Editorial ilmu komputer
Kegagalan Privasi dalam Pelatihan Split-LLM: Gradien yang Dikembalikan Menetralkan Decoy
Masalah inti
Inovasi
Protokol eksperimen ditetapkan sebelumnya untuk menghindari penyetelan post hoc. Protokol ini mencakup tiga komponen: (1) kebocoran yang disuntikkan pada kekuatan yang diketahui untuk membuktikan instrumen dapat melihatnya, (2) kontrol label teracak untuk membuktikan instrumen tidak melaporkan kebocoran yang tidak ada, dan (3) ambang batas yang ditetapkan sebelum eksekusi. Sistem yang diuji adalah setup pelatihan split-LLM dua-node. TLN mengirim aktivasi terproteksi ke UCN; UCN mengembalikan outputnya; TLN, yang memegang loss privat, mengembalikan gradien output. Frame yang diterima UCN mencampur baris asli dengan decoy, dan loss mengabaikan decoy. Secara formal, untuk frame yang berisi baris asli dan baris decoy , loss hanya bergantung pada , sehingga untuk setiap baris decoy gradien yang dikembalikan memenuhi
Mengapa penting
Siapa yang sebaiknya membaca
Membuka konten memberโฆ