Jadwal Sholat

Memuat jadwal sholatโ€ฆ

Editorial Ilmu Komputer & AI

Open AccessOA2026

Mengaudit Model AI Anonim: Protokol Empat Tahap untuk Verifikasi Identitas Black-Box

Digest forensik berstruktur IMRAD atas protokol empat tahap Yisen Xi untuk mengidentifikasi model frontier yang dirilis secara senyap melalui audit black-box API
Yisen Xiยท 2026ยท DOI 10.48550/arXiv.2608.31142

Masalah inti

## Masalah Rilis Senyap

Pasar AI 2025โ€“2026 menyaksikan gelombang **rilis senyap**: model frontier diluncurkan secara anonim di platform pengembang dengan nama sandi. Bagi penggunanya, identitas menentukan ketentuan penanganan data, risiko rantai pasok, dan ekspektasi kapabilitas. Namun belum ada metodologi tervalidasi untuk verifikasi identitas black-box model anonim. Daftar periksa praktisi kurang bukti akurasi, dan identifikasi diri tidak dapat dipercaya secara desain โ€” model dapat begitu saja mengklaim dirinya sebagai apa pun yang diminta.

Xi merumuskan celah penelitian inti sebagai berikut: identitas adalah pertanyaan *forensik*, bukan *deklaratif*. Karena itu, makalah ini menanyakan apakah seorang auditor, hanya bermodal akses API dan artefak publik, dapat menghasilkan **hipotesis bertingkat yang dapat difalsifikasi** tentang keluarga dan lini versi model anonim โ€” dan, yang krusial, apakah hipotesis itu dapat divalidasi secara prospektif terhadap pengungkapan resmi di kemudian hari.

Kontribusinya adalah protokol empat tahap (Tahap 0 hingga Tahap 3) plus implementasi referensi yang hanya memakai pustaka standar, dirilis sebagai materi suplemen. Taksonomi karya ini mencakup r

Inovasi

## Konsistensi Deklarasi dan Validasi Prospektif

### Hasil Himpunan Uji (10 Rilis Beridentitas Diketahui)

| Hasil | Jumlah |
|---|---|
| Persis | 7 |
| Perbedaan presisi | 2 |
| Parsial | 1 |
| Berlawanan arah | 0 |

Hasil **nol berlawanan arah** adalah properti keamanan utama: tidak sekali pun protokol menunjuk *berlawanan* dengan identitas sebenarnya. Dua perbedaan presisi dan satu parsial menunjukkan keluaran alami protokol adalah **hipotesis bertingkat**, bukan putusan biner.

### Kasus Unggulan Prospektif

Protokol divalidasi secara **prospektif** pada kasus unggulan. Analisis **2026-08-23** menunjuk ke **lini versi GLM-5.3**. **Pengungkapan resmi** berikutnya **mengonfirmasi inferensi keluarga dan lini versi** tersebut.

Catatan penting yang dinyatakan penulis:

- **Varian penerapan tidak diasumsikan sebelumnya**.
- **Flash konsisten pasca-pengungkapan** โ€” artinya, ia tidak dikesampingkan, tetapi tidak diklaim sebelumnya.

### Kasus Hanya Tahap 0

Pada **tiga kasus hanya Tahap 0**, protokol menghasilkan **hipotesis bertingkat** atau **menolak** alih-alih menduga. Inilah disiplin epistemik protokol: abstensi adalah keluaran yang sah.

### Implementasi

**Implementasi yang ha

## Masalah Rilis Senyap
Pasar AI 2025โ€“2026 menyaksikan gelombang **rilis senyap**: model frontier diluncurkan secara anonim di platform pengembang dengan nama sandi. Bagi penggunanya, identitas menentukan ketentuan penanganan data, risiko rantai pasok, dan ekspektasi kapabilitas. Namun belum ada metodologi tervalidasi untuk verifikasi identitas black-box model anonim. Daftar periksa praktisi kurang bukti akurasi, dan identifikasi diri tidak dapat dipercaya secara desain โ€” model dapat begitu saja mengklaim dirinya sebagai apa pun yang diminta.

Mengapa penting

## Mengapa Protokol Ini Bekerja โ€” dan di Mana Tidak

### Desain Epistemik

Kekuatan protokol ini adalah memisahkan **kelas bukti** dengan sifat kepercayaan yang berbeda:

1. **Snapshot terarsip** (Tahap 0) adalah *artefak historis* โ€” tidak dapat dipengaruhi oleh model yang diaudit.
2. **Sidik jari konfigurasi** (Tahap 1) adalah *fakta katalog platform* โ€” kasar tetapi stabil.
3. **Diferensial tokenizer** (Tahap 2) bersifat *nyaris kriptografis*: identitas tokenizer sulit dipalsukan tanpa benar-benar menjadi model tersebut, dan syarat lintas panjang mengalahkan serangan tabrakan prompt pendek.
4. **Probe perilaku** (Tahap 3) bersifat *koroboratif*, bukan primer โ€” dibobot secara tepat demikian.

### Jebakan Identifikasi Diri

Kerangka makalah bahwa identifikasi diri "tidak dapat dipercaya secara desain" adalah model ancaman yang tepat. Protokol apa pun yang menanyakan kepada model siapa dirinya sudah kalah sejak awal. Protokol Xi tidak pernah melakukannya.

### Batasan

- Himpunan uji 10 rilis mengukur **konsistensi deklarasi**, bukan identifikasi ujung-ke-ujung dalam kondisi anonimitas.
- Kasus unggulan mengonfirmasi **keluarga dan lini versi**, tetapi **varian penerapan** tidak diasumsikan sebelumnya โ€” pengingat bahwa inferensi lini versi bukan inferensi varian.
- Kasus hanya Tahap 0 menunjukkan protokol dapat **menolak**; tingkat abstensi dalam anonimitas sejati masih menjadi pertanyaan terbuka.

### Implikasi

Bagi praktisi **Keamanan Siber** dan **Jaringan**, protokol ini menawarkan pola forensik yang dapat digunakan ulang: rekonstruksi, sidik jari, uji diferensial, koroborasi. Bagi peneliti **Arsitektur**, diferensial tokenizer adalah primitif identitas yang konkret dan dapat diuji. Bagi **Kriptografi**, argumen penolakan tabrakan lintas panjang adalah gagasan yang paling mudah ditransfer โ€” klaim identitas seharusnya mensyaratkan kesepakatan pada *spektrum* probe, bukan satu titik.

### Pekerjaan Selanjutnya

Langkah berikutnya yang jelas adalah uji prospektif yang lebih besar dalam anonimitas sejati, dengan hipotesis yang diregistrasi sebelumnya dan tingkat abstensi yang dilaporkan.

Siapa yang sebaiknya membaca

Praktisi dan peneliti ilmu komputer

Membuka konten memberโ€ฆ