Studi ini mengevaluasi tiga metode watermarking LLM (KGW, Unigram, SynthID-Text) terhadap kelayakan Daubert dan kriteria forensik NIST SP 800-86 menggunakan Forensic Readiness Score yang diusulkan. Semua watermark yang awalnya terdeteksi d…
Metode
Studi ini mengevaluasi tiga metode watermarking: KGW, Unigram, dan implementasi MarkLLM dari SynthID-Text. Para penulis menggunakan 15 prompt beragam per metode, menghasilkan tota…
Hasil
Dari 846 proses parafrase yang valid di 15 prompt beragam per metode, setiap teks KGW dan Unigram yang awalnya terdeteksi kehilangan watermarknya setelah parafrase -- penghapusan kondisional 100%. Sy…
Ferrario (2026) mengusulkan metodologi ringan yang berpusat pada fungsi tingkat kepercayaan—aturan yang dapat diaudit yang memetakan profil kepercayaan terukur ke tingkat yang relevan bagi tata kelola. Pendekatan ini memisahkan bukti dari …
Metode
Metodologi ini memperkenalkan fungsi tingkat kepercayaan sebagai objek tata kelola inti. Secara formal, misalkan $\mathbf{p} \in \mathcal{P}$ menyatakan profil kepercayaan terukur…
Hasil
Metodologi ini diilustrasikan pada skenario siklus hidup AI sintetis yang mensimulasikan tantangan tata kelola yang realistis. Skenario-skenario ini meliputi: - **Degradasi**: Penurunan kinerja secar…
Penelitian ini menganalisis 87.617 pesan dari enam belas kanal Telegram (delapan pro-Israel, delapan pro-Palestina) sepanjang Mei 2021 hingga Juni 2026, menggabungkan analisis sentimen, tiga metode deteksi sikap, dan analisis pembingkaian.…
Metode
Para penulis memakai pipeline komputasional multi-metode yang mengintegrasikan analisis sentimen, tiga metode deteksi sikap, dan analisis pembingkaian. Analisis sentimen dilakukan…
Hasil
Model BERTweet yang di-fine-tune mencapai performa terbaik, dengan akurasi 72,1% dan macro F1 0,721 pada 5-fold cross-validation. Ini merupakan peningkatan 8 hingga 11 poin persentase dibandingkan ba…
Sunny Rai; Jinyi Kuang; Reyhan Jamalova; Annie Lou; Cristina Bicchieri; Niyati Malhotra; Victor Hugo Orozco-Olvera; Ana…
Ringkasan
Makalah ini memperkenalkan kerangka kerja untuk mengevaluasi penalaran metanorma pada LLM, dengan fokus pada penilaian emosional dan respons perilaku. Menggunakan dataset NormReact yang terdiri dari 450 skenario, studi ini menemukan bahwa …
Metode
Para penulis mengembangkan kerangka kerja untuk mengevaluasi penalaran metanorma pada LLM dengan berfokus pada dua dimensi utama: penilaian emosional dan respons perilaku. Mereka …
Hasil
Pada enam LLM, model-model tersebut secara konsisten terlalu banyak memprediksi sanksi negatif di mana manusia akan mengharapkan tidak ada tindakan. Hal ini menunjukkan gambaran dunia sosial yang leb…
Saiph Savage; Jesse Nava; Wanqing Iris Zhou; Hwijoon Lee
Ringkasan
Survei terhadap 31 orang yang pernah dipenjara menemukan bahwa mereka membayangkan teknologi pembebasan bersyarat sebagai sumber daya untuk menavigasi kekuasaan, bukan sebagai instrumen untuk menghapus sistem penjara. Studi ini berargumen …
Metode
Studi ini menggunakan survei terhadap 31 individu yang pernah dipenjara. Peserta ditanya tentang pengalaman pembebasan bersyarat mereka dan visi mereka untuk teknologi yang dapat …
Hasil
Peserta tidak membayangkan alat komputasional sebagai instrumen untuk membongkar sistem penjara. Sebaliknya, mereka membayangkan teknologi sebagai sumber daya untuk menavigasi kekuasaan. Tiga peran u…
Makalah ini mengusulkan kerangka kerja onboarding SaaS end-to-end berbasis kontrol yang mengintegrasikan Third-Party Risk Management, penilaian keamanan siber, Identity and Access Management, dan pemulihan bencana ke dalam satu siklus hidu…
Metode
Metodologinya adalah kerangka kerja onboarding SaaS end-to-end berbasis kontrol yang mengintegrasikan TPRM, keamanan siber, IAM, dan DR ke dalam model siklus hidup terpadu. Siklus…
Hasil
Makalah ini melaporkan tiga hasil utama. Pertama, makalah ini menyajikan siklus hidup onboarding terstruktur yang membuat pengurutan dan manajemen dependensi menjadi eksplisit lintas domain kontrol. …
Kerangka kerja pratinjau awal triplet-buta multi-LLM untuk jurnal ilmu kesehatan mengarahkan naskah melalui sanitasi, tinjauan AI lokal paralel, gerbang pemeriksaan otomatis, tinjauan manusia secara buta, dan adjudikasi editorial. Semua pe…
Metode
Kerangka kerja ini mengarahkan kiriman melalui lima tahap dengan loop pengembalian ke penulis pada tahap pemeriksaan dan editor: 1. **Sanitasi/Anonimisasi**: Naskah dihapus dari i…
Hasil
Kerangka kerja ini dikembangkan untuk jurnal ilmu kesehatan, tetapi tidak ada hasil empiris dari penerapan yang dilaporkan dalam sumber. Temuan kuantitatif utama yang dikutip berasal dari pekerjaan s…
Makalah ini berargumen bahwa biaya privasi—kebocoran informasi yang ditanggung setiap kelompok demografis—itu sendiri merupakan suatu kerugian, dan mengusulkan Privacy-Cost Equity Ratio (PCER) sebagai metrik keadilan kelompok yang menormal…
Metode
Dari prinsip keadilan kompensatori, penulis menurunkan **Privacy-Cost Equity Ratio (PCER)**, metrik keadilan kelompok yang didefinisikan sebagai tingkat prediksi positif suatu kel…
Hasil
Hasilnya mengungkap pola yang terlewat oleh metrik berbasis hasil. Pada COMPAS, PCER menemukan kerugian ganda yang persisten: kelompok terlindungi menanggung paparan privasi yang lebih besar sekaligu…
Gurukul AI mengkurasi 18.720 pasangan tanya-jawab selaras NCERT di lima mata pelajaran dan menyetel halus LLaMA 3.1 8B dalam kerangka RAG untuk menyajikan bimbingan belajar bilingual yang berorientasi ujian bagi siswa India.
Metode
Metodologi terdiri atas tiga tahap: kurasi dataset, penyetelan halus model, dan penyebaran berbasis RAG. **Kurasi dataset.** Penulis membangun dataset tanya-jawab dari buku teks N…
Hasil
Hasil utamanya adalah pembuatan dan perilisan publik dataset tanya-jawab selaras silabus yang memuat 18.720 pasangan pertanyaan–jawaban di lima mata pelajaran, yang diturunkan dari buku teks NCERT un…
Karya ini mengadaptasi metode pembelajaran sistem nilai yang telah tervalidasi ke AI generatif, sekaligus mempelajari landasan reward multiobjektif dan sistem nilai skalarisasi linear berbobot dari preferensi pasangan prompt-respons. Algor…
Metode
Metode yang diusulkan beroperasi pada data preferensi pasangan prompt-respons, di mana setiap pasangan menunjukkan preferensi manusia antara dua respons terhadap prompt yang sama.…
Hasil
Para penulis mengevaluasi metode mereka pada dataset preferensi prompt-respons, membandingkannya dengan baseline dan pendekatan kontemporer. Hasilnya menunjukkan kinerja kompetitif dengan trade-off m…