Mark Russinovich; Blake Bullwinkel; Giorgio Severi; Cristian Ovadiuc; Ahmed Salem
Summary
A weaker, unaligned model can decompose a harmful task into benign-looking subproblems, consult a stronger aligned model on each independently, and recombine the answers locally—an attack the authors call capability laundering. Refusing a …
Method
Desain eksperimen memisahkan peran menjadi **orkestrator** (model lokal yang lebih lemah dan tak selaras) dan **konsultan** (model terdepan yang lebih kuat dan selaras). Orkestrat…
Results
Pada **CyBench**, Gemma-4-31B memulihkan 8/14 kandidat dengan GPT-5.5 sebagai konsultan dan 7/9 dengan Opus, dibandingkan hanya 2/21 dan 4/15 untuk orkestrator Gemma-4-12B yang lebih lemah. Ini menun…
This paper evaluates a three-source permission architecture that eliminates standing credential exposure for AI agents by scoping access per task. A fine-tuned RoBERTa-large encoder matches few-shot Claude Haiku 4.5 on classification quali…
Method
Evaluasi ini mengimplementasikan security gate sebagai encoder **RoBERTa-large** yang di-fine-tune dan dilatih pada dataset berlabel 600 prompt yang dirilis oleh Noyan (2026). Gat…
Results
Encoder RoBERTa-large yang di-fine-tune menyamai few-shot trained Claude Haiku 4.5 pada kualitas klasifikasi di seluruh metrik yang dilaporkan: | Metrik | RoBERTa-large (fine-tuned) | Claude Haiku 4.…
This empirical study analyzes open-source software in onboard satellite systems across 126 repositories, producing 2,827 security findings. Medium-severity issues account for 49% of findings, and 72% are medium or higher, with memory safet…
Method
Para penulis menganalisis 126 repositori publik menggunakan pipeline bertahap yang menggabungkan beberapa teknik analisis keamanan. Pipeline ini mengintegrasikan: - **Pembuatan So…
Results
Analisis menghasilkan 2.827 temuan, mengungkap bahwa masalah keamanan tersebar luas tetapi tidak merata. Hasil kuantitatif utama meliputi: - **Distribusi keparahan:** Temuan tingkat sedang mencakup 4…
Third-party worker descriptions in centralized LLM-based multi-agent systems are trusted by the planner but authored outside the system, creating a registration-time injection channel that can cut task success from 84.31% to 37.25%. The au…
Method
Penulis membangun **delapan strategi serangan manipulasi deskripsi** yang menyasar tiga perilaku perencana: penguraian tugas, pembumian kapabilitas, dan spesifikasi subtugas. Seti…
Results
Pada kasus paling parah, **satu deskripsi yang dimanipulasi** menurunkan keberhasilan tugas dari **84,31% menjadi 37,25%**, atau meningkatkan konsumsi token atau waktu eksekusi **lebih dari 111%**, s…
Stevanovic and Wachter present a semi-automated pipeline that parses Trivy, Semgrep, and Nmap findings into MulVAL predicates and uses an LLM-assisted process to construct domain-specific Datalog rules, enabling symbolic attack graph gener…
Method
Pipeline yang diusulkan terdiri dari tiga tahap utama: (1) mengurai temuan dari Trivy, Semgrep, dan Nmap menjadi predikat MulVAL; (2) menggunakan proses berbantuan LLM untuk memba…
Results
Setiap tugas menghasilkan setidaknya satu graph yang mencapai tujuan. Pipeline ini mencapai cakupan kerentanan ground-truth rata-rata 53,7%, dengan 51,9% tugas mencapai cakupan penuh. Tingkat jalur n…
I. Petkovska; O. Alus; Lee Rodriguez; M. El Homsi; J. G. Golia Pernicka; Maria Clara Fernandes; Jun-Ting Zheng; M. Capa…
Summary
A denoising neural network accelerates diffusion-weighted imaging (DWI) in rectal cancer restaging after total neoadjuvant therapy, reducing scan times while preserving image quality and diagnostic accuracy. The study demonstrates that 8- …
Method
Studi retrospektif satu pusat ini melibatkan pasien kanker rektum lokal lanjut yang menjalani MRI rektum restaging antara 30 Desember 2021 dan 1 Juni 2022 setelah TNT. Convolution…
Results
Sebanyak 46 pasien (usia median 60 tahun [IQR: 47–72]; 37 pria dan 9 wanita) diikutsertakan. Gambar dengan percepatan 8 dan 16 kali, setelah denoising, mempertahankan atau menunjukkan visibilitas les…
This position paper argues that the primary challenge in GenAI privacy engineering is the missing bridge between threat knowledge and mitigation techniques, not the lack of either. It decomposes this gap into three sub-problems and propose…
Method
Sebagai makalah posisi, karya ini tidak mengikuti metodologi empiris tradisional. Sebaliknya, karya ini menyintesis pengetahuan yang ada dari pemodelan ancaman privasi dan penelit…
Results
Makalah ini mengidentifikasi tiga sub-masalah yang membentuk kesenjangan antara ancaman privasi GenAI dan mitigasi: 1. **Kurangnya pemetaan ancaman-ke-mitigasi yang terperinci untuk sistem GenAI**: M…
RIBA, a reinforcement learning inspired black-box adversarial attack, reduces median queries by up to 25.4% compared to state-of-the-art methods on CIFAR-10 and ImageNet, and matches white-box performance on adversarially trained models.
Method
RIBA merumuskan pembangkitan perturbasi adversarial sebagai masalah reinforcement learning. Penyerang berinteraksi dengan model target sebagai lingkungan, menerima reward berdasar…
Results
Penulis mengevaluasi RIBA terhadap serangan black-box state-of-the-art pada dataset CIFAR-10 dan ImageNet menggunakan model ResNet-18 dan ViT-B/16. Pada CIFAR-10 dengan ResNet-18, RIBA memerlukan 25,…
Graph neural networks over control flow graphs are evaluated with a strict temporal split, showing that the choice of message-passing operator significantly affects robustness to distribution shift and that the most accurate operator on la…
Method
Penelitian ini menggunakan pemisahan temporal yang ketat untuk mengevaluasi arsitektur GNN untuk deteksi malware. CFG diekstraksi secara statis dari Windows portable executable, d…
Results
Pilihan operator message-passing secara signifikan mengubah ketahanan terhadap pergeseran temporal. Setiap selisih berpasangan yang bertahan setelah koreksi memisahkan arsitektur agregasi dari arsite…
This paper establishes two lower bounds: the shared-randomness cost of robust conditional disclosure of secrets (CDS) is at least the logarithm of deterministic SMP communication complexity, and the entanglement cost of one-sided-perfect f…
Method
Penulis menggunakan dua teknik yang berbeda. Untuk CDS yang robust, mereka menunjukkan bahwa biaya shared randomness dibatasi bawah oleh logaritma dari kompleksitas komunikasi SMP…
Results
Makalah ini menyajikan dua hasil utama. Pertama, untuk CDS yang robust, biaya shared randomness dibatasi bawah oleh logaritma dari kompleksitas komunikasi SMP deterministik. Secara formal, untuk seti…