Loopjacking occurs when a human approves operation A but the system executes a materially different operation B. The paper demonstrates this attack in multiple released agent products and proposes binding mechanisms to prevent it.
Method
Penulis melakukan evaluasi purposif terhadap beberapa produk agen yang telah dirilis, dengan fokus pada mekanisme persetujuan HITL mereka. Mereka menguji dua jenis Loopjacking: ke…
Results
Evaluasi berhasil mereproduksi serangan Loopjacking pada beberapa produk. Substitusi status pasca-persetujuan direproduksi pada tujuh rilis Agno AgentOS yang diuji (hingga 3.0.9) dan pada 12 versi ya…
Provenance-Aware Transformers assign each input token a ring ID encoding its origin and augment the model with origin embeddings, a learnable origin attention bias, and a learnable origin scale. This architecture maintains robust resistanc…
Method
Arsitektur yang diusulkan memberikan setiap token masukan sebuah ring ID yang mengodekan asalnya. Model diperkaya dengan tiga komponen utama: origin embedding, bias atensi origin …
Results
Evaluasi menunjukkan bahwa Transformer Sadar Provenans mempertahankan ketahanan yang kokoh terhadap IPI baik in-distribution maupun out-of-distribution sekaligus menjaga utilitas yang sebanding denga…
NetInspector addresses the critical gap in LLM-based Intent-Based Networking by decoupling information retrieval from reasoning, enforcing a verify-then-act protocol that grounds every policy decision in live network facts. On a 2,224-samp…
Method
NetInspector adalah kerangka agentic tiga lapis yang dirancang untuk memberlakukan protokol verify-then-act. Arsitekturnya terdiri dari: 1. **Environment Layer**: Menjaga represen…
Results
Penulis mengevaluasi NetInspector pada NetInspector-Bench, benchmark sintetis 2.224 sampel yang mencakup topologi kampus, enterprise, dan WAN. Benchmark ini mencakup beragam intent dan kebijakan keam…
Francis Hahn; Spencer Cherry; Kumar Shashwat; Laura Araujo Buldrini; Daniel Lende; Xinming Ou
Summary
This ethnographic study introduces "non-perishable knowledge"—investigative thinking skills independent of specific tools—and evaluates a scenario-based training method designed to impart it. Through 20 hours of training with 25 students a…
Method
Penulis merancang dua skenario pelatihan berdasarkan insiden dunia nyata. Skenario ini disajikan kepada peserta pelatihan secara tool-agnostic, mengharuskan mereka menyelesaikan t…
Results
Studi ini mengumpulkan data dari 20 jam pelatihan yang melibatkan 25 peserta pelatihan dalam lima sesi. Analisis etnografis mengungkap berbagai faktor yang menghambat atau mendorong pembelajaran kete…
X-SPUR replaces handcrafted traffic features with raw packet-field token sequences learned via causal language modeling, detecting anomalies through per-token cross-entropy surprisal. It achieves an AUC of 0.9987 on TOW-IDS and provides fi…
Method
X-SPUR terdiri atas tiga komponen inti: tokenisasi bidang paket mentah, arsitektur fusi bimodal, dan kalibrasi Z-score dual top-$k$% per protokol. **Tokenisasi dan pemodelan bahas…
Results
Pada dataset TOW-IDS, X-SPUR mencapai AUC 0,9987. Ini sedikit lebih tinggi daripada 0,9969 yang dilaporkan untuk AERO, detektor tanpa supervisi sebelumnya yang terkuat. Yang lebih penting, X-SPUR men…
Ahmed Shah; Ibrahim Abualhaol; Mahmoud Gad; Michael Weiss
Summary
This paper presents a prototype system that monitors real-time Border Gateway Protocol (BGP) traffic for anomalies, combining automated detection with exploratory visualization. It argues that the complementary strengths of both approaches…
Method
Penulis mengembangkan sistem prototipe yang menyerap lalu lintas BGP real-time dan menghitung indikator serta alert ancaman. Arsitekturnya menggabungkan modul analisis otomatis de…
Results
Makalah ini melaporkan pengembangan platform prototipe yang berfungsi yang menghitung indikator dan alert ancaman secara real-time serta memvisualisasikan konteks alert. Meskipun abstrak tidak member…
Hybrid key establishment combines a post-quantum KEM with a classical Diffie-Hellman primitive, but a standalone hybrid KEM does not protect the integrity of the negotiation that selects primitives, allowing an active attacker to strip the…
Method
Pekerjaan ini berlangsung dalam tiga bagian: definisi formal, bukti keamanan, dan model biaya terkalibrasi. **Definisi.** Penulis memperkenalkan definisi berbasis permainan tentan…
Results
Penulis melaporkan hasil keamanan sekaligus kinerja. **Keamanan.** Pemisahan dua sisi adalah hasil utamanya. Combiner yang mengabaikan transkrip pasti mengalami downgrade, artinya penyerang aktif sel…
Long-running AI agents outlive their initiating processes through credentials, delegated tasks, queues, callbacks, and provider-side operations, so cancellation and credential revocation alone cannot close every pre-cut carrier. The author…
Method
Protokol kuisensi berlingkup akar melinearisasi potong akar, mem-fence ekspansi akar lama dan sink yang dilindungi, serta merepresentasikan otoritas alternatif dan konjungtif seba…
Results
Di bawah asumsi yang dinyatakan, penulis membuktikan enam properti: non-ekspansi penerbit pasca-potong, proyeksi yang sound terhadap dukungan, kesoundan komposisional di bawah konservasi kanal yang e…
Shaefer Drew; Michael Brautbar; Paul Knight; Edward Raff; Lana Peric-McDermott; Simran Sarin; Nickolas Machado; Hanna A…
Summary
This paper presents the first deployed system for detecting product abuse in security platforms, achieving a 35% increase in coverage and a 30% reduction in monthly alerts through multi-modal machine learning.
Method
Sistem yang diusulkan mengumpulkan dan mengintegrasikan data dari berbagai modalitas—seperti log, aktivitas pengguna, dan telemetri produk—di berbagai jenis basis data. Untuk mena…
Results
Sistem yang diterapkan menunjukkan peningkatan signifikan: peningkatan cakupan penyalahgunaan produk sebesar 35% dan pengurangan peringatan bulanan sebesar 30%. Ini menunjukkan bahwa pendekatan machi…
Conformal Privacy Auditing (CPA) provides finite-sample statistical guarantees for re-identification risk in released text, outputting conformal ambiguity sets that contain the true identity with user-chosen confidence. It unifies audits o…
Method
CPA bekerja dengan mengalibrasi conformal predictor pada sekumpulan dokumen dengan identitas yang diketahui, menggunakan skor nonconformity yang mengukur seberapa baik suatu kandi…
Results
Pada berbagai tolok ukur rilis dan konfigurasi penyerang, CPA mencapai cakupan terkalibrasi, artinya cakupan empiris himpunan ambiguitas sangat mendekati tingkat keyakinan nominal $1-\alpha$. Penulis…