Richard Lawrence; Zhenhua He; Dhruva K. Chakravorty; Wesley A. Brashear; Honggao Liu; S. Nite; Lisa M. Perez; Chris Fra…
Ringkasan
Summer Computing Academy (SCA) menjawab kesenjangan dalam pendidikan komputasi sekolah menengah dengan menawarkan program dua pekan yang berfokus pada sains data dan keamanan siber, disatukan oleh pemrograman Python. Kurikulum ini dirancan…
Metode
Program SCA disusun sebagai akademi intensif dua pekan. Pekan pertama, berjudul 'Computing for a Better Tomorrow: Data Sciences', membenamkan siswa dalam aplikasi nyata pemrosesan…
Hasil
Program SCA berhasil melibatkan siswa sekolah menengah dalam aktivitas komputasi praktik langsung. Siswa memperoleh pengalaman praktis dalam pemrograman Python sekaligus mengeksplorasi penerapannya d…
Chenyu Wang; Yunbo Lyu; Junda He; Zhou Yang; Chenxing Zhong; Yaniv Harel; David Lo
Ringkasan
FailFast-RestartSmart menggabungkan monitor kegagalan ringan 0.6B dengan rollout baru berkebijakan sama yang dapat memakai ulang diff repositori yang terputus. Pada SWE-bench Verified, sistem ini menghemat 14,6%–20,4% token eksekusi pada t…
Metode
Monitor FailFast adalah model 0.6B parameter yang dilatih dengan dua sinyal supervisi: label terminal fail-to-pass dan supervisi dense fail-to-pass atas prefiks. Yang krusial, mod…
Hasil
Pada SWE-bench Verified, monitor FailFast yang dilatih hanya pada lintasan Qwen3.6-27B ditransfer ke tiga kebijakan lain, termasuk model closed-API. Pada target tingkat false-positive 5%, sistem meng…
Jikai Wang; Ningyu He; Tianming Liu; Junhai Wang; Haoyu Wang
Ringkasan
NotDec adalah kerangka dekompilasi WebAssembly yang memperluas pemeriksaan tipe Wasm ke IR berbasis SSA, menerapkan pemulihan tipe antar-prosedur (Retypd) dengan pembedaan pointer/numerik, dan menghasilkan kode C yang konsisten secara sema…
Metode
Pipeline NotDec terdiri dari empat tahap utama. Pertama, kerangka ini **memperluas algoritma pemeriksaan tipe WebAssembly** untuk mengangkat bytecode menjadi IR berbasis SSA. Perl…
Hasil
Evaluasi melaporkan hasil kuantitatif yang kuat. NotDec mencapai **tingkat keberhasilan rekompilasi 100%** pada seluruh **5.241 sampel Juliet** dan semua **program dataset Howard**, jauh melampaui ba…
Xavier Wrenn; Radoslav Raykov; Aleksandar Angelov; Hirokuni Kitahara; Yuji Watanabe; Anca Sailer
Ringkasan
Makalah ini mengevaluasi enam large language model untuk generasi alur kerja berbasis AI di platform perusahaan produksi, dengan benchmark 2.784 eksekusi di 29 skenario otomasi TI. Pipeline piecewise yang dirancang ulang menaikkan keberhas…
Metode
Evaluasi membandingkan dua arsitektur pipeline generasi. Pipeline awal menggunakan generasi alur kerja monolitik, di mana satu panggilan LLM menghasilkan seluruh JSON alur kerja. …
Hasil
Pipeline monolitik mencapai tingkat keberhasilan struktural berkisar dari 31,5% hingga 82,8% di seluruh model, dengan sebagian besar model kesulitan pada generasi JSON yang kompleks. Pipeline piecewi…
Yunqi Chen; Thomas Zimmermann; Bianca Trinkenreich
Ringkasan
Menganalisis 29.624 repositori GitHub, studi ini mengidentifikasi 385 proyek dengan kebijakan tata kelola AI dan memperkenalkan TRACE, kerangka lima dimensi (Transparency, Responsibility, Attribution, Constraints, Enforcement). Dengan prop…
Metode
Studi ini mengikuti desain empiris multi-tahap pada korpus GitHub berskala besar. **Pengumpulan data dan identifikasi kebijakan.** Para penulis menganalisis 29.624 repositori GitH…
Hasil
Analisis empiris menghasilkan beberapa temuan inti. **Prevalensi dan sifat kebijakan AI.** Di antara 29.624 repositori, 385 proyek mengadopsi kebijakan AI. Kebijakan-kebijakan tersebut terutama menga…
Yu Pei; Cunming Zhang; Jeongju Sohn; Mike Papadakis
Ringkasan
Makalah ini memperkenalkan kerangka inferred-metamorphic-relation untuk menilai test suite komponen UI, menunjukkan bahwa pengujian yang ada menjalankan jauh lebih banyak relasi perilaku daripada yang divalidasinya secara eksplisit. Cakupa…
Metode
Kerangka yang diusulkan beroperasi dalam tiga tahap utama. Pertama, dengan diberikan sumber, dokumentasi, dan pengujian sebuah komponen, kerangka ini menginferensi MR spesifik kom…
Hasil
Evaluasi menunjukkan bahwa test suite yang ada menjalankan jauh lebih banyak relasi perilaku daripada yang divalidasinya secara eksplisit. Pada tiga konfigurasi LLM, MR Cover tetap antara 42,5% dan 4…
RAV menggabungkan routing prompt yang sadar tugas, adaptasi LoRA yang selaras, dan verifikasi berbasis eksekusi untuk meningkatkan kebenaran fungsional pada MBPP, mencapai 0.8911 pada MBPP Sanitized dan 0.8520 pada MBPP Full. Pipeline ini …
Metode
RAV diorganisasikan sebagai pipeline tiga tahap yang diterapkan pada model backbone tetap. 1. **Route** — routing prompt yang sadar tugas sebelum generasi. Alih-alih menggunakan s…
Hasil
Pipeline RAV lengkap mencapai kinerja terbaik di antara semua konfigurasi yang dievaluasi pada benchmark MBPP. Pipeline ini mencapai **0.8911 pada MBPP Sanitized** dan **0.8520 pada MBPP Full**. Diba…
Survei ini menyintesis bidang yang sedang berkembang tentang agen coding yang berevolusi sendiri, yang secara persisten memperbarui framework, memori, keterampilan, alat, alur kerja, atau lingkungannya dari interaksi coding sebelumnya. Sur…
Metode
Survei ini mengikuti pendekatan sintesis literatur yang sistematis. Para penulis mendefinisikan cakupan dengan membedakan agen coding yang berevolusi sendiri dari dua konsep yang …
Hasil
Survei ini melaporkan lanskap yang berkembang tetapi terfragmentasi. Temuan utama meliputi: - **Umpan balik yang dapat dieksekusi adalah pendorong utama**: Hasil pengujian, kesalahan runtime, dan jej…
Adopsi AI tidak secara seragam menambah atau mengurangi community smells pada tim perangkat lunak; sebagai gantinya, adopsi AI bekerja melalui mekanisme yang berbeda bergantung pada jenis kerja kolaboratif. Pada kerja spesialisasi, AI berk…
Metode
Penelitian ini mengikuti desain kuantitatif yang digerakkan teori, menggabungkan validasi instrumen dengan pemodelan persamaan struktural. **Landasan teoretis.** Model ini berland…
Hasil
Analisis PLS-SEM mengungkapkan bahwa adopsi AI berkaitan dengan community smells **tidak dengan satu cara saja**, melainkan melalui mekanisme yang bergantung pada jenis pekerjaan. **Jalur kerja spesi…
Analisis bibliometrik ini memetakan penelitian pendidikan kimia berbasis kearifan lokal dari 2015 hingga 2024, menyoroti kontribusi signifikan Indonesia dan perlunya integrasi pengetahuan lokal yang lebih besar.
Metode
Penelitian ini menggunakan pendekatan bibliometrik. Data diambil dari database Web of Science, mencakup publikasi dari 2015 hingga 2024. Strategi pencarian kemungkinan menggabungk…
Hasil
Analisis mengungkap fluktuasi dalam tren publikasi dari 2015 hingga 2024, dengan puncak pada 2023. Indonesia termasuk dalam 10 negara kontributor teratas, yang mencerminkan keragaman budaya dan geogr…