Zofia Boni; Zofia Bieńkowska; F. Chwałczyk; Barbara Jancewicz; I. Mărginean; Paloma Yáñez Serrano
Ringkasan
Artikel ini mengusulkan kerangka interdisipliner untuk memahami gelombang panas sebagai objek yang beragam, dengan memadukan antropologi sosial, sosiologi, ilmu iklim, epidemiologi, dan meteorologi. Artikel ini menyoroti kesenjangan penget…
Metode
Penelitian ini didasarkan pada riset yang dilakukan di Polandia dan Spanyol, dengan fokus pada orang dewasa lanjut usia di Warsawa dan Madrid. Penelitian ini memadukan data dan pe…
Hasil
Ahli klimatologi dan meteorologi mendefinisikan gelombang panas sebagai episode berkepanjangan dengan suhu yang luar biasa tinggi. Ahli epidemiologi memandang gelombang panas melalui kenaikan angka m…
Penelitian ini mengkaji indikator bibliometrik dosen di FEUP dan departemen teknik mesin Portugal lainnya, mengungkap kinerja ilmiah yang lebih tinggi seiring jenjang akademik serta perbedaan antar- dan intra-institusi yang mencolok.
Metode
Metodologi melibatkan pemrosesan dan analisis lembar data Scopus menggunakan indeks bibliometrik. Profil kutipan (CP) para profesor dapat diakses publik dan diambil dari basis dat…
Hasil
Hasil mengonfirmasi tren yang diharapkan, yaitu kinerja ilmiah yang lebih tinggi seiring jenjang akademik. Perbedaan antar- dan intra-institusi yang mencolok terungkap, terutama di FEUP, di mana stra…
Richard Lawrence; Zhenhua He; Dhruva K. Chakravorty; Wesley A. Brashear; Honggao Liu; S. Nite; Lisa M. Perez; Chris Fra…
Ringkasan
Summer Computing Academy (SCA) menjawab kesenjangan dalam pendidikan komputasi sekolah menengah dengan menawarkan program dua pekan yang berfokus pada sains data dan keamanan siber, disatukan oleh pemrograman Python. Kurikulum ini dirancan…
Metode
Program SCA disusun sebagai akademi intensif dua pekan. Pekan pertama, berjudul 'Computing for a Better Tomorrow: Data Sciences', membenamkan siswa dalam aplikasi nyata pemrosesan…
Hasil
Program SCA berhasil melibatkan siswa sekolah menengah dalam aktivitas komputasi praktik langsung. Siswa memperoleh pengalaman praktis dalam pemrograman Python sekaligus mengeksplorasi penerapannya d…
Chenyu Wang; Yunbo Lyu; Junda He; Zhou Yang; Chenxing Zhong; Yaniv Harel; David Lo
Ringkasan
FailFast-RestartSmart menggabungkan monitor kegagalan ringan 0.6B dengan rollout baru berkebijakan sama yang dapat memakai ulang diff repositori yang terputus. Pada SWE-bench Verified, sistem ini menghemat 14,6%–20,4% token eksekusi pada t…
Metode
Monitor FailFast adalah model 0.6B parameter yang dilatih dengan dua sinyal supervisi: label terminal fail-to-pass dan supervisi dense fail-to-pass atas prefiks. Yang krusial, mod…
Hasil
Pada SWE-bench Verified, monitor FailFast yang dilatih hanya pada lintasan Qwen3.6-27B ditransfer ke tiga kebijakan lain, termasuk model closed-API. Pada target tingkat false-positive 5%, sistem meng…
Jikai Wang; Ningyu He; Tianming Liu; Junhai Wang; Haoyu Wang
Ringkasan
NotDec adalah kerangka dekompilasi WebAssembly yang memperluas pemeriksaan tipe Wasm ke IR berbasis SSA, menerapkan pemulihan tipe antar-prosedur (Retypd) dengan pembedaan pointer/numerik, dan menghasilkan kode C yang konsisten secara sema…
Metode
Pipeline NotDec terdiri dari empat tahap utama. Pertama, kerangka ini **memperluas algoritma pemeriksaan tipe WebAssembly** untuk mengangkat bytecode menjadi IR berbasis SSA. Perl…
Hasil
Evaluasi melaporkan hasil kuantitatif yang kuat. NotDec mencapai **tingkat keberhasilan rekompilasi 100%** pada seluruh **5.241 sampel Juliet** dan semua **program dataset Howard**, jauh melampaui ba…
Xavier Wrenn; Radoslav Raykov; Aleksandar Angelov; Hirokuni Kitahara; Yuji Watanabe; Anca Sailer
Ringkasan
Makalah ini mengevaluasi enam large language model untuk generasi alur kerja berbasis AI di platform perusahaan produksi, dengan benchmark 2.784 eksekusi di 29 skenario otomasi TI. Pipeline piecewise yang dirancang ulang menaikkan keberhas…
Metode
Evaluasi membandingkan dua arsitektur pipeline generasi. Pipeline awal menggunakan generasi alur kerja monolitik, di mana satu panggilan LLM menghasilkan seluruh JSON alur kerja. …
Hasil
Pipeline monolitik mencapai tingkat keberhasilan struktural berkisar dari 31,5% hingga 82,8% di seluruh model, dengan sebagian besar model kesulitan pada generasi JSON yang kompleks. Pipeline piecewi…
Yunqi Chen; Thomas Zimmermann; Bianca Trinkenreich
Ringkasan
Menganalisis 29.624 repositori GitHub, studi ini mengidentifikasi 385 proyek dengan kebijakan tata kelola AI dan memperkenalkan TRACE, kerangka lima dimensi (Transparency, Responsibility, Attribution, Constraints, Enforcement). Dengan prop…
Metode
Studi ini mengikuti desain empiris multi-tahap pada korpus GitHub berskala besar. **Pengumpulan data dan identifikasi kebijakan.** Para penulis menganalisis 29.624 repositori GitH…
Hasil
Analisis empiris menghasilkan beberapa temuan inti. **Prevalensi dan sifat kebijakan AI.** Di antara 29.624 repositori, 385 proyek mengadopsi kebijakan AI. Kebijakan-kebijakan tersebut terutama menga…
Yu Pei; Cunming Zhang; Jeongju Sohn; Mike Papadakis
Ringkasan
Makalah ini memperkenalkan kerangka inferred-metamorphic-relation untuk menilai test suite komponen UI, menunjukkan bahwa pengujian yang ada menjalankan jauh lebih banyak relasi perilaku daripada yang divalidasinya secara eksplisit. Cakupa…
Metode
Kerangka yang diusulkan beroperasi dalam tiga tahap utama. Pertama, dengan diberikan sumber, dokumentasi, dan pengujian sebuah komponen, kerangka ini menginferensi MR spesifik kom…
Hasil
Evaluasi menunjukkan bahwa test suite yang ada menjalankan jauh lebih banyak relasi perilaku daripada yang divalidasinya secara eksplisit. Pada tiga konfigurasi LLM, MR Cover tetap antara 42,5% dan 4…
RAV menggabungkan routing prompt yang sadar tugas, adaptasi LoRA yang selaras, dan verifikasi berbasis eksekusi untuk meningkatkan kebenaran fungsional pada MBPP, mencapai 0.8911 pada MBPP Sanitized dan 0.8520 pada MBPP Full. Pipeline ini …
Metode
RAV diorganisasikan sebagai pipeline tiga tahap yang diterapkan pada model backbone tetap. 1. **Route** — routing prompt yang sadar tugas sebelum generasi. Alih-alih menggunakan s…
Hasil
Pipeline RAV lengkap mencapai kinerja terbaik di antara semua konfigurasi yang dievaluasi pada benchmark MBPP. Pipeline ini mencapai **0.8911 pada MBPP Sanitized** dan **0.8520 pada MBPP Full**. Diba…
Survei ini menyintesis bidang yang sedang berkembang tentang agen coding yang berevolusi sendiri, yang secara persisten memperbarui framework, memori, keterampilan, alat, alur kerja, atau lingkungannya dari interaksi coding sebelumnya. Sur…
Metode
Survei ini mengikuti pendekatan sintesis literatur yang sistematis. Para penulis mendefinisikan cakupan dengan membedakan agen coding yang berevolusi sendiri dari dua konsep yang …
Hasil
Survei ini melaporkan lanskap yang berkembang tetapi terfragmentasi. Temuan utama meliputi: - **Umpan balik yang dapat dieksekusi adalah pendorong utama**: Hasil pengujian, kesalahan runtime, dan jej…