Irina Nikishina; M. Tikhonova; Viktoriia Chekalina; Alexey Zaytsev; Artem Vazhentsev; Alexander Panchenko
Ringkasan
Makalah ini menyajikan kursus Transformer untuk akademisi dan industri, mencakup 15 sesi dengan kuliah dan praktikum, plus dua kompetisi CodaLab. Kursus ini dijalankan enam kali (empat di industri, dua di akademik) dan terus diperbarui den…
Metode
Desain kursus mengikuti pendekatan modular dengan 15 sesi, masing-masing menggabungkan kuliah dan praktik langsung. Enam sesi pertama memperkenalkan arsitektur Transformer dan var…
Hasil
Kursus ini disampaikan enam kali: empat kali kepada audiens industri dan dua kali kepada mahasiswa akademik. Umpan balik dari kedua kelompok positif, menunjukkan efektivitas kurikulum dan format komp…
Rosetta memulihkan semantik kolom dari nilai data semata dengan menempatkan model bahasa di dalam harness verifikasi deterministik. Sistem ini mencapai akurasi 0.475 pada 42% kolom yang dikomit, versus 0.223 pada 94% untuk model saja, deng…
Metode
Rosetta beroperasi dengan mengintegrasikan model bahasa di dalam harness verifikasi. Profiler deterministik terlebih dahulu menganalisis nilai kolom untuk mengekstrak bukti strukt…
Hasil
Pada 680 kolom berpasangan dari basis data BIRD dengan pengenal dihancurkan, Rosetta mencapai akurasi 0.475 pada 42% kolom yang dikomit, dibandingkan dengan akurasi 0.223 pada 94% untuk model yang sa…
Guixu menggantikan pengambilan dataset berbasis kata kunci dengan valuasi data yang sadar tugas dan terbatas anggaran untuk agen otonom. Sistem ini menggabungkan propagasi label proksi, optimasi knapsack multi-putaran, protokol pembayaran …
Metode
Metodologi Guixu disusun di sekitar pipeline valuasi tiga fase yang mengubah spesifikasi tugas berbahasa alami menjadi kumpulan dataset yang diperingkat dan layak anggaran. Fase p…
Hasil
Makalah ini disajikan sebagai sistem demonstrasi, sehingga hasil yang dilaporkan berpusat pada alur kerja yang dapat dijalankan peserta secara interaktif, bukan pada tabel benchmark. Demonstrasi ini …
Giacomo De Colle; Helena Blackmore; Chris Partridge
Ringkasan
De Colle, Blackmore, dan Partridge mengusulkan metodologi baru yang memvalidasi pemetaan semantik antara sumber data yang berlandaskan fondasi ontologi berbeda dengan memanfaatkan komitmen metafisik ontologi tersebut. Pendekatan ini didemo…
Metode
Metodologi berlangsung dalam tiga tahap. Pertama, penulis mengekstraksi komitmen metafisik setiap fondasi ontologi—khususnya IES dan BFO—dengan menganalisis aksiomatisasi dan pola…
Hasil
Penulis melaporkan penerapan kerangka mereka pada kasus uji IES–BFO. Mereka mengidentifikasi seperangkat komitmen metafisik yang berbeda antara kedua ontologi, terutama seputar perlakuan continuant, …
Yiming Lin; Chiyu Hao; Shreya Shankar; Aditya G. Parameswaran
Ringkasan
Scout memanfaatkan kemiripan dokumen untuk menghasilkan dan menyempurnakan aturan ekstraksi dari beberapa sampel, menyamai akurasi agen LLM terdepan sekaligus 61x hingga lebih dari 1000x lebih murah pada koleksi 1.000 dokumen. Scout menang…
Metode
Scout beroperasi dalam dua fase utama: pembangkitan aturan dan penyempurnaan aturan, diikuti strategi bertingkat untuk koleksi yang sebagian mirip. **Pembangkitan Aturan.** Dari s…
Hasil
Eksperimen pada enam dataset dunia nyata menunjukkan bahwa Scout menyamai akurasi baseline terkuat—agen LLM terdepan yang membaca setiap dokumen secara penuh—sekaligus 61x hingga lebih dari 1000x leb…
Zhuowen Liang; Zhengxuan Zhang; Jiayang Wang; Jiazhuo Chen; Nan Tang
Ringkasan
Doc2DB-Bench mengevaluasi pemahaman dokumen sebagai konstruksi basis data alih-alih ekstraksi bidang yang terisolasi, menyediakan 203 instans dokumen panjang di 42 skema dan tujuh kelompok domain. Benchmark ini mengungkap ketidakmemadaian …
Metode
Benchmark ini dibangun melalui pipeline sintesis DB-to-Doc yang dapat dikendalikan. Pipeline ini dimulai dengan instans basis data relasional dan menghasilkan dokumen panjang yang…
Hasil
Doc2DB-Bench berisi 203 instans dokumen panjang di 42 skema dan tujuh kelompok domain. Instans basis data mencakup 117 tabel entitas dan 132 tabel hubungan, dengan total 7.341 baris dan 41.935 sel. S…
InSituANN memungkinkan pencarian tetangga terdekat perkiraan skala miliar pada satu GPU komoditas dengan menyimpan vektor basis di memori host dan melakukan fine search in situ, menghindari transfer PCIe vektor berdimensi tinggi. Sistem in…
Metode
InSituANN dibangun di atas indeks inverted file (IVF), yang mempartisi ruang vektor menjadi klaster melalui coarse quantizer dan menyimpan vektor basis dalam inverted list. Prinsi…
Hasil
Makalah ini mengevaluasi InSituANN pada dataset skala miliar, termasuk SIFT-1B dan DEEP-1B. Pada recall yang setara, InSituANN meningkatkan throughput end-to-end sebesar 104,9x-4298,2x dibandingkan b…
Laporan implementasi ini merinci bagaimana Rowan University menggantikan penempatan dan registrasi mata kuliah mahasiswa baru secara manual dengan sistem otomatis yang mengintegrasikan Banner, Google Sheets, dan data bimbingan akademik, me…
Metode
Inisiatif otomatisasi ini dikembangkan oleh tim lintas departemen yang mengintegrasikan data dari berbagai sumber: Banner (Student Information System), Google Sheets yang dikelola…
Hasil
Sistem otomatis berhasil memproses lebih dari 3.500 mahasiswa baru, mencapai penghematan waktu tahunan lebih dari 350 jam. Ini merupakan pengurangan signifikan dalam beban kerja administratif bagi Te…
PolicyKG adalah pipeline LLM yang membaca PDF kebijakan institusional, mengklasifikasikan setiap kalimat sebagai kewajiban, izin, atau larangan, mengangkat label ke logika deontik orde pertama, dan menghasilkan batasan SHACL. Pada korpus A…
Metode
PolicyKG menjalankan empat tahap pada mesin status LangGraph dengan validator per tahap. Tahapannya adalah: (1) klasifikasi kalimat ke kategori deontik, (2) pengangkatan ke logika…
Hasil
Pada korpus AIT, PolicyKG mencapai akurasi klasifikasi deontik 86,9% (Cohen's kappa = .709). Tiga anotator secara independen memberi label ulang pada sampel 50 item dan sepakat pada Fleiss' kappa = .…
Makalah ini merilis trace NoSQL Cosmos DB nyata, mendefinisikan metrik keandalan Distressed Resource Volume (DRV), dan menyajikan LoadStar, Luna, serta Orbit untuk mengoptimalkan penempatan replika. Penerapan di produksi menunjukkan pengur…
Metode
Metodologi berjalan dalam empat tahap. Pertama, penulis mengumpulkan dan membuka beban kerja NoSQL dari klaster Cosmos DB nyata, menyediakan korpus trace yang mencerminkan pola la…
Hasil
Eksperimen, yang divalidasi menggunakan LoadStar pada beban kerja yang dirilis, membandingkan Orbit dengan dua baseline: kebijakan Cosmos DB yang ada dan baseline worst-fit yang dioptimalkan. Di selu…