Makalah ini memperkenalkan DATER, kerangka konseptual untuk mendeskripsikan dan mengevaluasi arsitektur data secara sistematis berdasarkan kebutuhan teknis, dan menerapkannya pada enam paradigma modern: data warehouse, (semantic) data lake…
Metode
Penulis mengusulkan DATER sebagai kerangka konseptual yang memetakan arsitektur data ke kebutuhan teknis. Kerangka ini diterapkan pada enam arsitektur: data warehouse, (semantic) …
Hasil
Makalah ini mengkaji enam arsitektur data modern: data warehouse, (semantic) data lake, data lakehouse, data fabric, dan data mesh. Masing-masing dianalisis melalui konteks historis, fitur yang mende…
HNTL mempartisi ruang berdimensi tinggi menjadi butir tangen lokal dan memindai vektor secara sekuensial dalam tata letak Block-SoA tanpa pointer, mencapai Rerank Recall@10 sebesar 1,0000 hanya dengan 20 kandidat dan percepatan 3,61x diban…
Metode
HNTL beroperasi dalam tiga tahap: (1) **Partisi ruang** menjadi butir lokal melalui clustering atau pemisahan rekursif, memastikan setiap butir menangkap wilayah yang koheren dari…
Hasil
Laporan ini mengevaluasi HNTL pada data manifold anisotropik dengan $d=768$ dan $N=10{,}000$. Temuan utama: - **Recall**: HNTL mencapai **Rerank Recall@10 final sebesar 1,0000** dengan ukuran kumpula…
Seth Ockerman; Song Young Oh; Amal Gueroudji; Rochana Chaturvedi; Philip Carns; Nicholas Chia; Matthieu Dorier; Robert …
Ringkasan
Basis data vektor yang dioptimalkan untuk lingkungan cloud menunjukkan paradoks penskalaan pada sistem HPC: penambahan core dapat menurunkan throughput kueri hingga 30,67%, dan penskalaan dari 16 ke 256 worker hanya menghasilkan peningkata…
Metode
Evaluasi dilakukan pada dua superkomputer produksi, menggunakan hingga 256 worker terdistribusi di 64 node komputasi. Tiga basis data vektor—Qdrant, Milvus, dan Weaviate—diuji pad…
Hasil
Hasilnya mengungkap paradoks penskalaan: karakteristik beban kerja dapat membatasi pengurangan latensi, dan penambahan lebih banyak core justru dapat menurunkan throughput kueri hingga 30,67%. Lebih …
Amir Tonta; Bernhard Seeger; Eljas Soisalon-Soininen
Ringkasan
cMVBT (concurrent MVBT) merancang ulang multiversion B-tree dengan protokol kontrol konkurensi baru yang memakai latch optimistis untuk penulisan dan tanpa latch untuk pemindaian rentang, sekaligus mempertahankan jaminan optimalitas. Ekspe…
Metode
Protokol cMVBT dibangun di atas tiga mekanisme utama: (1) latching optimistis untuk penulisan, (2) pemindaian rentang tanpa latch, dan (3) pengumpulan sampah berkelanjutan. Operas…
Hasil
Eksperimen dengan beban kerja campuran yang diturunkan dari benchmark standar menunjukkan bahwa cMVBT mencapai overhead rendah, throughput penulisan tinggi, dan kinerja pemindaian rentang yang sangat…
Bradley Spitz; Antoine Jacquemin; Nikita Beliy; Christophe Phillips
Ringkasan
BIDSme, alat semi-otomatis untuk mengonversi data pencitraan otak mentah ke Brain Imaging Data Structure (BIDS), telah dikontainerisasi menggunakan Docker dan Docker Compose untuk meningkatkan kegunaan, reproducibility, dan integrasi denga…
Metode
Kontainerisasi BIDSme dilakukan menggunakan Docker dan Docker Compose. Docker menyediakan lingkungan yang ringan dan portabel yang merangkum aplikasi beserta dependensinya, memast…
Hasil
Aplikasi BIDSme yang terkontainerisasi berhasil meningkatkan kegunaan, reproducibility, dan integrasi dengan platform seperti Neurodesk. Kontainer ini fleksibel, ringan, dan ramah pengguna, mengatasi…
Yen-Hsin Hsu; Ya-Wen Teng; De-Nian Yang; Wang-Chien Lee; Philip S. Yu; Ming-Syan Chen
Ringkasan
Makalah ini memperkenalkan Quantum Frequent-itemset Mining (QFM), kerangka pemrosesan data kuantum yang mengatasi hambatan skalabilitas pada FIM klasik. QFM mencapai peningkatan rata-rata 96% dibandingkan baseline klasik pada dataset dunia…
Metode
Kerangka QFM terdiri atas tiga mekanisme utama yang dirancang untuk mengatasi keterbatasan FIM klasik. Pertama, **Bit-Vector Qubit Encoding** mengorganisasi data transaksi menjadi…
Hasil
Penulis mengimplementasikan QFM pada IBM Qiskit dan Amazon Braket serta mengevaluasinya pada dataset dunia nyata, termasuk dataset retail dan accident. Mereka membandingkan QFM dengan baseline klasik…
TRL-Bench memperkenalkan protokol terstandardisasi untuk mengevaluasi encoder tabular dengan mengekspor embedding tingkat baris, kolom, atau tabel dan menyelidikinya memakai head ringan yang dibagi bersama. Di seluruh 20 model dan 16 tugas…
Metode
TRL-Bench mendefinisikan protokol evaluasi terstandardisasi di mana setiap encoder menghasilkan embedding pada satu atau lebih granularitas: baris, kolom, atau tabel. Embedding in…
Hasil
Di seluruh 20 model dan 16 tugas, TRL-Bench menunjukkan bahwa setelah kondisi hilir distandardisasi, kualitas encoder bersifat spesifik terhadap kapabilitas, bukan tertangkap oleh satu papan peringka…
Te Luo; Yan Zhu; Peiyao Fu; Ruijie Yang; Xian Yang; Quanlin Li; Pinghong Zhou; Shuo Wang
Ringkasan
Prompt CADe positif palsu menarik tatapan pada 48,6% observasi retrospektif dan 65,2% peristiwa waktu nyata prospektif, dengan median okupasi atensi 1000–1100 ms meskipun durasi prompt hanya 33–267 ms. Temuan ini mendukung perlunya memasuk…
Metode
Studi ini menggunakan desain retrospektif dan prospektif yang saling melengkapi dengan pelacakan mata terkunci peristiwa. **Eksperimen video berpasangan retrospektif.** Tiga endos…
Hasil
Prompt positif palsu menarik tatapan pada **48,6% (68/140)** observasi retrospektif dan **65,2% (533/817)** peristiwa prospektif. Di antara peristiwa atraksi dengan pemulihan lengkap, median okupasi …
EMGBlend adalah kerangka pretraining swasupervisi yang secara eksplisit menangani heterogenitas antar dataset surface EMG publik—tata letak elektroda, jumlah kanal, dukungan frekuensi, dan ukuran—untuk meningkatkan pengenalan gestur, regre…
Metode
EMGBlend beroperasi sebagai kerangka pretraining swasupervisi dengan tiga mekanisme inti yang disesuaikan dengan heterogenitas EMG. **1. Patch Kanal Bersama dengan Attention Sadar…
Hasil
EMGBlend dievaluasi pada tiga tugas hilir: pengenalan gestur, regresi gaya kontinu, dan klasifikasi kontak. Di seluruh tugas ini, ia secara konsisten mengungguli dua kondisi kontrol: inisialisasi aca…
Berinteraksi dengan ChatGPT, Claude, atau Gemini sebagai mitra berpikir sementara menggeser prioritas nilai manusia ke arah fokus personal, terutama melalui peningkatan Self-Enhancement, bahkan ketika LLM tidak menyasar nilai maupun berupa…
Metode
Studi ini menggunakan desain antarsubjek terpreregistrasi dengan 200 orang dewasa di Amerika Serikat. Peserta secara acak ditugaskan ke salah satu dari empat kondisi: interaksi de…
Hasil
Setiap kondisi LLM sementara menggeser prioritas nilai ke arah fokus personal dibandingkan kondisi kontrol, dengan ukuran efek berkisar dari d = 0,37 hingga d = 0,51. Pergeseran ini terutama didorong…