A rebuilt GPU execution of f-k migration and phasor-fields achieves up to 42× faster streaming reconstruction and 14× over the fastest published GPU baseline, using as little as 2.5% of the memory. The work enables larger, finer NLOS recon…
Method
Penulis menata ulang pipeline GPU kedua algoritma di sekitar kernel gabungan, pengelompokan foton tingkat warp, transformasi batch, pemutaran ulang CUDA graph, dan penyimpanan FP1…
Results
Pipeline yang dibangun ulang mencapai rekonstruksi streaming hingga 42× lebih cepat daripada pipeline streaming referensi dan hingga 14× lebih cepat daripada baseline GPU tercepat yang dipublikasikan…
Tim Zeyl; Jason Lam; Shu Lin; Reza Pournaghi; Qi Cheng; Calvin Wong; Kaixiang Du; Yuliang He; Yang Sun; Weicheng Wang; …
Summary
GaussDB, Huawei's distributed shared-nothing database, was enhanced with a pipeline execution model, faster inter-node data shuffle, unified bus and remote memory access, and expanded Bloom filter support. These changes improved TPC-H perf…
Method
Para penulis menerapkan serangkaian modifikasi arsitektural dan algoritmik pada GaussDB. Pilar metodologis utamanya adalah: 1. **Model Eksekusi Pipeline**: Menggantikan eksekusi b…
Results
Setelah modifikasi yang dijelaskan, performa GaussDB pada beban kerja TPC-H melampaui hasil terbaik yang telah dipublikasikan sebesar 40% pada 30 TB. Peningkatan ini diatribusikan pada kombinasi mode…
Pietro Tiberi; Gabriele Marcelli; Vitangelo Lasorella
Summary
This paper proposes a confidential interbank settlement protocol for permissioned Ethereum networks that preserves public sender accountability while cryptographically obfuscating the receiver, amount, and business payload. Implemented on …
Method
Protokol ini dibangun sebagai serangkaian transisi status pada rantai EVM berizin. Protokol ini mendukung tiga operasi: **shield**, **confidential transfer**, dan **unshield**. Ke…
Results
Evaluasi eksperimental melaporkan penyelesaian end-to-end dalam **8–16 detik** pada jaringan lima node. Overhead verifikasi bukti sekitar **1 ms**, mengonsumsi sekitar **220k gas** melalui precompile…
Ablating HERMES stage by stage yields Battus-Z, a fixed-rate deterministic mean-field forward-backward method with threshold decoding that matches published HERMES aggregate macro-F1 and NRMSE across 12 canonical datasets. A CUDA implement…
Method
Ablasi dilakukan dengan menghapus komponen HERMES secara berurutan. Misalkan $\mathcal{H}_{\text{HERMES}}$ menyatakan pipeline lengkap. Penulis mendefinisikan varian $\mathcal{H}_…
Results
Pada protokol benchmark HERMES standar (frame teramati terakhir disematkan sebelum penilaian), Battus-Z mencapai rata-rata macro-F1 0,8726 dan NRMSE 0,1010 pada seluruh 12 dataset kanonis. Agregat HE…
B$^3$-PWL is a GPU-centric batched branch-and-bound framework for piecewise-linear optimization with SOS2 constraints. It solves batches of LP relaxation subproblems concurrently on the GPU using a first-order primal-dual solver and a spec…
Method
B$^3$-PWL adalah kerangka branch-and-bound terbatch berbasis GPU yang dirancang untuk optimasi PWL dengan kendala SOS2. Arsitekturnya terdiri dari tiga komponen utama: (1) solver …
Results
Penulis mengevaluasi B$^3$-PWL pada tolok ukur 43 instans PWL-MIP. Metode ini mencapai percepatan geometric-mean 9,25x dibandingkan NVIDIA cuOpt sekaligus mencapai incumbent layak berkualitas tinggi …
RED-ONION is a high-speed disk-to-disk transfer system that connects research instruments to a computing center over a dedicated high-bandwidth network and all-flash parallel file system. A prototype over a 100 Gbps transpacific path with …
Method
RED-ONION adalah sistem transfer disk-ke-disk berkecepatan tinggi yang menghubungkan instrumen penelitian ke pusat komputasi melalui jaringan khusus berbandwidth tinggi dan sistem…
Results
Prototipe yang diterapkan melalui jalur transpacific 100 Gbps antara Atlanta dan Tokyo dengan RTT 150 ms mencapai transfer satu file 1 TB pada 90 Gbps. Ini mengirimkan satu terabyte dalam sekitar 95 …
CLASP is a scaling and scheduling strategy for stateful serverless stream processing that estimates execution and chained-request costs to adjust operator parallelism and pack operators onto workers. Experiments show up to 3.3x throughput …
Method
CLASP beroperasi pada runtime, memperkirakan biaya eksekusi dan biaya permintaan berantai dari metrik yang diamati. CLASP menggunakan model kapasitas yang menggabungkan kedua biay…
Results
Evaluasi eksperimen menunjukkan bahwa CLASP mengungguli strategi penskalaan terkini. Secara spesifik, CLASP meningkatkan throughput hingga 3,3x dan menurunkan median latensi end-to-end hingga 76%. Ke…
MosaicJoin introduces a sketching strategy that approximates column-pair joinability without comparing all values, enabling value-level semantic join discovery up to 66x faster than prior value-level methods. It scales to query columns wit…
Method
MosaicJoin beroperasi dalam dua fase utama: fase sketsa offline dan fase kueri online. Ide intinya adalah merepresentasikan setiap kolom sebagai sketsa ringkas yang mempertahankan…
Results
Penulis melakukan eksperimen ekstensif untuk mengevaluasi MosaicJoin terhadap metode yang telah dipublikasikan sebelumnya pada berbagai benchmark. Temuan utamanya adalah: - **Akurasi.** MosaicJoin me…
TRACE-RealWorld (TRW) introduces the first commitment-level consistency contract for world models, treating predicted state as a materialized view and physical commitments as reads whose authorization can expire. It proves that synchroniza…
Method
TRW mendefinisikan klaim terketik dan terkalibrasi yang menetapkan kesegaran terkondisi konsekuensi dan verifikasi berharga. Suatu klaim mencakup prediksi, persyaratan kesegaran y…
Results
Evaluasi empiris dalam Flood-SAR menguji enam pertanyaan yang telah diregistrasi sebelumnya. Penyegaran adaptif mengurangi eksekusi usang tetapi tidak mendominasi penyegaran tetap pada biaya, cakupan…
Yiyan Li; Guanli Liu; Renata Borovica-Gajic; Haoyang Li; Zihang Qiu; Xinmei Huang; Andreas Kipf; Cuiping Li; Hong Chen
Summary
IDSTune is an integrated tuning framework that jointly optimizes database knobs, indexes, and materialized views through LLM-driven multi-agent collaboration. It achieves up to 38% performance improvement and 57% faster tuning across diver…
Method
IDSTune beroperasi dalam dua fase: (i) kompresi beban kerja, yang mengekstraksi dan memilih fitur yang relevan dengan tugas, dan (ii) rekomendasi konfigurasi, tempat agen-agen khu…
Results
Eksperimen yang ekstensif menunjukkan bahwa IDSTune mencapai peningkatan kinerja hingga 38% dan penyetelan 57% lebih cepat, dengan kemampuan adaptasi yang kuat pada beragam skenario. Hasil ini menunj…