Penelitian ini menyelidiki bagaimana desain konteks istimewa dalam on-policy self-distillation (OPSD) memengaruhi performa siswa. Pada tugas matematika kompetisi pada skala 4B dan 8B, abstraksi tingkat menengah seperti strategi bernama dan…
Metode
Pengaturan eksperimen mempertahankan tampilan siswa dan prosedur pelatihan tetap sama dalam setiap skala model (4B dan 8B parameter). Untuk setiap skala, penulis mengevaluasi lima…
Hasil
Pada uji utama pada matematika kompetisi, konteks tingkat menengah terbaik meningkatkan rata-rata puncak dalam domain dibandingkan solusi lengkap sebesar 1,4 poin pada 4B dan 1,6 poin pada 8B. Keuntu…
Probe 64 jaringan, empat konfigurasi, atas tumpang-tindih bobot berpasangan sepanjang grokking mengembalikan UNDETERMINED karena langkah penyelarasan yang terdaftar tidak mempertahankan fungsi jaringan. Secara post-hoc, hanya rasio simpang…
Metode
Rancangannya adalah sapuan pelatihan empat konfigurasi dengan 64 seed. Setiap jaringan dilatih hingga konvergensi berkelanjutan atau batas 40.000 epoch. Untuk setiap pasangan solu…
Hasil
Hasil terdaftar adalah UNDETERMINED (kode alasan C0_INSTRUMENT_INVALID). Tidak ada putusan konfirmatori yang tersedia, dan makalah ini menyatakan secara gamblang bahwa data tidak memberikan null konf…
Tesis ini menyelidiki dua arah persinggungan kuantum-AI: metode kuantum untuk machine learning dan machine learning untuk sistem kuantum. Tesis ini memperkenalkan Neural Quantum Embedding untuk klasifikasi yang lebih baik pada perangkat ke…
Metode
Tesis ini menggunakan kombinasi derivasi teoretis, perancangan algoritma, dan validasi empiris. Untuk QML, Neural Quantum Embedding (NQE) diusulkan untuk mempelajari representasi …
Hasil
Dalam QML, NQE meningkatkan akurasi klasifikasi pada perangkat keras kuantum yang bising dengan meningkatkan trace distance antara ansambel kelas. Ekstensi DQC1 berhasil didemonstrasikan pada proseso…
Minghui Liu; Thomas Magelinski; Dehao Yuan; Qi Yu; Furong Huang
Ringkasan
Ladders-of-Thought (LoT) meningkatkan penalaran pada LLM berukuran 1–8B parameter dengan menghasilkan varian masalah yang setia secara semantik namun lebih mudah dan menjadwalkannya dengan bandit yang berkembang sendiri. Metode ini mengung…
Metode
LoT beroperasi dalam tiga tahap: (1) **Penulisan ulang pertanyaan secara progresif**: Untuk setiap masalah penalaran asli, kerangka kerja ini menghasilkan urutan varian yang setar…
Hasil
LoT secara konsisten meningkatkan KD pada model 1–8B dari berbagai keluarga. Pada tugas aritmetika, metode ini memberikan keuntungan besar: **+32 poin persentase pada AddSub** dan **+25pp pada SVAMP*…
Studi ini mengaudit transfer kalibrasi dari prediktor hasil awal dual-head yang dibekukan pada agen LLM di SWE-bench Verified, menemukan galat spesifik target yang bertahan untuk gpt-5-mini/SUCCESS dan claude-opus-4.6/FAILURE, tetapi tidak…
Metode
Audit ini memanfaatkan trajektori SWE-bench Verified publik dan pipeline prediksi hasil awal dual-head yang dibekukan, yang mengeluarkan prediksi terpisah untuk hasil SUCCESS dan …
Hasil
Heterogenitas berpasangan prediktor-sama yang luas tidak didukung. Median perbedaan corrected-gap berpasangan adalah 0.0180 untuk head SUCCESS (45 pasangan) dan 0.0385 untuk head FAILURE (35 pasangan…
Zhentao Tan; Chang Liu; Yao Liu; Yue Wu; Jieping Ye
Ringkasan
NSFT memperkenalkan fine-tuning parameter-efisien pada tingkat sub-pakar untuk LLM Mixture-of-Experts, menguraikan pakar menjadi kelompok kanal dan memilih sub-pakar yang relevan dengan tugas. Eksperimen menunjukkan keuntungan konsisten di…
Metode
NSFT beroperasi dengan menguraikan setiap pakar dalam lapisan MoE sepanjang dimensi perantara menjadi kelompok kanal terstruktur, yang disebut sub-pakar. Untuk input tertentu, rou…
Hasil
Penulis mengevaluasi NSFT pada dua LLM MoE: OLMoE dan Ling-mini-2.0. Eksperimen mencakup tugas spesifik domain yang menantang dan tolok ukur umum. Baseline mencakup metode PEFT representatif (misalny…
Makalah ini menyajikan kerangka kursus robotika terintegrasi yang mengorganisasi alur kerja penelitian lengkap di sekitar robot humanoid open-source bersama, divalidasi melalui tinjauan formatif oleh lima pakar. Makalah ini mengidentifikas…
Metode
Kerangka ini dikembangkan melalui proses desain iteratif yang mencakup tinjauan formatif oleh lima pakar dalam penelitian robotika, teknik, pendidikan STEM menengah, dan desain ku…
Hasil
Umpan balik pakar menyoroti tiga ketegangan desain utama yang membentuk kerangka akhir: 1. **Keaslian versus beban kognitif**: Pakar mencatat bahwa meskipun tugas penelitian autentik memotivasi, tuga…
Agen AI generatif yang digunakan sebagai konsumen sintetis gagal mereproduksi efek pemasaran visual manusia pada sebagian besar konfigurasi, dan bahkan pengarahan yang berhasil pun meremehkan heterogenitas konsumen. Para penulis mengusulka…
Metode
Para penulis melakukan uji tekanan sistematis menggunakan enam eksperimen pemasaran visual kanonik. Untuk setiap eksperimen, mereka memanipulasi dua faktor: generasi model (GPT-4o…
Hasil
Tidak ada dari 24 konfigurasi yang mereproduksi lebih dari dua dari enam efek manusia; sisanya tidak signifikan. Satu pengecualian adalah pembalikan signifikan dari pola manusia. Memberikan bukti kon…
MTFGN-SRL merumuskan ulang prediksi RUL sebagai satu graf lengkap yang diproses oleh Fourier Graph Neural Network, diperkaya dengan jendela lookback multi-term dan GNN heterogen untuk pembelajaran relasi antar-sampel. Metode ini mencapai k…
Metode
Kerangka MTFGN-SRL terdiri dari tiga komponen inti: Fourier Graph Neural Network (FGN), modul pembelajaran multi-term, dan modul pembelajaran relasi sampel. **Fourier Graph Neural…
Hasil
MTFGN-SRL yang diusulkan dievaluasi pada dataset CMAPSS, tolok ukur yang banyak digunakan untuk prediksi RUL. Dataset ini terdiri dari beberapa subset (FD001, FD002, FD003, FD004) dengan kondisi oper…
Artikel ini mengusulkan epidemiologi survival sebagai cabang epidemiologi yang khas, berfokus pada populasi pascadiagnosis, dengan argumen bahwa estimasi berbasis pencegahan sering tidak berlaku setelah diagnosis. Artikel ini menguraikan p…
Metode
Artikel ini menyintesis bukti pada kondisi kardiovaskular, renal, onkologis, pulmoner, dan hepatik untuk menunjukkan bahwa asosiasi yang diukur untuk insidensi sering gagal terepr…
Hasil
Bukti di berbagai area penyakit menunjukkan bahwa asosiasi yang diukur untuk insidensi sering tidak berlaku pada populasi pascadiagnosis. Misalnya, faktor yang meningkatkan risiko penyakit dapat memi…