Parameter Exploration for RLVR via Variational Learning Paper • 2608.09805 • Published 4 days ago • 5
Macaron-V1: Towards Open Continual Learning with Self-Improvement and Mixture-of-LoRA Paper • 2608.09819 • Published 5 days ago • 331
Reference-Free Post-Training of Open Large Language Models for Multilingual Machine Translation Paper • 2608.10812 • Published 4 days ago • 12
On-Policy Self-Distillation without Any Supervision Paper • 2608.06296 • Published 6 days ago • 199
Efficient Knowledge Distillation for LLMs: Offline Top-K Logits and a Fused Chunked KL Loss Paper • 2608.03796 • Published 11 days ago • 14
OasisKV: Scaling In-Decode KV Cache Beyond HBM with Lookahead Sparse Prefetching Paper • 2608.08097 • Published 7 days ago • 24
SPOT: Sparse Probing and Outcome Calibration for On-Policy Distillation Paper • 2608.04419 • Published 10 days ago • 26
BDH-CQ: In-Context Learning with Recurrent Latent Reasoning Paper • 2608.09888 • Published 5 days ago • 598
Modular TTT: Rethinking Test-Time Training as Composable Modules Paper • 2608.07110 • Published 8 days ago • 8
Beyond Conditional Computation: Retrieval-Augmented Genomic Foundation Models with Gengram Paper • 2601.22203 • Published Jan 29 • 2
Interpretable MEG Decoding of Perceived Speech: Cortical Sources and the Stimulus Features That Drive Retrieval Paper • 2608.01481 • Published 13 days ago • 69
Activity Frames: Deterministic Screen-Activity Compilation for Agent Memory and Replay Paper • 2608.05784 • Published 9 days ago • 28
Teaching Nemotron Greek: Mining a Corpus, Adapting Retrieval, and Grounding Generation for Modern Greek across Specialist Domains Paper • 2608.05138 • Published 10 days ago • 31
OSReward: Instituting Standardized Evaluation for Cross-Platform Computer-Use Reward Models Paper • 2607.28609 • Published 16 days ago • 72
ABSeeker: Training Long-Horizon Search Agents via Answer-Backtracked Credit Assignment Paper • 2608.05102 • Published 10 days ago • 65
Lossless Tensor Compression as Program Synthesis Paper • 2608.02162 • Published 12 days ago • 15
MameLoshnLM: Yiddish Language Model and Evaluation Benchmark Paper • 2608.05850 • Published 9 days ago • 22
On-Policy Delta Distillation for Multilingual Math Reasoning Paper • 2608.05802 • Published 9 days ago • 32
CalibForge: Adversarial Solver Calibration for Scaling Learnable Terminal Tasks Paper • 2608.06352 • Published 9 days ago • 23