FlowBalance: Verifier-Grounded Self-Improvement from On-Policy Reasoning Experience Paper • 2609.03241 • Published 8 days ago • 91
Unifying Conformal Language Tasks with In-Context Ensembles Paper • 2609.03005 • Published 9 days ago • 8
Unlocking Lossless Speedups in LLMs via Discrete Diffusion Paper • 2609.04010 • Published 8 days ago • 137
Beyond Visual Similarity: Entity-Aligned Retrieval for Knowledge-Based Visual Question Answering Paper • 2608.21450 • Published 23 days ago • 29
ExecRetrieval: Measuring the Functional-Correctness Gap in Code-Embedding Retrieval Paper • 2609.01865 • Published 10 days ago • 8
Blind Men and the Elephant: Probing the Epistemic Myopia of LLMs under Long-Tail Divergent Knowledge Paper • 2608.28478 • Published 14 days ago • 20
Scaffolding Foundation Models into Physical-World Agents Pushes the Frontier of Long-Horizon Navigation Paper • 2608.30396 • Published 11 days ago • 12
DiagEvo: Diagnosis-Guided Self-Evolution via Hierarchical Error Memory Paper • 2609.00768 • Published 10 days ago • 22
EM^2Mem: Event-Centric Multimodal Memory for Large Language Models Paper • 2609.00551 • Published 10 days ago • 14
Hi-Q: Hierarchical Evidence-guided Query Refinement for Multi-Hop Question Answering Paper • 2608.30468 • Published 11 days ago • 37
Qwen-Drive-1.0: An Initial Step towards a Vision-Language Foundation Model for Autonomous Driving Paper • 2609.00111 • Published 11 days ago • 379