Using Grounded Theory for Agent Behavior Analysis at Scale Paper • 2608.30391 • Published 21 days ago • 19
PACE: Towards Surfacing Hidden Conflicts in User Requests Paper • 2609.03293 • Published 18 days ago • 24
CORE: Improving Compositional Reasoning in MLLM Embedding via Reranker Distillation Paper • 2609.04083 • Published 18 days ago • 27
Rethinking On-Policy Distillation of Large Language Models II: One Training Example Paper • 2609.04172 • Published 18 days ago • 100
Puffin-World: Scaling a Unified Multimodal Model with Native 3D World States Paper • 2609.04196 • Published 18 days ago • 70
Random Attention: Rethinking KV Cache Eviction for Efficient Reasoning Paper • 2609.03430 • Published 18 days ago • 187
Compile by Training: Turning Natural-Language Specifications into Local Neural Functions Paper • 2609.04199 • Published 18 days ago • 325
LatentPress: Context Compression Beyond Text and Vision Paper • 2609.01507 • Published 20 days ago • 119
LLaDA-Image: Building Strong Image Generators with Fully Open Training Recipes Paper • 2609.03796 • Published 18 days ago • 186
Terminal-Universe: Turning Agent Trajectories into Scalable Terminal Environments Paper • 2609.04148 • Published 18 days ago • 242
DVAO: Dynamic Variance-adaptive Advantage Optimization for Multi-reward Reinforcement Learning Paper • 2605.25604 • Published May 25 • 137