Using Grounded Theory for Agent Behavior Analysis at Scale Paper • 2608.30391 • Published 9 days ago • 19
PACE: Towards Surfacing Hidden Conflicts in User Requests Paper • 2609.03293 • Published 6 days ago • 24
CORE: Improving Compositional Reasoning in MLLM Embedding via Reranker Distillation Paper • 2609.04083 • Published 6 days ago • 25
Rethinking On-Policy Distillation of Large Language Models II: One Training Example Paper • 2609.04172 • Published 6 days ago • 83
Puffin-World: Scaling a Unified Multimodal Model with Native 3D World States Paper • 2609.04196 • Published 6 days ago • 66
Random Attention: Rethinking KV Cache Eviction for Efficient Reasoning Paper • 2609.03430 • Published 6 days ago • 170
Compile by Training: Turning Natural-Language Specifications into Local Neural Functions Paper • 2609.04199 • Published 6 days ago • 377
LatentPress: Context Compression Beyond Text and Vision Paper • 2609.01507 • Published 8 days ago • 113
LLaDA-Image: Building Strong Image Generators with Fully Open Training Recipes Paper • 2609.03796 • Published 6 days ago • 231
Terminal-Universe: Turning Agent Trajectories into Scalable Terminal Environments Paper • 2609.04148 • Published 6 days ago • 288
DVAO: Dynamic Variance-adaptive Advantage Optimization for Multi-reward Reinforcement Learning Paper • 2605.25604 • Published May 25 • 139