Using Grounded Theory for Agent Behavior Analysis at Scale Paper • 2608.30391 • Published 7 days ago • 18
PACE: Towards Surfacing Hidden Conflicts in User Requests Paper • 2609.03293 • Published 4 days ago • 22
CORE: Improving Compositional Reasoning in MLLM Embedding via Reranker Distillation Paper • 2609.04083 • Published 4 days ago • 24
Rethinking On-Policy Distillation of Large Language Models II: One Training Example Paper • 2609.04172 • Published 4 days ago • 77
Puffin-World: Scaling a Unified Multimodal Model with Native 3D World States Paper • 2609.04196 • Published 4 days ago • 66
Random Attention: Rethinking KV Cache Eviction for Efficient Reasoning Paper • 2609.03430 • Published 4 days ago • 161
Compile by Training: Turning Natural-Language Specifications into Local Neural Functions Paper • 2609.04199 • Published 4 days ago • 315
LatentPress: Context Compression Beyond Text and Vision Paper • 2609.01507 • Published 6 days ago • 109
LLaDA-Image: Building Strong Image Generators with Fully Open Training Recipes Paper • 2609.03796 • Published 4 days ago • 226
Terminal-Universe: Turning Agent Trajectories into Scalable Terminal Environments Paper • 2609.04148 • Published 4 days ago • 271
DVAO: Dynamic Variance-adaptive Advantage Optimization for Multi-reward Reinforcement Learning Paper • 2605.25604 • Published May 25 • 139