Understanding Reasoning from Pretraining to Post-Training Paper • 2607.16097 • Published 5 days ago • 21
From Noisy Traces to Root Causes: Structural Trajectory Analysis and Causal Extraction for Agent Optimization Paper • 2607.07702 • Published 14 days ago • 11
The Mirage of Optimizing Training Policies: Monotonic Inference Policies as the Real Objective for LLM Reinforcement Learning Paper • 2606.29526 • Published 24 days ago • 168
openai/whisper-large-v3-turbo Automatic Speech Recognition • 0.8B • Updated Oct 4, 2024 • 7.91M • • 3.18k
Crafter: A Multi-Agent Harness for Editable Scientific Figure Generation from Diverse Inputs Paper • 2605.30611 • Published May 28 • 252
IndusAgent: Reinforcing Open-Vocabulary Industrial Anomaly Detection with Agentic Tools Paper • 2605.20682 • Published May 20 • 85
optimize_anything: A Universal API for Optimizing any Text Parameter Paper • 2605.19633 • Published May 19 • 6