Persona Dosing: Calibrated Activation Steering for Graded Trait Control Paper • 2609.36388 • Published 14 days ago • 56
Science or Slop?: Benchmarking and Mitigating Scientific Slop in AI-Generated Papers Paper • 2610.00531 • Published 12 days ago • 62
VeriHarness: Scaling Agentic Verification for Long-Horizon Tasks Paper • 2610.00972 • Published 11 days ago • 61
Memadapter: Counterfactual Adaptation Against Memory-induced Sycophancy Paper • 2610.05162 • Published 8 days ago • 60
More Choices, Fewer Decisions: Ordinal-Scale Bias in JEV-like Direct-Decision Models Paper • 2609.38827 • Published 12 days ago • 64
Questioning the Questions: Sustaining Self-Evolution in Reasoning Models Paper • 2610.04299 • Published 9 days ago • 70
DecepEval: A Benchmark for Evaluating Deception in LLM Agents Paper • 2610.07967 • Published 6 days ago • 75
Thinking Outside the Box: Can Language Models Rely on External Guidance Selectively? Paper • 2609.39578 • Published 12 days ago • 72
Transformers Stop Thinking Too Early, and a Tiny LoRA Fixes It Paper • 2609.36585 • Published 13 days ago • 71
ActiveSaddler: Automated Curriculum Learning for Agent Harness Optimization Paper • 2610.00906 • Published 11 days ago • 85
Beyond Memory: Harnessing Long-Horizon Agents with Explicit Belief States Paper • 2610.01415 • Published 11 days ago • 92
Prefill-Free Cross-Family KV Cache Transfer for Heterogeneous Multi-Agent LLMs Paper • 2609.32259 • Published 13 days ago • 101
TokenRouter: Efficient Serving System for Token-Level LLM Routing Paper • 2610.12242 • Published 4 days ago • 130
Mid-Harness: Scaling Actions Between Model and Harness for Terminal Agents Paper • 2609.39982 • Published 12 days ago • 120
Self-Retrospection Distillation: Turning Post-hoc Experiences into Prior Foresight Paper • 2610.08077 • Published 6 days ago • 159
AREX-2: Advancing Self-Improving Agents through Long-Horizon Reflective Tasks Paper • 2609.38288 • Published 13 days ago • 137