Evo-Bench: Can Language Models Improve Agent Harness? Paper • 2608.09096 • Published 14 days ago • 18
Nanbeige4.2-3B: Unlocking Agentic Capabilities in a Compact Model Paper • 2607.22083 • Published 28 days ago • 8
Evo-Bench: Can Language Models Improve Agent Harness? Paper • 2608.09096 • Published 14 days ago • 18
SWE-Master: Unleashing the Potential of Software Engineering Agents via Post-Training Paper • 2602.03411 • Published Feb 3 • 39
SWE-World: Building Software Engineering Agents in Docker-Free Environments Paper • 2602.03419 • Published Feb 3 • 41
ManuSearch: Democratizing Deep Search in Large Language Models with a Transparent and Open Multi-Agent Framework Paper • 2505.18105 • Published May 23, 2025
Ring-Zero: Scaling Zero RL to a Trillion Parameters for Emergent Reasoning Paper • 2607.12395 • Published Jul 14 • 100
Which Models Are Our Models Built On? Auditing Invisible Dependencies in Modern LLMs Paper • 2606.12385 • Published Jun 10 • 3
Which Models Are Our Models Built On? Auditing Invisible Dependencies in Modern LLMs Paper • 2606.12385 • Published Jun 10 • 3