model profile
Rank · overall#14
Score77.0
Benchmark scores
7 benchmarksTerminal-Bench 2.178.4%Accuracy · Jul 11, 2026 · ± 1.3
Chatbot Arena (Coding)1562Coding Elo
Artificial Analysis56.6Intelligence Index
ARC-AGI83.9%Score
Arena Agent3.78%Net Improvement · ± 1.25
WebDev Arena1521WebDev Elo · ± 9
FrontierMath (Tier 4)70.7%Accuracy · ± 7.2
Across harnesses
1 agentsPer-benchmark score · composite per harness. Tap a row to open that board.
Scraped and aggregated from public leaderboards · 2026-08-16