Arena benchmark
Published Vision results on the original Arena scale.
Updated Aug 7, 2026. Data as of 2026-08-07
The table uses the source-provided overall rank and excludes review rows.
Top published models on the same Arena scale.
Registry-backed context for this evaluation surface.
Vision reports rating values and currently defines 11 evaluation categories.
Arena results are preference or task-outcome signals. They are not automatically equivalent to capability benchmark scores.
Common questions about Vision.
Claude Fable 5 is currently ranked first on the published Arena scale.
This Arena reports rating values across 11 configured evaluation categories.
No. Arena results remain a separate preference or task-outcome signal.
65 canonical published model results are currently shown.