llmboard.ai
Benchmarks
CompareRankings
llmboard.ai
Benchmarks
CompareRankings
HomeBenchmarksVision

Arena benchmark

Vision

Published Vision results on the original Arena scale.

Updated Aug 7, 2026. Data as of 2026-08-07

Published models65
Categories11
Result typerating

On this page

  • Ranking
  • Distribution
  • Highlights
  • About
  • FAQ

Vision ranking

The table uses the source-provided overall rank and excludes review rows.

65 rows
Columns

Show columns

1ANClaude Fable 5Anthropicanthropic1330.58,333N/AAug 6, 2026
3ANClaude Opus 4.7Anthropicanthropic1316.420,857N/AAug 6, 2026
6ACQwen3.8 MaxAlibaba Cloud / Qwen Teamalibaba1314.65,344N/AAug 6, 2026
7ANClaude Opus 4.6Anthropicanthropic1311.024,609N/AAug 6, 2026
8GOGemini 3.6 FlashGooglegoogle1310.91,205N/AAug 6, 2026
11MEMuse SparkMetameta1306.75,576N/AAug 6, 2026
12GOGemini 3 ProGooglegoogle1304.913,095N/AAug 6, 2026
15OPGPT-5.5OpenAIopenai1296.318,722N/AAug 6, 2026
16MEMuse Spark 1.1Metameta1295.54,661N/AAug 6, 2026
17XAGrok 4.5xAIxai1295.43,871N/AAug 6, 2026
18GOGemini 3.1 ProGooglegoogle1294.136,893N/AAug 6, 2026
20OPGPT-5.4OpenAIopenai1293.020,516N/AAug 6, 2026
22ANClaude Opus 4.8Anthropicanthropic1289.711,571N/AAug 6, 2026
24GOGemini 3 FlashGooglegoogle1283.435,759N/AAug 6, 2026
25ANClaude Sonnet 4.6Anthropicanthropic1282.224,997N/AAug 6, 2026
26MAKimi K2.6Moonshot AImoonshot1281.415,386N/AAug 6, 2026
27ACQwen3.7-PlusAlibaba Cloud / Qwen Teamalibaba1277.77,200N/AAug 6, 2026
31GOGemma 4 31BGooglegoogle1270.132,461N/AAug 6, 2026
34ACQwen3.5-397B-A17BAlibaba Cloud / Qwen Teamalibaba1265.023,868N/AAug 6, 2026
36ZAGLM-5V-TurboZhipu AIzai1264.528,950N/AAug 6, 2026
37GOGemini 3.5 Flash-LiteGooglegoogle1263.51,207N/AAug 6, 2026
38XAGrok-4.20 Beta ReasoningxAIxai1262.224,509N/AAug 6, 2026
39GOGemini 2.5 ProGooglegoogle1261.888,429N/AAug 6, 2026
40XAGrok-4.20 Multi-Agent BetaxAIxai1261.622,353N/AAug 6, 2026
41GOGemma 4 26B-A4BGooglegoogle1257.822,246N/AAug 6, 2026
42MIMiniMax M3MiniMaxminimax1257.710,984N/AAug 6, 2026
44OPGPT-5.5 InstantOpenAIopenai1251.57,224N/AAug 6, 2026
46XIMiMo-V2.5Xiaomixiaomi1251.420,781N/AAug 6, 2026
48OPGPT-5.1 HighOpenAIopenai1248.29,165N/AAug 6, 2026
50ACQwen3 VL 235B A22B InstructAlibaba Cloud / Qwen Teamalibaba1246.812,102N/AAug 6, 2026
53ACQwen3.5-122B-A10BAlibaba Cloud / Qwen Teamalibaba1245.612,437N/AAug 6, 2026
55ACQwen3.5-27BAlibaba Cloud / Qwen Teamalibaba1240.921,450N/AAug 6, 2026
56GOGemini 3.1 Flash-LiteGooglegoogle1239.825,889N/AAug 6, 2026
57GOGemini 2.5 FlashGooglegoogle1235.559,184N/AAug 6, 2026
60XAGrok 4.3xAIxai1231.318,132N/AAug 6, 2026
62XIMiMo-V2-OmniXiaomixiaomi1228.410,081N/AAug 6, 2026
65OPo3OpenAIopenai1215.346,095N/AAug 6, 2026
67OPGPT-5 HighOpenAIopenai1211.634,605N/AAug 6, 2026
68OPGPT-4.1OpenAIopenai1210.141,556N/AAug 6, 2026
70ACQwen3 VL 235B A22B ThinkingAlibaba Cloud / Qwen Teamalibaba1208.22,347N/AAug 6, 2026
72XAGrok-4.1 Fast ReasoningxAIxai1199.912,462N/AAug 6, 2026
83OPGPT-4.1 miniOpenAIopenai1182.540,833N/AAug 6, 2026
85ANClaude Opus 4Anthropicanthropic1175.62,201N/AAug 6, 2026
86ANClaude Sonnet 4Anthropicanthropic1175.61,826N/AAug 6, 2026
89OPo1OpenAIopenai1168.63,694N/AAug 6, 2026
90ZHGLM-4.6VZhipuaizai1166.62,311N/AAug 6, 2026
91GOGemma 3 27BGooglegoogle1165.317,179N/AAug 6, 2026
96ZAGLM-4.5VZhipu AIzai1156.43,279N/AAug 6, 2026
97ACQwen2.5 VL 32B InstructAlibaba Cloud / Qwen Teamalibaba1152.51,490N/AAug 6, 2026
98ANClaude 3.7 SonnetAnthropicanthropic1151.04,539N/AAug 6, 2026
102MAMistral Small 3.1 24B InstructMistral AImistral1136.928,886N/AAug 6, 2026
103OPGPT-4oOpenAIopenai1136.723,273N/AAug 6, 2026
104ANClaude 3.5 SonnetAnthropicanthropic1125.510,389N/AAug 6, 2026
106ANClaude 3.5 SonnetAnthropicanthropic1120.421,624N/AAug 6, 2026
110ANClaude 3.5 HaikuAnthropicanthropic1092.71,406N/AAug 6, 2026
111OPGPT-4 TurboOpenAIopenai1090.013,391N/AAug 6, 2026
115OPGPT-4o miniOpenAIopenai1065.717,341N/AAug 6, 2026
116OPGPT-4oOpenAIopenai1064.73,376N/AAug 6, 2026
117OPGPT-4.1 nanoOpenAIopenai1063.51,211N/AAug 6, 2026
119ACQwen2-VL-72B-InstructAlibaba Cloud / Qwen Teamalibaba1047.15,937N/AAug 6, 2026
122ANClaude 3 OpusAnthropicanthropic1023.015,565N/AAug 6, 2026
124MAPixtral-12BMistral AImistral1008.77,511N/AAug 6, 2026
132ANClaude 3 SonnetAnthropicanthropic984.012,314N/AAug 6, 2026
137ANClaude 3 HaikuAnthropicanthropic950.313,380N/AAug 6, 2026
144MIPhi-3.5-vision-instructMicrosoftmicrosoft851.62,592N/AAug 6, 2026

Top model distribution

Top published models on the same Arena scale.

Vision

Arena highlights

Rank #1Claude Fable 51330.5 ratingRank #3Claude Opus 4.71316.4 ratingRank #6Qwen3.8 Max1314.6 ratingRank #7Claude Opus 4.61311.0 rating

What is the Vision Arena?

Registry-backed context for this evaluation surface.

Vision reports rating values and currently defines 11 evaluation categories.

Arena results are preference or task-outcome signals. They are not automatically equivalent to capability benchmark scores.

FAQ

Common questions about Vision.

Which model leads Vision?

Claude Fable 5 is currently ranked first on the published Arena scale.

What does Vision measure?

This Arena reports rating values across 11 configured evaluation categories.

Does this result affect the LLMBoard score?

No. Arena results remain a separate preference or task-outcome signal.

How many models are included?

65 canonical published model results are currently shown.

Rankings

OverallCodingText ArenaPricing

Modalities

Image GenerationVideo GenerationSpeech-to-TextEmbeddings

Benchmarks

All BenchmarksReasoningMathCoding

Vendors

All VendorsOpenAIAnthropicGoogle
llmboard.aiCopyright 2026 llmboard.ai