Coding
WebDev Arena
LMArena Code / WebDev human-preference Elo for front-end and agentic web development tasks; this is a time-varying leaderboard snapshot, not a fixed model property.
How models are tested
Scores are published numbers from the sources below. They are only comparable when the evaluation version, tools, agent harness, and sampling setup match. Missing scores are omitted rather than treated as zero.
- Category
- Coding
- Metric
- Elo
- Direction
- Higher is better
- Coverage
- 74 / 318Models in this catalog with a published score
- Updated
- Catalog snapshot date
Scores
- 1Claude Fable 5.11,758
Anthropicclosed
- 2Claude Opus 51,687
Anthropicclosed
- 3Qwen3.8 Max 09021,681
Alibabaclosed
- 4Kimi K31,674
Moonshotopen
- 5Qwen3.8 Max1,671
Alibabaopen
- 6Qwen3.8 Flash Next1,635
Alibabaopen
- 7Claude Fable 51,628
Anthropicclosed
- 8Hy4 Preview1,624
Tencentopen
- 9DeepSeek V4.1 Flash1,620
DeepSeekopen
- 10Grok 4.61,618
xAIclosed
- 11GPT-5.6 Sol1,617
OpenAIclosed
- 12GLM-5.31,614
Zhipu AIopen
- 13GLM-5.3 Flash1,607
Zhipu AIopen
- 14Qwen3.8 27B1,593
Alibabaopen
- 15GLM-5.21,592
Zhipu AIopen
- 16Gemini 3.7 Flash1,588
Googleclosed
- 17DeepSeek V4 Flash1,580
DeepSeekopen
- 18Gemini 3.8 Flash1,567
Googleclosed
- 19Claude Opus 4.71,557
Anthropicclosed
- 20Grok 4.51,555
xAIclosed
- 21Muse Spark 1.11,542
Metaclosed
- 22Claude Opus 4.81,539
Anthropicclosed
- 23Claude Opus 4.61,537
Anthropicclosed
- 24Gemini 3.6 Flash1,537
Googleclosed
- 25Claude Sonnet 51,537
Anthropicclosed
- 26Muse Spark 1.21,535
Metaclosed
- 27GPT-5.6 Terra1,521
OpenAIclosed
- 28Claude Sonnet 4.61,521
Anthropicclosed
- 29GPT-5.6 Luna1,519
OpenAIclosed
- 30Qwen3.7 Max1,517
Alibabaclosed
- 31Hy31,513
Tencentopen
- 32GPT-5.51,510
OpenAIclosed
- 33Kimi K2.61,509
Moonshotclosed
- 34GLM-5.11,508
Zhipu AIopen
- 35Gemini 3.5 Flash1,492
Googleclosed
- 36MiniMax M31,487
MiniMaxopen
- 37MiMo-V2.5-Pro1,475
Xiaomiopen
- 38Kimi K2.7 Code1,473
Moonshotopen
- 39Claude Opus 4.51,468
Anthropicclosed
- 40Qwen3.6 Plus1,461
Alibabaclosed
- 41Gemini 3.1 Pro1,447
Googleclosed
- 42Gemini 3.5 Flash-Lite1,447
Googleclosed
- 43DeepSeek V4 Pro1,446
DeepSeekopen
- 44Gemini 3 Pro1,439
Googleclosed
- 45Gemini 3 Flash1,438
Googleclosed
- 46MiMo-V2.51,437
Xiaomiopen
- 47GLM-51,436
Zhipu AIopen
- 48GLM-4.71,435
Zhipu AIopen
- 49Inkling1,410
Thinking Machinesopen
- 50Inkling-Small1,407
Thinking Machinesopen
- 51Qwen3.5 397B-A17B1,399
Alibabaopen
- 52MiniMax M2.71,398
MiniMaxclosed
- 53GPT-5.4 Mini1,397
OpenAIclosed
- 54Claude Opus 4.11,389
Anthropicclosed
- 55GPT-5.41,387
OpenAIclosed
- 56Claude Sonnet 4.51,386
Anthropicclosed
- 57MiniMax M2.51,384
MiniMaxopen
- 58Solar Pro 41,372
Upstageclosed
- 59Gemma 4 31B1,364
Googleopen
- 60Gemma 4 26B1,362
Googleopen
- 61Muse Glimmer1,360
Metaopen
- 62Grok 4.31,357
xAIclosed
- 63Hunyuan 3 Preview1,356
Tencentclosed
- 64Claude Haiku 4.51,329
Anthropicclosed
- 65DeepSeek V3.21,325
DeepSeekopen
- 66Mistral Medium 3.51,265
Mistralopen
- 67Gemini 3.1 Flash-Lite1,254
Googleclosed
- 68Qwen3.5 Flash1,238
Alibabaclosed
- 69Trinity Large Thinking1,237
Arcee AIopen
- 70Mistral Large 31,230
Mistralopen
- 71Gemini 2.5 Pro1,226
Googleclosed
- 72Devstral 21,194
Mistralopen
- 73Granite 4.1 8B1,192
IBMopen
- 74Mercury 21,167
Inception Labsclosed