- 发布日期
- 2026年7月24日
- 数据截止
- 2026年7月24日
- 方法版本
- OpenGPT research synthesis 1.0
- 排名依据
- 3 个独立公开来源
2026年7月 · 研究版
选择排名角度
真人偏好
LMArena 最新风格控制总体榜单。完整收录来源快照中的全部公开配置,可通过搜索与筛选查看完整名单。
独立来源LMArena
显示 40 / 378. 真人偏好.
- 来源内名次#1
claude-fable-5
Anthropic- 来源所写配置
- Text · Style control · Overall
- OpenGPT 目录 ID
claude-fable-5- 投票数
- 14,646
- 置信区间
- 1500.9–1513.7
- 许可协议
- Proprietary
真人偏好1507 - 来源内名次#2
claude-opus-4-6-thinking
Anthropic- 来源所写配置
- Text · Style control · Overall
- 投票数
- 63,191
- 置信区间
- 1501.1–1508.6
- 许可协议
- Proprietary
真人偏好1505尚未进入 OpenGPT 具体模型目录 - 来源内名次#3
claude-opus-4-7-thinking
Anthropic- 来源所写配置
- Text · Style control · Overall
- 投票数
- 50,683
- 置信区间
- 1497.8–1506.2
- 许可协议
- Proprietary
真人偏好1502尚未进入 OpenGPT 具体模型目录 - 来源内名次#4
claude-opus-4-6
Anthropic- 来源所写配置
- Text · Style control · Overall
- 投票数
- 67,037
- 置信区间
- 1494.1–1501.4
- 许可协议
- Proprietary
真人偏好1498尚未进入 OpenGPT 具体模型目录 - 来源内名次#5
muse-spark-1.1
Meta- 来源所写配置
- Text · Style control · Overall
- 投票数
- 7,927
- 置信区间
- 1487.8–1502.3
- 许可协议
- Proprietary
真人偏好1495尚未进入 OpenGPT 具体模型目录 - 来源内名次#6
claude-opus-4-7
Anthropic- 来源所写配置
- Text · Style control · Overall
- 投票数
- 51,788
- 置信区间
- 1489.5–1497.9
- 许可协议
- Proprietary
真人偏好1494尚未进入 OpenGPT 具体模型目录 - 来源内名次#7
muse-spark
Meta- 来源所写配置
- Text · Style control · Overall
- 投票数
- 13,565
- 置信区间
- 1481.7–1493.4
- 许可协议
- Proprietary
真人偏好1488尚未进入 OpenGPT 具体模型目录 - 来源内名次#8
gemini-3.1-pro-preview
Google- 来源所写配置
- Text · Style control · Overall
- OpenGPT 目录 ID
gemini-3.1-pro-preview- 投票数
- 84,631
- 置信区间
- 1482.3–1489.3
- 许可协议
- Proprietary
真人偏好1486 - 来源内名次#9
gemini-3-pro
Google- 来源所写配置
- Text · Style control · Overall
- 投票数
- 41,268
- 置信区间
- 1481.9–1489.6
- 许可协议
- Proprietary
真人偏好1486尚未进入 OpenGPT 具体模型目录 - 来源内名次#10
kimi-k3
Moonshot AI- 来源所写配置
- Text · Style control · Overall
- OpenGPT 目录 ID
kimi-k3- 投票数
- 3,619
- 置信区间
- 1475.7–1495.6
- 许可协议
- Proprietary
真人偏好1486 - 来源内名次#11
gpt-5.6-sol-xhigh
OpenAI- 来源所写配置
- Text · Style control · Overall
- 投票数
- 6,221
- 置信区间
- 1477.2–1493.0
- 许可协议
- Proprietary
真人偏好1485尚未进入 OpenGPT 具体模型目录 - 来源内名次#12
gemini-3.6-flash
Google- 来源所写配置
- Text · Style control · Overall
- 投票数
- 4,747
- 置信区间
- 1476.2–1493.9
- 许可协议
- Proprietary
真人偏好1485尚未进入 OpenGPT 具体模型目录 - 来源内名次#13
claude-opus-4-8-thinking
Anthropic- 来源所写配置
- Text · Style control · Overall
- 投票数
- 30,901
- 置信区间
- 1478.5–1488.7
- 许可协议
- Proprietary
真人偏好1484尚未进入 OpenGPT 具体模型目录 - 来源内名次#14
gpt-5.5-high
OpenAI- 来源所写配置
- Text · Style control · Overall
- 投票数
- 45,760
- 置信区间
- 1477.3–1486.1
- 许可协议
- Proprietary
真人偏好1482尚未进入 OpenGPT 具体模型目录 - 来源内名次#15
gpt-5.4-high
OpenAI- 来源所写配置
- Text · Style control · Overall
- 投票数
- 58,997
- 置信区间
- 1473.8–1481.7
- 许可协议
- Proprietary
真人偏好1478尚未进入 OpenGPT 具体模型目录 - 来源内名次#16
gpt-5.5
OpenAI- 来源所写配置
- Text · Style control · Overall
- 投票数
- 47,180
- 置信区间
- 1472.0–1480.7
- 许可协议
- Proprietary
真人偏好1476尚未进入 OpenGPT 具体模型目录 - 来源内名次#17
gemini-3.5-flash-high
Google- 来源所写配置
- Text · Style control · Overall
- 投票数
- 10,092
- 置信区间
- 1469.7–1482.8
- 许可协议
- Proprietary
真人偏好1476尚未进入 OpenGPT 具体模型目录 - 来源内名次#18
gpt-5.2-chat-latest-20260210
OpenAI- 来源所写配置
- Text · Style control · Overall
- 投票数
- 34,420
- 置信区间
- 1471.6–1479.8
- 许可协议
- Proprietary
真人偏好1476尚未进入 OpenGPT 具体模型目录 - 来源内名次#19
qwen3.7-max-preview
Alibaba- 来源所写配置
- Text · Style control · Overall
- 投票数
- 3,714
- 置信区间
- 1465.1–1485.2
- 许可协议
- Proprietary
真人偏好1475尚未进入 OpenGPT 具体模型目录 - 来源内名次#20
grok-4.20-beta1
xAI- 来源所写配置
- Text · Style control · Overall
- 投票数
- 26,822
- 置信区间
- 1469.7–1479.0
- 许可协议
- Proprietary
真人偏好1474尚未进入 OpenGPT 具体模型目录 - 来源内名次#21
gemini-3.5-flash-medium
Google- 来源所写配置
- Text · Style control · Overall
- 投票数
- 14,063
- 置信区间
- 1468.2–1480.4
- 许可协议
- Proprietary
真人偏好1474尚未进入 OpenGPT 具体模型目录 - 来源内名次#22
claude-opus-4-8
Anthropic- 来源所写配置
- Text · Style control · Overall
- OpenGPT 目录 ID
claude-opus-4-8- 投票数
- 31,619
- 置信区间
- 1468.3–1478.5
- 许可协议
- Proprietary
真人偏好1473 - 来源内名次#23
gpt-5.5-instant
OpenAI- 来源所写配置
- Text · Style control · Overall
- 投票数
- 25,995
- 置信区间
- 1468.2–1478.5
- 许可协议
- Proprietary
真人偏好1473尚未进入 OpenGPT 具体模型目录 - 来源内名次#24
grok-4.20-beta-0309-reasoning
xAI- 来源所写配置
- Text · Style control · Overall
- 投票数
- 60,330
- 置信区间
- 1469.3–1477.0
- 许可协议
- Proprietary
真人偏好1473尚未进入 OpenGPT 具体模型目录 - 来源内名次#25
gemini-3-flash
Google- 来源所写配置
- Text · Style control · Overall
- 投票数
- 30,682
- 置信区间
- 1468.7–1477.5
- 许可协议
- Proprietary
真人偏好1473尚未进入 OpenGPT 具体模型目录 - 来源内名次#26
claude-opus-4-5-20251101-thinking-32k
Anthropic- 来源所写配置
- Text · Style control · Overall
- 投票数
- 37,037
- 置信区间
- 1469.0–1476.8
- 许可协议
- Proprietary
真人偏好1473尚未进入 OpenGPT 具体模型目录 - 来源内名次#27
claude-sonnet-4-6
Anthropic- 来源所写配置
- Text · Style control · Overall
- 投票数
- 57,183
- 置信区间
- 1468.7–1476.4
- 许可协议
- Proprietary
真人偏好1473尚未进入 OpenGPT 具体模型目录 - 来源内名次#28
grok-4.20-multi-agent-beta-0309
xAI- 来源所写配置
- Text · Style control · Overall
- 投票数
- 59,116
- 置信区间
- 1467.1–1474.8
- 许可协议
- Proprietary
真人偏好1471尚未进入 OpenGPT 具体模型目录 - 来源内名次#29
glm-5.1
Z.AI- 来源所写配置
- Text · Style control · Overall
- 投票数
- 30,726
- 置信区间
- 1465.1–1474.2
- 许可协议
- MIT
真人偏好1470尚未进入 OpenGPT 具体模型目录 - 来源内名次#30
glm-5.2 (max)
Z.AI- 来源所写配置
- Text · Style control · Overall
- 投票数
- 18,017
- 置信区间
- 1463.4–1475.0
- 许可协议
- MIT
真人偏好1469尚未进入 OpenGPT 具体模型目录 - 来源内名次#31
claude-opus-4-5-20251101
Anthropic- 来源所写配置
- Text · Style control · Overall
- 投票数
- 70,976
- 置信区间
- 1465.9–1472.3
- 许可协议
- Proprietary
真人偏好1469尚未进入 OpenGPT 具体模型目录 - 来源内名次#32
ernie-5.1
Baidu- 来源所写配置
- Text · Style control · Overall
- 投票数
- 37,418
- 置信区间
- 1463.1–1472.4
- 许可协议
- Proprietary
真人偏好1468尚未进入 OpenGPT 具体模型目录 - 来源内名次#33
grok-4.5
xAI- 来源所写配置
- Text · Style control · Overall
- OpenGPT 目录 ID
grok-4.5- 投票数
- 7,833
- 置信区间
- 1460.4–1475.0
- 许可协议
- Proprietary
真人偏好1468 - 来源内名次#34
mimo-v2.5-pro
Xiaomi- 来源所写配置
- Text · Style control · Overall
- 投票数
- 42,195
- 置信区间
- 1462.4–1471.3
- 许可协议
- MIT
真人偏好1467尚未进入 OpenGPT 具体模型目录 - 来源内名次#35
gpt-5.4
OpenAI- 来源所写配置
- Text · Style control · Overall
- 投票数
- 62,036
- 置信区间
- 1462.4–1470.1
- 许可协议
- Proprietary
真人偏好1466尚未进入 OpenGPT 具体模型目录 - 来源内名次#36
grok-4.1-thinking
xAI- 来源所写配置
- Text · Style control · Overall
- 投票数
- 65,461
- 置信区间
- 1462.7–1469.1
- 许可协议
- Proprietary
真人偏好1466尚未进入 OpenGPT 具体模型目录 - 来源内名次#37
qwen3.5-max-preview
Alibaba- 来源所写配置
- Text · Style control · Overall
- 投票数
- 21,479
- 置信区间
- 1459.8–1469.8
- 许可协议
- Proprietary
真人偏好1465尚未进入 OpenGPT 具体模型目录 - 来源内名次#38
claude-sonnet-5-high
Anthropic- 来源所写配置
- Text · Style control · Overall
- 投票数
- 13,521
- 置信区间
- 1454.9–1467.4
- 许可协议
- Proprietary
真人偏好1461尚未进入 OpenGPT 具体模型目录 - 来源内名次#39
kimi-k2.6
Moonshot AI- 来源所写配置
- Text · Style control · Overall
- OpenGPT 目录 ID
kimi-k2.6- 投票数
- 37,686
- 置信区间
- 1456.4–1465.5
- 许可协议
- Modified MIT
真人偏好1461 - 来源内名次#40
qwen3.6-max-preview
Alibaba- 来源所写配置
- Text · Style control · Overall
- 投票数
- 5,188
- 置信区间
- 1451.7–1468.5
- 许可协议
- Proprietary
真人偏好1460尚未进入 OpenGPT 具体模型目录
显示 40 / 378
排名依据
如何理解这些排名
分数保留各发布方的原始量表,不合并成一个综合总分。
缺失数据不等于 0,只表示该发布方在本期快照中没有报告这项指标。
名次适用于所写的具体模型配置和来源版本,不能直接推广到所有任务、地区或部署方式。
任何服务商都不能付费购买名次;OpenGPT 直接链接原始数据。
排名依据
数据与来源
每个视图都保留来源的指标、版本和方法。你可以通过链接核验原始工作。方法版本
可预期的发布节奏
OpenGPT 将动态信号与冻结版本分开,确保过去的决策可以审计。- 01
每周观察
检查新模型与评测发布,标记重要变化,但不会悄悄改写当前版本。
- 02
每月冻结版
发布带日期、具体配置、来源版本和更正记录的快照。
- 03
每季度方法复核
修改方法前,复核分类、来源质量、冲突和纳入规则。
发布日期
历史快照
首次发布 · 下载冻结数据
下一期计划。仅在完成来源采集和复核后发布。