- 發布日期
- 2026年7月24日
- 資料截止
- 2026年7月24日
- 方法版本
- OpenGPT research synthesis 1.0
- 排名依據
- 3 個獨立公開來源
2026年7月 · 研究版
選擇排名角度
真人偏好
LMArena 最新風格控制整體榜單。完整收錄來源快照中的所有公開設定,可透過搜尋與篩選查看完整名單。
獨立來源LMArena
顯示 40 / 378. 真人偏好.
- 來源內名次#1
claude-fable-5
Anthropic- 來源所列設定
- Text · Style control · Overall
- OpenGPT 目錄 ID
claude-fable-5- 投票數
- 14,646
- 信賴區間
- 1500.9–1513.7
- 授權條款
- Proprietary
真人偏好1507 - 來源內名次#2
claude-opus-4-6-thinking
Anthropic- 來源所列設定
- Text · Style control · Overall
- 投票數
- 63,191
- 信賴區間
- 1501.1–1508.6
- 授權條款
- Proprietary
真人偏好1505尚未加入 OpenGPT 具體模型目錄 - 來源內名次#3
claude-opus-4-7-thinking
Anthropic- 來源所列設定
- Text · Style control · Overall
- 投票數
- 50,683
- 信賴區間
- 1497.8–1506.2
- 授權條款
- Proprietary
真人偏好1502尚未加入 OpenGPT 具體模型目錄 - 來源內名次#4
claude-opus-4-6
Anthropic- 來源所列設定
- Text · Style control · Overall
- 投票數
- 67,037
- 信賴區間
- 1494.1–1501.4
- 授權條款
- Proprietary
真人偏好1498尚未加入 OpenGPT 具體模型目錄 - 來源內名次#5
muse-spark-1.1
Meta- 來源所列設定
- Text · Style control · Overall
- 投票數
- 7,927
- 信賴區間
- 1487.8–1502.3
- 授權條款
- Proprietary
真人偏好1495尚未加入 OpenGPT 具體模型目錄 - 來源內名次#6
claude-opus-4-7
Anthropic- 來源所列設定
- Text · Style control · Overall
- 投票數
- 51,788
- 信賴區間
- 1489.5–1497.9
- 授權條款
- Proprietary
真人偏好1494尚未加入 OpenGPT 具體模型目錄 - 來源內名次#7
muse-spark
Meta- 來源所列設定
- Text · Style control · Overall
- 投票數
- 13,565
- 信賴區間
- 1481.7–1493.4
- 授權條款
- Proprietary
真人偏好1488尚未加入 OpenGPT 具體模型目錄 - 來源內名次#8
gemini-3.1-pro-preview
Google- 來源所列設定
- Text · Style control · Overall
- OpenGPT 目錄 ID
gemini-3.1-pro-preview- 投票數
- 84,631
- 信賴區間
- 1482.3–1489.3
- 授權條款
- Proprietary
真人偏好1486 - 來源內名次#9
gemini-3-pro
Google- 來源所列設定
- Text · Style control · Overall
- 投票數
- 41,268
- 信賴區間
- 1481.9–1489.6
- 授權條款
- Proprietary
真人偏好1486尚未加入 OpenGPT 具體模型目錄 - 來源內名次#10
kimi-k3
Moonshot AI- 來源所列設定
- Text · Style control · Overall
- OpenGPT 目錄 ID
kimi-k3- 投票數
- 3,619
- 信賴區間
- 1475.7–1495.6
- 授權條款
- Proprietary
真人偏好1486 - 來源內名次#11
gpt-5.6-sol-xhigh
OpenAI- 來源所列設定
- Text · Style control · Overall
- 投票數
- 6,221
- 信賴區間
- 1477.2–1493.0
- 授權條款
- Proprietary
真人偏好1485尚未加入 OpenGPT 具體模型目錄 - 來源內名次#12
gemini-3.6-flash
Google- 來源所列設定
- Text · Style control · Overall
- 投票數
- 4,747
- 信賴區間
- 1476.2–1493.9
- 授權條款
- Proprietary
真人偏好1485尚未加入 OpenGPT 具體模型目錄 - 來源內名次#13
claude-opus-4-8-thinking
Anthropic- 來源所列設定
- Text · Style control · Overall
- 投票數
- 30,901
- 信賴區間
- 1478.5–1488.7
- 授權條款
- Proprietary
真人偏好1484尚未加入 OpenGPT 具體模型目錄 - 來源內名次#14
gpt-5.5-high
OpenAI- 來源所列設定
- Text · Style control · Overall
- 投票數
- 45,760
- 信賴區間
- 1477.3–1486.1
- 授權條款
- Proprietary
真人偏好1482尚未加入 OpenGPT 具體模型目錄 - 來源內名次#15
gpt-5.4-high
OpenAI- 來源所列設定
- Text · Style control · Overall
- 投票數
- 58,997
- 信賴區間
- 1473.8–1481.7
- 授權條款
- Proprietary
真人偏好1478尚未加入 OpenGPT 具體模型目錄 - 來源內名次#16
gpt-5.5
OpenAI- 來源所列設定
- Text · Style control · Overall
- 投票數
- 47,180
- 信賴區間
- 1472.0–1480.7
- 授權條款
- Proprietary
真人偏好1476尚未加入 OpenGPT 具體模型目錄 - 來源內名次#17
gemini-3.5-flash-high
Google- 來源所列設定
- Text · Style control · Overall
- 投票數
- 10,092
- 信賴區間
- 1469.7–1482.8
- 授權條款
- Proprietary
真人偏好1476尚未加入 OpenGPT 具體模型目錄 - 來源內名次#18
gpt-5.2-chat-latest-20260210
OpenAI- 來源所列設定
- Text · Style control · Overall
- 投票數
- 34,420
- 信賴區間
- 1471.6–1479.8
- 授權條款
- Proprietary
真人偏好1476尚未加入 OpenGPT 具體模型目錄 - 來源內名次#19
qwen3.7-max-preview
Alibaba- 來源所列設定
- Text · Style control · Overall
- 投票數
- 3,714
- 信賴區間
- 1465.1–1485.2
- 授權條款
- Proprietary
真人偏好1475尚未加入 OpenGPT 具體模型目錄 - 來源內名次#20
grok-4.20-beta1
xAI- 來源所列設定
- Text · Style control · Overall
- 投票數
- 26,822
- 信賴區間
- 1469.7–1479.0
- 授權條款
- Proprietary
真人偏好1474尚未加入 OpenGPT 具體模型目錄 - 來源內名次#21
gemini-3.5-flash-medium
Google- 來源所列設定
- Text · Style control · Overall
- 投票數
- 14,063
- 信賴區間
- 1468.2–1480.4
- 授權條款
- Proprietary
真人偏好1474尚未加入 OpenGPT 具體模型目錄 - 來源內名次#22
claude-opus-4-8
Anthropic- 來源所列設定
- Text · Style control · Overall
- OpenGPT 目錄 ID
claude-opus-4-8- 投票數
- 31,619
- 信賴區間
- 1468.3–1478.5
- 授權條款
- Proprietary
真人偏好1473 - 來源內名次#23
gpt-5.5-instant
OpenAI- 來源所列設定
- Text · Style control · Overall
- 投票數
- 25,995
- 信賴區間
- 1468.2–1478.5
- 授權條款
- Proprietary
真人偏好1473尚未加入 OpenGPT 具體模型目錄 - 來源內名次#24
grok-4.20-beta-0309-reasoning
xAI- 來源所列設定
- Text · Style control · Overall
- 投票數
- 60,330
- 信賴區間
- 1469.3–1477.0
- 授權條款
- Proprietary
真人偏好1473尚未加入 OpenGPT 具體模型目錄 - 來源內名次#25
gemini-3-flash
Google- 來源所列設定
- Text · Style control · Overall
- 投票數
- 30,682
- 信賴區間
- 1468.7–1477.5
- 授權條款
- Proprietary
真人偏好1473尚未加入 OpenGPT 具體模型目錄 - 來源內名次#26
claude-opus-4-5-20251101-thinking-32k
Anthropic- 來源所列設定
- Text · Style control · Overall
- 投票數
- 37,037
- 信賴區間
- 1469.0–1476.8
- 授權條款
- Proprietary
真人偏好1473尚未加入 OpenGPT 具體模型目錄 - 來源內名次#27
claude-sonnet-4-6
Anthropic- 來源所列設定
- Text · Style control · Overall
- 投票數
- 57,183
- 信賴區間
- 1468.7–1476.4
- 授權條款
- Proprietary
真人偏好1473尚未加入 OpenGPT 具體模型目錄 - 來源內名次#28
grok-4.20-multi-agent-beta-0309
xAI- 來源所列設定
- Text · Style control · Overall
- 投票數
- 59,116
- 信賴區間
- 1467.1–1474.8
- 授權條款
- Proprietary
真人偏好1471尚未加入 OpenGPT 具體模型目錄 - 來源內名次#29
glm-5.1
Z.AI- 來源所列設定
- Text · Style control · Overall
- 投票數
- 30,726
- 信賴區間
- 1465.1–1474.2
- 授權條款
- MIT
真人偏好1470尚未加入 OpenGPT 具體模型目錄 - 來源內名次#30
glm-5.2 (max)
Z.AI- 來源所列設定
- Text · Style control · Overall
- 投票數
- 18,017
- 信賴區間
- 1463.4–1475.0
- 授權條款
- MIT
真人偏好1469尚未加入 OpenGPT 具體模型目錄 - 來源內名次#31
claude-opus-4-5-20251101
Anthropic- 來源所列設定
- Text · Style control · Overall
- 投票數
- 70,976
- 信賴區間
- 1465.9–1472.3
- 授權條款
- Proprietary
真人偏好1469尚未加入 OpenGPT 具體模型目錄 - 來源內名次#32
ernie-5.1
Baidu- 來源所列設定
- Text · Style control · Overall
- 投票數
- 37,418
- 信賴區間
- 1463.1–1472.4
- 授權條款
- Proprietary
真人偏好1468尚未加入 OpenGPT 具體模型目錄 - 來源內名次#33
grok-4.5
xAI- 來源所列設定
- Text · Style control · Overall
- OpenGPT 目錄 ID
grok-4.5- 投票數
- 7,833
- 信賴區間
- 1460.4–1475.0
- 授權條款
- Proprietary
真人偏好1468 - 來源內名次#34
mimo-v2.5-pro
Xiaomi- 來源所列設定
- Text · Style control · Overall
- 投票數
- 42,195
- 信賴區間
- 1462.4–1471.3
- 授權條款
- MIT
真人偏好1467尚未加入 OpenGPT 具體模型目錄 - 來源內名次#35
gpt-5.4
OpenAI- 來源所列設定
- Text · Style control · Overall
- 投票數
- 62,036
- 信賴區間
- 1462.4–1470.1
- 授權條款
- Proprietary
真人偏好1466尚未加入 OpenGPT 具體模型目錄 - 來源內名次#36
grok-4.1-thinking
xAI- 來源所列設定
- Text · Style control · Overall
- 投票數
- 65,461
- 信賴區間
- 1462.7–1469.1
- 授權條款
- Proprietary
真人偏好1466尚未加入 OpenGPT 具體模型目錄 - 來源內名次#37
qwen3.5-max-preview
Alibaba- 來源所列設定
- Text · Style control · Overall
- 投票數
- 21,479
- 信賴區間
- 1459.8–1469.8
- 授權條款
- Proprietary
真人偏好1465尚未加入 OpenGPT 具體模型目錄 - 來源內名次#38
claude-sonnet-5-high
Anthropic- 來源所列設定
- Text · Style control · Overall
- 投票數
- 13,521
- 信賴區間
- 1454.9–1467.4
- 授權條款
- Proprietary
真人偏好1461尚未加入 OpenGPT 具體模型目錄 - 來源內名次#39
kimi-k2.6
Moonshot AI- 來源所列設定
- Text · Style control · Overall
- OpenGPT 目錄 ID
kimi-k2.6- 投票數
- 37,686
- 信賴區間
- 1456.4–1465.5
- 授權條款
- Modified MIT
真人偏好1461 - 來源內名次#40
qwen3.6-max-preview
Alibaba- 來源所列設定
- Text · Style control · Overall
- 投票數
- 5,188
- 信賴區間
- 1451.7–1468.5
- 授權條款
- Proprietary
真人偏好1460尚未加入 OpenGPT 具體模型目錄
顯示 40 / 378
排名依據
如何理解這些排名
分數保留各發布方的原始量表,不合併成一個綜合總分。
缺少資料不等於 0,只表示該發布方在本期快照中沒有報告這項指標。
名次適用於所列的具體模型設定和來源版本,不能直接推廣到所有工作、地區或部署方式。
任何服務商都不能付費購買名次;OpenGPT 直接連結原始資料。
排名依據
資料與來源
每個檢視都保留來源的指標、版本與方法。你可以透過連結核驗原始工作。方法版本
可預期的發布節奏
OpenGPT 將動態訊號與凍結版本分開,確保過去的決策可以稽核。- 01
每週觀察
檢查新模型與評測發布,標記重要變化,但不會悄悄改寫目前版本。
- 02
每月凍結版
發布包含日期、具體設定、來源版本與更正記錄的快照。
- 03
每季方法複核
修改方法前,複核分類、來源品質、衝突與納入規則。
發布日期
歷史快照
首次發布 · 下載凍結資料
下一期計畫。只在完成來源擷取與複核後發布。