變化資料只在同一來源內計算
排名變化只比較可比的LMArena Text Style Control綜合榜單。Artificial Analysis與LiveBench目前沒有經OpenGPT凍結的上一期歷史資料,因此暫不顯示排名升降。
本月變化
本月上升最快本期首次上榜
本月上升最快
- gpt 5.5openai上升 1 名 · 17 → 16
本期首次上榜
- muse spark 1.1meta5
- kimi k3moonshot10
- gpt 5.6 sol xhighopenai11
- gemini 3.6 flashgoogle12
- gemini 3.5 flash highgoogle17
- gemini 3.5 flash mediumgoogle21
- grok 4.5xai33
- claude sonnet 5 highanthropic38
- gemini 3.5 flash litegoogle43
- inklingthinky62
- glm 5v turbozai74
首次上榜不等同於模型正式發布日期。
比較基準 2026年6月25日
排名變化
排名變化依來源記錄ID計算;新上榜模型不會被視為從第 0 名上升。新項目也可能讓原有記錄後移,因此名次下降不一定代表模型品質下降。379
| 模型記錄 | 服務商 | 上期排名 | 本期排名 | 變化 | 評分變化 |
|---|---|---|---|---|---|
| claude fable 5 | anthropic | 1 | 1 | 排名不變 | -0.86 |
| claude opus 4 6 thinking | anthropic | 2 | 2 | 排名不變 | +1.75 |
| claude opus 4 7 thinking | anthropic | 3 | 3 | 排名不變 | -0.26 |
| claude opus 4 6 | anthropic | 4 | 4 | 排名不變 | -1.31 |
| muse spark 1.1 | meta | — | 5 | 本期首次進入該來源榜單 | — |
| claude opus 4 7 | anthropic | 5 | 6 | 下降 1 名 | -0.14 |
| muse spark | meta | 6 | 7 | 下降 1 名 | +0.27 |
| gemini 3.1 pro preview | 7 | 8 | 下降 1 名 | -0.27 | |
| gemini 3 pro | 8 | 9 | 下降 1 名 | -0.06 | |
| kimi k3 | moonshot | — | 10 | 本期首次進入該來源榜單 | — |
| gpt 5.6 sol xhigh | openai | — | 11 | 本期首次進入該來源榜單 | — |
| gemini 3.6 flash | — | 12 | 本期首次進入該來源榜單 | — | |
| claude opus 4 8 thinking | anthropic | 9 | 13 | 下降 4 名 | -0.13 |
| gpt 5.5 high | openai | 10 | 14 | 下降 4 名 | +0.47 |
| gpt 5.4 high | openai | 12 | 15 | 下降 3 名 | +0.03 |
| gpt 5.5 | openai | 17 | 16 | 上升 1 名 | +1.50 |
| gemini 3.5 flash high | — | 17 | 本期首次進入該來源榜單 | — | |
| gpt 5.2 chat latest 20260210 | openai | 14 | 18 | 下降 4 名 | +0.18 |
| qwen3.7 max preview | alibaba | 16 | 19 | 下降 3 名 | +0.31 |
| grok 4.20 beta1 | xai | 18 | 20 | 下降 2 名 | -0.10 |
| gemini 3.5 flash medium | — | 21 | 本期首次進入該來源榜單 | — | |
| claude opus 4 8 | anthropic | 11 | 22 | 下降 11 名 | -5.62 |
| gpt 5.5 instant | openai | 22 | 23 | 下降 1 名 | +0.82 |
| grok 4.20 beta 0309 reasoning | xai | 15 | 24 | 下降 9 名 | -2.33 |
| gemini 3 flash | 20 | 25 | 下降 5 名 | -0.11 | |
| claude opus 4 5 20251101 thinking 32k | anthropic | 21 | 26 | 下降 5 名 | +0.02 |
| claude sonnet 4 6 | anthropic | 23 | 27 | 下降 4 名 | +0.33 |
| grok 4.20 multi agent beta 0309 | xai | 24 | 28 | 下降 4 名 | -0.14 |
| glm 5.1 | zai | 19 | 29 | 下降 10 名 | -3.77 |
| glm 5.2 (max) | zai | 25 | 30 | 下降 5 名 | -0.67 |
為什麼只有一個榜單顯示變化
目前比較的LMArena 6 月與 7 月快照屬於相同方法時期,較早歷史會分開標示方法時期。其他榜單來源目前沒有已凍結的可比上一期資料,因此不顯示排名升降。
新舊版本差異選擇同一模型系列的兩個目錄版本,查看服務商模型ID、官方資料和公開排名資料;OpenGPT目錄分類會另外標示。
| 新舊版本差異 | Claude Fable 5 | Claude Opus 4.7 |
|---|---|---|
| 官方模型ID | claude-fable-5 | claude-opus-4-7 |
| 目錄狀態 | 全面可用 | 全面可用 |
| OpenGPT目錄分類 | 旗艦 | 舊版本 |
| 目前公開排名資料 | 使用者偏好 1 · 1507 · 智慧指數 3 · 62 · 客觀工作 1 · 83.4 | 使用者偏好 6 · 1494 |
| 服務商資料 | Anthropic ↗ | Anthropic ↗ |
| 模型詳情 | 模型詳情 → | 模型詳情 → |
目前沒有可核實的功能差異資料。OpenGPT不推測速度、價格、上下文長度或品質提升。
榜單歷史快照每月保留一份固定快照,並用SHA-256 校驗,避免歷史檔案被替換。
| 月份 | 來源發布日期 | 方法版本 | 記錄數 | 檔案校驗 | 下載JSON |
|---|---|---|---|---|---|
| 2026年7月 目前 | 方法版本 3 | 378 | 30a2b9915774… | 下載JSON ↓ | |
| 2026年6月 | 方法版本 3 | 368 | a06ed961a983… | 下載JSON ↓ | |
| 2026年5月 | 方法版本 3 | 360 | 057c9e12679b… | 下載JSON ↓ | |
| 2026年4月 | 方法版本 3 | 354 | dca5faa06859… | 下載JSON ↓ | |
| 2026年3月 | 方法版本 3 | 336 | c258a21cfd6f… | 下載JSON ↓ | |
| 2026年2月 | 方法版本 3 | 319 | 4f21abee9ac0… | 下載JSON ↓ | |
| 2026年1月 | 方法版本 3 | 302 | b252f774df59… | 下載JSON ↓ | |
| 2025年12月 | 方法版本 3 | 291 | 75a5e543c2b0… | 下載JSON ↓ | |
| 2025年11月 | 方法版本 3 | 276 | cf161eb704e7… | 下載JSON ↓ | |
| 2025年10月 | 方法版本 3 | 259 | f9589f5985c3… | 下載JSON ↓ | |
| 2025年9月 | 方法版本 3 | 248 | ba97765955d4… | 下載JSON ↓ | |
| 2025年8月 | 方法版本 3 | 238 | 28fbbd1445b0… | 下載JSON ↓ |
早期記錄是後來從LMArena官方完整歷史資料中匯入的來源快照,並不表示OpenGPT曾在對應歷史日期發布這些版本。