变化数据只在同一来源内计算
排名变化仅比较可比的LMArena Text Style Control综合榜单。Artificial Analysis与LiveBench暂无经OpenGPT冻结的上一期历史数据,因此暂不显示排名升降。
本月变化
本月上升最快本期首次上榜
本月上升最快
- gpt 5.5openai上升 1 位 · 17 → 16
本期首次上榜
- muse spark 1.1meta5
- kimi k3moonshot10
- gpt 5.6 sol xhighopenai11
- gemini 3.6 flashgoogle12
- gemini 3.5 flash highgoogle17
- gemini 3.5 flash mediumgoogle21
- grok 4.5xai33
- claude sonnet 5 highanthropic38
- gemini 3.5 flash litegoogle43
- inklingthinky62
- glm 5v turbozai74
首次上榜不等同于模型正式发布日期。
比较基准 2026年6月25日
排名变化
排名变化按来源记录ID计算;新上榜模型不会被视为从第 0 名上升。新条目也可能让原有记录后移,因此名次下降不一定代表模型质量下降。379
| 模型记录 | 服务商 | 上期排名 | 本期排名 | 变化 | 评分变化 |
|---|---|---|---|---|---|
| claude fable 5 | anthropic | 1 | 1 | 排名不变 | -0.86 |
| claude opus 4 6 thinking | anthropic | 2 | 2 | 排名不变 | +1.75 |
| claude opus 4 7 thinking | anthropic | 3 | 3 | 排名不变 | -0.26 |
| claude opus 4 6 | anthropic | 4 | 4 | 排名不变 | -1.31 |
| muse spark 1.1 | meta | — | 5 | 本期首次进入该来源榜单 | — |
| claude opus 4 7 | anthropic | 5 | 6 | 下降 1 位 | -0.14 |
| muse spark | meta | 6 | 7 | 下降 1 位 | +0.27 |
| gemini 3.1 pro preview | 7 | 8 | 下降 1 位 | -0.27 | |
| gemini 3 pro | 8 | 9 | 下降 1 位 | -0.06 | |
| kimi k3 | moonshot | — | 10 | 本期首次进入该来源榜单 | — |
| gpt 5.6 sol xhigh | openai | — | 11 | 本期首次进入该来源榜单 | — |
| gemini 3.6 flash | — | 12 | 本期首次进入该来源榜单 | — | |
| claude opus 4 8 thinking | anthropic | 9 | 13 | 下降 4 位 | -0.13 |
| gpt 5.5 high | openai | 10 | 14 | 下降 4 位 | +0.47 |
| gpt 5.4 high | openai | 12 | 15 | 下降 3 位 | +0.03 |
| gpt 5.5 | openai | 17 | 16 | 上升 1 位 | +1.50 |
| gemini 3.5 flash high | — | 17 | 本期首次进入该来源榜单 | — | |
| gpt 5.2 chat latest 20260210 | openai | 14 | 18 | 下降 4 位 | +0.18 |
| qwen3.7 max preview | alibaba | 16 | 19 | 下降 3 位 | +0.31 |
| grok 4.20 beta1 | xai | 18 | 20 | 下降 2 位 | -0.10 |
| gemini 3.5 flash medium | — | 21 | 本期首次进入该来源榜单 | — | |
| claude opus 4 8 | anthropic | 11 | 22 | 下降 11 位 | -5.62 |
| gpt 5.5 instant | openai | 22 | 23 | 下降 1 位 | +0.82 |
| grok 4.20 beta 0309 reasoning | xai | 15 | 24 | 下降 9 位 | -2.33 |
| gemini 3 flash | 20 | 25 | 下降 5 位 | -0.11 | |
| claude opus 4 5 20251101 thinking 32k | anthropic | 21 | 26 | 下降 5 位 | +0.02 |
| claude sonnet 4 6 | anthropic | 23 | 27 | 下降 4 位 | +0.33 |
| grok 4.20 multi agent beta 0309 | xai | 24 | 28 | 下降 4 位 | -0.14 |
| glm 5.1 | zai | 19 | 29 | 下降 10 位 | -3.77 |
| glm 5.2 (max) | zai | 25 | 30 | 下降 5 位 | -0.67 |
为什么只有一个榜单显示变化
当前比较的LMArena 6 月与 7 月快照属于同一方法时期,较早历史会分开标注方法时期。其他榜单来源目前没有已冻结的可比上一期数据,因此不显示排名升降。
新旧版本差异选择同一模型系列的两个目录版本,查看服务商模型ID、官方资料和公开排名数据;OpenGPT目录分类会单独标明。
| 新旧版本差异 | Claude Fable 5 | Claude Opus 4.7 |
|---|---|---|
| 官方模型ID | claude-fable-5 | claude-opus-4-7 |
| 目录状态 | 全面可用 | 全面可用 |
| OpenGPT目录分类 | 旗舰 | 旧版本 |
| 当前公开排名数据 | 用户偏好 1 · 1507 · 智能指数 3 · 62 · 客观任务 1 · 83.4 | 用户偏好 6 · 1494 |
| 服务商资料 | Anthropic ↗ | Anthropic ↗ |
| 模型详情 | 模型详情 → | 模型详情 → |
暂无可核实的功能差异数据。OpenGPT不推测速度、价格、上下文长度或质量提升。
榜单历史快照每月保留一份固定快照,并用SHA-256 校验,避免历史文件被替换。
| 月份 | 来源发布日期 | 方法版本 | 记录数 | 文件校验 | 下载JSON |
|---|---|---|---|---|---|
| 2026年7月 当前 | 方法版本 3 | 378 | 30a2b9915774… | 下载JSON ↓ | |
| 2026年6月 | 方法版本 3 | 368 | a06ed961a983… | 下载JSON ↓ | |
| 2026年5月 | 方法版本 3 | 360 | 057c9e12679b… | 下载JSON ↓ | |
| 2026年4月 | 方法版本 3 | 354 | dca5faa06859… | 下载JSON ↓ | |
| 2026年3月 | 方法版本 3 | 336 | c258a21cfd6f… | 下载JSON ↓ | |
| 2026年2月 | 方法版本 3 | 319 | 4f21abee9ac0… | 下载JSON ↓ | |
| 2026年1月 | 方法版本 3 | 302 | b252f774df59… | 下载JSON ↓ | |
| 2025年12月 | 方法版本 3 | 291 | 75a5e543c2b0… | 下载JSON ↓ | |
| 2025年11月 | 方法版本 3 | 276 | cf161eb704e7… | 下载JSON ↓ | |
| 2025年10月 | 方法版本 3 | 259 | f9589f5985c3… | 下载JSON ↓ | |
| 2025年9月 | 方法版本 3 | 248 | ba97765955d4… | 下载JSON ↓ | |
| 2025年8月 | 方法版本 3 | 238 | 28fbbd1445b0… | 下载JSON ↓ |
早期记录是后来从LMArena官方完整历史数据中导入的来源快照,并不表示OpenGPT曾在对应历史日期发布这些版本。