数据版本
2026-08 · 2026-08-30
自动验证决策范围
20 个自动验证决策模型 / 79 个目录模型
当前排名快照
2026-08-27 · 395 条来源记录
最新可比变化版
2026-07-21 → 2026-08-27
生命周期覆盖
36 / 79 个生命周期已记录 · 20 个进入自动验证范围
官方模型资料

AI模型目录

浏览服务商资料中列出的准确模型ID;只有能可靠对应公开数据的版本才会进入榜单。

模型系列
13
官方版本
79
已有公开排名
0
待补可比数据
79
官方模型资料

官方模型ID

所有已收录版本都会显示;有排名的注明数据来源,暂无排名的说明原因。

13 个模型系列 · 79 个版本提交模型
部署方式
排名数据
13 / 13 个模型系列 · 79 个版本

已显示 2 / 13 个模型系列

01 · 7 个版本

GPT

覆盖面广的专有模型系列,拥有成熟的API与工具生态。

处理日常工作解决问题或编程使用最新信息或工具
官方资料

版本对比

已显示 3 / 7 个版本 · 2026 年 7 月核对

GPT · 版本对比
选择用于比较模型/版本更适合公开排名数据官方入口
gpt-5.6-sol最高能力
暂未排名本期暂未找到适用于这个具体版本的可比公开数据。
gpt-5.6-terra质量与成本平衡
暂未排名本期暂未找到适用于这个具体版本的可比公开数据。
gpt-5.6-luna速度与高并发
暂未排名本期暂未找到适用于这个具体版本的可比公开数据。

优势

适合通用、编程、视觉和工具型工作流。

局限

权重不开放,部署由服务商控制。

02 · 6 个版本

Claude

面向分析、写作、编程与长上下文任务的专有模型系列。

阅读、分析或写作阅读长文档解决问题或编程
官方资料

版本对比

已显示 3 / 6 个版本 · 2026 年 7 月核对

Claude · 版本对比
选择用于比较模型/版本更适合公开排名数据官方入口
claude-fable-5最高能力
暂未排名本期暂未找到适用于这个具体版本的可比公开数据。
claude-sonnet-5质量与成本平衡
暂未排名本期暂未找到适用于这个具体版本的可比公开数据。
claude-opus-4-8编程与智能体
暂未排名本期暂未找到适用于这个具体版本的可比公开数据。

优势

适合文档分析和连续的长篇内容工作。

局限

权重闭源,使用依赖API。

已显示 2 / 13 个模型系列
公开来源索引

完整来源模型索引

收录 2 个公开来源的全部 425 条记录,并归并为 419 个独立来源名称。收录不等于推荐;官方身份映射会单独标明。

425 / 419
公开记录
425
独立来源名称
419
已映射官方ID
0
身份未解析
419
公开来源
身份状态

已显示 12 / 419 个来源名称

LiveBench身份未解析
来源模型ID

Qwen 3.8 Flash Next

Alibaba

单次成功任务成本 · #3 · $0.0423开放权重 · #4 · 76.19
LiveBench身份未解析
来源模型ID

Qwen 3.8 Max

Alibaba

客观任务 · #7 · 78.46开放权重 · #2 · 78.46
LiveBench身份未解析
来源模型ID

Qwen3.8 27B

Alibaba

开放权重 · #6 · 75.27
LiveBench身份未解析
来源模型ID

Claude 5 Opus Thinking Max Effort

Anthropic

客观任务 · #4 · 80.08
LiveBench身份未解析
来源模型ID

Claude Fable 5 Max Effort

Anthropic

客观任务 · #1 · 82.97
LiveBench身份未解析
来源模型ID

DeepSeek V4 Flash 0731

DeepSeek

单次成功任务成本 · #6 · $0.0596开放权重 · #7 · 74.17
LiveBench身份未解析
来源模型ID

DeepSeek V4 Flash Vision Exp

DeepSeek

单次成功任务成本 · #5 · $0.0505
LiveBench身份未解析
来源模型ID

DeepSeek V4 Pro 0813

DeepSeek

单次成功任务成本 · #4 · $0.0442开放权重 · #3 · 77.44
LiveBench身份未解析
来源模型ID

Gemini 3.5 Flash-Lite High

Google

单次成功任务成本 · #9 · $0.0686
LiveBench身份未解析
来源模型ID

Gemini 3.7 Flash High

Google

客观任务 · #6 · 78.83
LiveBench身份未解析
来源模型ID

Muse Spark 1.2 xHigh Effort

Meta

客观任务 · #10 · 77.95
LiveBench身份未解析
来源模型ID

Minimax M3

Minimax

单次成功任务成本 · #7 · $0.0597
已显示 12 / 419 个来源名称