資料版本
2026-08 · 2026-08-30
自動驗證決策範圍
20 個自動驗證決策模型 / 79 個目錄模型
目前排名快照
2026-08-27 · 395 筆來源記錄
最新可比較變化版
2026-07-21 → 2026-08-27
生命週期覆蓋
36 / 79 個生命週期已記錄 · 20 個進入自動驗證範圍
官方模型資料

AI模型目錄

瀏覽服務商資料中列出的準確模型ID;只有能可靠對應公開資料的版本才會進入榜單。

模型系列
13
官方版本
79
已有公開排名
0
待補可比資料
79
官方模型資料

官方模型ID

所有已收錄版本都會顯示;有排名的註明資料來源,暫無排名的說明原因。

13 個模型系列 · 79 個版本提交模型
部署方式
排名資料
13 / 13 個模型系列 · 79 個版本

已顯示 2 / 13 個模型系列

01 · 7 個版本

GPT

涵蓋面廣的專有模型系列,具備成熟的API與工具生態。

處理日常工作解決問題或寫程式使用最新資訊或工具
官方資料

版本比較

已顯示 3 / 7 個版本 · 2026 年 7 月核對

GPT · 版本比較
選擇用於比較模型/版本較適合公開排名資料官方入口
gpt-5.6-sol最高能力
暫未排名本期暫未找到適用於這個具體版本的可比公開資料。
gpt-5.6-terra品質與成本平衡
暫未排名本期暫未找到適用於這個具體版本的可比公開資料。
gpt-5.6-luna速度與高流量
暫未排名本期暫未找到適用於這個具體版本的可比公開資料。

優勢

適合通用、程式設計、視覺和工具型流程。

限制

權重不開放,部署由服務商控制。

02 · 6 個版本

Claude

面向分析、寫作、程式設計與長上下文工作的專有模型系列。

閱讀、分析或寫作閱讀長文件解決問題或寫程式
官方資料

版本比較

已顯示 3 / 6 個版本 · 2026 年 7 月核對

Claude · 版本比較
選擇用於比較模型/版本較適合公開排名資料官方入口
claude-fable-5最高能力
暫未排名本期暫未找到適用於這個具體版本的可比公開資料。
claude-sonnet-5品質與成本平衡
暫未排名本期暫未找到適用於這個具體版本的可比公開資料。
claude-opus-4-8程式設計與代理
暫未排名本期暫未找到適用於這個具體版本的可比公開資料。

優勢

適合文件分析和持續的長篇內容工作。

限制

權重不公開,使用依賴API。

已顯示 2 / 13 個模型系列
公開來源索引

完整來源模型索引

收錄 2 個公開來源的全部 425 筆記錄,並整併為 419 個獨立來源名稱。收錄不等於推薦;官方身分對應會另外標示。

425 / 419
公開記錄
425
獨立來源名稱
419
已對應官方ID
0
身分未解析
419
公開來源
身分狀態

已顯示 12 / 419 個來源名稱

LiveBench身分未解析
來源模型ID

Qwen 3.8 Flash Next

Alibaba

單次成功工作成本 · #3 · $0.0423開放權重 · #4 · 76.19
LiveBench身分未解析
來源模型ID

Qwen 3.8 Max

Alibaba

客觀任務 · #7 · 78.46開放權重 · #2 · 78.46
LiveBench身分未解析
來源模型ID

Qwen3.8 27B

Alibaba

開放權重 · #6 · 75.27
LiveBench身分未解析
來源模型ID

Claude 5 Opus Thinking Max Effort

Anthropic

客觀任務 · #4 · 80.08
LiveBench身分未解析
來源模型ID

Claude Fable 5 Max Effort

Anthropic

客觀任務 · #1 · 82.97
LiveBench身分未解析
來源模型ID

DeepSeek V4 Flash 0731

DeepSeek

單次成功工作成本 · #6 · $0.0596開放權重 · #7 · 74.17
LiveBench身分未解析
來源模型ID

DeepSeek V4 Flash Vision Exp

DeepSeek

單次成功工作成本 · #5 · $0.0505
LiveBench身分未解析
來源模型ID

DeepSeek V4 Pro 0813

DeepSeek

單次成功工作成本 · #4 · $0.0442開放權重 · #3 · 77.44
LiveBench身分未解析
來源模型ID

Gemini 3.5 Flash-Lite High

Google

單次成功工作成本 · #9 · $0.0686
LiveBench身分未解析
來源模型ID

Gemini 3.7 Flash High

Google

客觀任務 · #6 · 78.83
LiveBench身分未解析
來源模型ID

Muse Spark 1.2 xHigh Effort

Meta

客觀任務 · #10 · 77.95
LiveBench身分未解析
來源模型ID

Minimax M3

Minimax

單次成功工作成本 · #7 · $0.0597
已顯示 12 / 419 個來源名稱