模型目录

模型

先选模型家族,再比较准确版本。

个家族
12
个版本
70
2026 年 7 月核对
模型目录

全部模型与版本

按模型、版本或任务搜索。

12 个家族 · 70 个版本
部署方式
12 / 12 个家族 · 70 个版本
01 · 3 个版本

GPT

覆盖面广的专有模型家族,拥有成熟的 API 与工具生态。

通用工作推理与编程工具与实时信息
官方资料

版本对比

3 个版本 · 2026 年 7 月核对

从这个家族开始
选择用于比较模型/版本更适合
gpt-5.6-sol最高能力
gpt-5.6-terra质量与成本平衡
gpt-5.6-luna速度与高并发

优势

适合通用、编程、视觉和工具型工作流。

局限

权重不开放,部署由服务商控制。

02 · 4 个版本

Claude

面向分析、写作、编程与长上下文任务的专有模型家族。

分析与写作长文档推理与编程
官方资料

版本对比

4 个版本 · 2026 年 7 月核对

从这个家族开始
选择用于比较模型/版本更适合
claude-fable-5最高能力
claude-sonnet-5质量与成本平衡
claude-opus-4-8编程与智能体
claude-haiku-4-5-20251001速度与高并发

优势

适合文档分析和连续的长篇内容工作。

局限

权重闭源,使用依赖 API。

03 · 6 个版本

Gemini

Google 面向文本、图像、音频、视频与工具流程的专有模型家族。

多模态通用工作工具与实时信息
官方资料

版本对比

6 个版本 · 2026 年 7 月核对

从这个家族开始
选择用于比较模型/版本更适合
gemini-3.5-flash最高能力
gemini-3.1-pro-preview预览深度推理
gemini-3.1-flash-lite速度与高并发
gemini-2.5-pro2026-10-16 停用较早稳定版本
gemini-2.5-flash2026-10-16 停用较早稳定版本
gemini-2.5-flash-lite2026-10-16 停用较早稳定版本

优势

提供覆盖多种输入类型的原生多模态选项。

局限

旗舰托管模型权重不开放。

04 · 3 个版本

Llama

面向自托管、定制与社区生态的开放权重模型家族。

本地定制通用工作
官方资料

版本对比

3 个版本 · 2026 年 7 月核对

从这个家族开始
选择用于比较模型/版本更适合
meta-llama/Llama-4-Maverick-17B-128E-Instruct大型开放模型
meta-llama/Llama-4-Scout-17B-16E-Instruct高效开放模型
meta-llama/Llama-3.3-70B-Instruct较早稳定版本

优势

对部署、数据路径和定制拥有更高控制力。

局限

生产部署需要硬件、安全与运维投入。

05 · 2 个版本

DeepSeek

偏重推理与编程,并提供 API 和部分开放权重版本的模型家族。

推理与编程分析与写作
官方资料

版本对比

2 个版本 · 2026 年 7 月核对

从这个家族开始
选择用于比较模型/版本更适合
deepseek-v4-pro预览最高能力
deepseek-v4-flash预览速度与高并发

优势

提供明确面向推理与编程的模型选项。

局限

模型名称和兼容别名可能较快变化。

06 · 12 个版本

Qwen

覆盖中文、多语言、编程与多模态,并提供 API 和开放部署选项的模型家族。

多语言推理与编程多模态
官方资料

版本对比

12 个版本 · 2026 年 7 月核对

从这个家族开始
选择用于比较模型/版本更适合
qwen3.7-max-2026-06-08最高能力
qwen3.7-plus-2026-05-26质量与成本平衡
qwen3.6-plus-2026-04-02较早稳定版本
qwen3-coder-plus-2025-09-23编程与智能体
Qwen/Qwen3-235B-A22B大型开放模型
Qwen/Qwen3-30B-A3B高效开放模型
Qwen/Qwen3-32B大型开放模型
Qwen/Qwen3-14B高效开放模型
Qwen/Qwen3-8B高效开放模型
Qwen/Qwen3-4B本地与设备端
Qwen/Qwen3-1.7B本地与设备端
Qwen/Qwen3-0.6B本地与设备端

优势

中文与多语言模型覆盖面较广。

局限

家族包含许多专用版本,不能视为完全等价。

07 · 6 个版本

Mistral

组合托管、开放权重、高效率、编程与专用模型的家族。

推理与编程本地定制
官方资料

版本对比

6 个版本 · 2026 年 7 月核对

从这个家族开始
选择用于比较模型/版本更适合
mistral-medium-3-5质量与成本平衡
mistral-small-2603速度与高并发
mistral-large-2512大型开放模型
ministral-14b-2512高效开放模型
ministral-8b-2512本地与设备端
ministral-3b-2512本地与设备端

优势

多种规模与部署路径便于按效率取舍。

局限

不能用单一 Mistral 模型代表整个家族。

08 · 5 个版本

Grok

xAI 面向推理、工具、多模态与实时数据流程的专有模型家族。

工具与实时信息通用工作
官方资料

版本对比

5 个版本 · 2026 年 7 月核对

从这个家族开始
选择用于比较模型/版本更适合
grok-4.5最高能力
grok-4.3质量与成本平衡
grok-4.20-0309-reasoning深度推理
grok-4.20-0309-non-reasoning速度与高并发
grok-build-0.1预览编程与智能体

优势

托管模型包含工具和实时信息路径。

局限

权重闭源,数据与工具接入由服务商控制。

09 · 8 个版本

Command

Cohere 面向企业 RAG、智能体、工具和多语言工作的生成模型家族。

企业 RAG工具与实时信息
官方资料

版本对比

8 个版本 · 2026 年 7 月核对

从这个家族开始
选择用于比较模型/版本更适合
command-a-plus-05-2026最高能力
command-a-03-2025企业与 RAG
command-a-reasoning-08-2025深度推理
command-a-vision-07-2025多模态任务
command-a-translate-08-2025翻译
command-r7b-12-2024速度与高并发
command-r-plus-08-2024较早稳定版本
command-r-08-2024较早稳定版本

优势

产品线明确围绕检索与企业工作流设计。

局限

RAG 效果高度依赖检索、文档与引用配置。

10 · 5 个版本

Gemma

Google 面向本地实验、定制和部分多模态任务的轻量开放模型家族。

本地定制多模态
官方资料

版本对比

5 个版本 · 2026 年 7 月核对

从这个家族开始
选择用于比较模型/版本更适合
google/gemma-4-E2B-it本地与设备端
google/gemma-4-E4B-it本地与设备端
google/gemma-4-12B-it高效开放模型
google/gemma-4-26B-A4B-it高效开放模型
google/gemma-4-31B-it大型开放模型

优势

可下载模型支持私有化和定制部署。

局限

较小体积通常以部分能力换取资源效率。

11 · 5 个版本

Phi

Microsoft 面向高效率本地、边缘与受限设备部署的小型开放模型家族。

本地定制推理与编程
官方资料

版本对比

5 个版本 · 2026 年 7 月核对

从这个家族开始
选择用于比较模型/版本更适合
microsoft/phi-4高效开放模型
microsoft/Phi-4-mini-instruct本地与设备端
microsoft/Phi-4-multimodal-instruct多模态任务
microsoft/Phi-4-reasoning深度推理
microsoft/Phi-4-mini-reasoning本地与设备端

优势

小体积适合设备端与低资源场景。

局限

紧凑体积会带来任务范围和容量取舍。

12 · 11 个版本

Kimi

Moonshot AI 面向长上下文、中文、推理与智能体流程的托管模型家族。

长文档多语言
官方资料

版本对比

11 个版本 · 2026 年 7 月核对

从这个家族开始
选择用于比较模型/版本更适合
kimi-k3最高能力
kimi-k2.7-code编程与智能体
kimi-k2.7-code-highspeed速度与高并发
kimi-k2.6多模态任务
kimi-k2.52026-08-31 停用较早稳定版本
moonshot-v1-8k2026-08-31 停用较早稳定版本
moonshot-v1-32k2026-08-31 停用较早稳定版本
moonshot-v1-128k2026-08-31 停用较早稳定版本
moonshot-v1-8k-vision-preview2026-08-31 停用多模态任务
moonshot-v1-32k-vision-preview2026-08-31 停用多模态任务
moonshot-v1-128k-vision-preview2026-08-31 停用多模态任务

优势

托管 API 强调长文档与中文使用场景。

局限

闭源托管方式限制部署控制力。