Updated 2026-10-04

主流大语言模型
横向对比 Arena

Claude · GPT · Gemini · DeepSeek · Qwen · GLM · Kimi
一页纵览核心参数、定价、多模态与推理能力

11旗舰模型
7模型厂商
4开源模型
11支持推理

快速总览

七大厂商核心定位与差异化一览(2026 年 Q3/Q4 旗舰)

A

Anthropic Claude

Fable 5.1 为最强智能层旗舰,自适应推理永久开启。Opus 5.5 / Sonnet 5.5 覆盖企业到高性价比全场景。全系百万上下文。

O

OpenAI GPT

GPT-6 Astra 统一原生多模态架构,百万上下文。Sol 变体以 20% 成本匹敌旗舰性能,生态覆盖 Azure / Bedrock / Codex。

G

Google Gemini

Gemini 4 Argon 率先实现百万 Token 输出上限,视频理解 SOTA。3.8 Flash 以极致性价比覆盖四模态高吞吐场景。

D

DeepSeek

V4.1-Flash 采用全新 CED 架构 + Engram 记忆,552B MoE 仅激活 8B/16B 参数。性能超越 V4-Pro,价格全场最低。

Q

通义千问 Qwen

Qwen 3.8 Max 拥有 2.4T 参数(95B 激活),多步推理与 Agent 调用能力顶尖。Qwen 4 系列已在训练中。

Z

智谱 GLM

GLM-5.3 以 753B MoE 架构 MIT 开源,支持可调推理力度(low/high/max),Flash 变体覆盖图像视频多模态。

K

Kimi (月之暗面)

K3 以 2.8T 参数成为最大开源权重模型,专利注意力架构 KDA + AttnRes 实现线性扩展与超长文档记忆。

模型卡片

各旗舰模型核心参数与亮点速览

Claude Fable 5.1

Anthropic

🧠 推理
上下文1M
最大输出128K
输入 /M$10
输出 /M$50
文本图像
  • Anthropic 最强智能层旗舰
  • 自适应推理(Adaptive Thinking)永久开启
  • 面向科学研究与长程 Agent 自主执行

Claude Opus 5.5

Anthropic

🧠 推理
上下文1M
最大输出128K
输入 /M$4
输出 /M$20
文本图像
  • 企业级生产首选
  • 深度推理与编码的最佳平衡
  • 支持 Amazon Bedrock 与 Vertex AI

Claude Sonnet 5.5

Anthropic

🧠 推理
上下文1M
最大输出128K
输入 /M$2
输出 /M$10
文本图像
  • 性价比标杆,日常开发首选
  • 速度与智能的高效平衡
  • 百万上下文全覆盖

GPT-6 Astra

OpenAI

🧠 推理
上下文1.05M
最大输出128K
输入 /M$10
输出 /M$50
文本图像
  • 统一原生多模态架构
  • 前沿推理(科学/安全研究/计算机操控)
  • 百万级上下文窗口

GPT-6.1 Sol

OpenAI

🧠 推理
上下文1.05M
最大输出128K
输入 /M$2
输出 /M$10
文本图像
  • Astra 20% 成本即可匹敌性能
  • 高吞吐量生产级 Agent 管线
  • DeepSWE v1.1 基准匹敌旗舰

Gemini 4 Argon

Google DeepMind

🧠 推理🎨 多模态
上下文1M+
最大输出1M
输入 /M$2
输出 /M$10
文本图像音频视频
  • 输出上限突破 1M Token
  • LVBench 视频理解 91.7%
  • 自主漏洞发现与补丁生成

Gemini 3.8 Flash

Google DeepMind

🧠 推理🎨 多模态
上下文1M
最大输出128K
输入 /M$0.15
输出 /M$0.60
文本图像音频视频
  • 速度与成本之王(GA 已稳定)
  • 原生四模态支持
  • 支持思维预算控制

DeepSeek-V4.1-Flash

DeepSeek(深度求索)

🧠 推理🔓 开源
上下文1M
最大输出384K
输入 /M$0.15–0.30
输出 /M$0.60–1.20
架构规模552B MoE
文本图像
  • 552B MoE · CED 全新架构 · 8B/16B 激活
  • Engram 记忆架构近无损长文检索
  • 性能超越 V4-Pro,延迟大幅下降

Qwen 3.8 Max

阿里云(通义千问)

🧠 推理🔓 开源🎨 多模态
上下文1M
最大输出131K / 262K
输入 /M$2
输出 /M$6
架构规模2.4T MoE (95B active)
文本图像视频
  • 2.4T 参数 MoE(95B 激活)
  • 多步推理与 Agent 工具调用强势
  • 开放权重 · Qwen 4 已在训练中

GLM-5.3

智谱 AI (Z.ai)

🧠 推理🔓 开源
上下文1M
最大输出128K
输入 /M$1.40
输出 /M$4.40
架构规模753B MoE (40B active)
文本代码
  • 753B MoE(40B 激活)· MIT 开源
  • 可调推理力度(low/high/max)
  • Flash 变体支持图像/视频多模态

Kimi K3

月之暗面(Moonshot AI)

🧠 推理🔓 开源🎨 多模态
上下文1M
最大输出128K
输入 /M$3
输出 /M$15
架构规模2.8T
文本图像视频
  • 2.8T 参数 · 最大开源权重模型
  • KDA + AttnRes 专利注意力架构
  • 超长代码库理解与多 Agent 协作

完整参数对比

横向比较所有旗舰模型的核心维度

模型厂商发布上下文最大输出架构规模推理多模态开源输入 /M输出 /M
Claude Fable 5.1
Anthropic2026-091M128K—✅文本 / 图像—$10$50
Claude Opus 5.5
Anthropic2026-091M128K—✅文本 / 图像—$4$20
Claude Sonnet 5.5
Anthropic2026-091M128K—✅文本 / 图像—$2$10
GPT-6 Astra
OpenAI2026-091.05M128K—✅文本 / 图像—$10$50
GPT-6.1 Sol
OpenAI2026-101.05M128K—✅文本 / 图像—$2$10
Gemini 4 Argon
Google DeepMind2026-091M+1M—✅文本 / 图像 / 音频 / 视频—$2$10
Gemini 3.8 Flash
Google DeepMind2026-091M128K—✅文本 / 图像 / 音频 / 视频—$0.15$0.60
DeepSeek-V4.1-Flash
DeepSeek(深度求索)2026-091M384K552B MoE✅文本 / 图像✅$0.15–0.30$0.60–1.20
Qwen 3.8 Max
阿里云(通义千问)2026-081M131K / 262K2.4T MoE (95B active)✅文本 / 图像 / 视频✅$2$6
GLM-5.3
智谱 AI (Z.ai)2026-081M128K753B MoE (40B active)✅文本 / 代码✅$1.40$4.40
Kimi K3
月之暗面(Moonshot AI)2026-071M128K2.8T✅文本 / 图像 / 视频✅$3$15

📌 数据说明

  • 价格单位为美元,按每百万 Token 计费(DeepSeek 有峰谷时段差异价)。
  • 数据来源于各厂商官方文档与 API 定价页,截至 2026 年 10 月,可能随时间变化。
  • 「推理」指模型是否支持思维链(CoT)/ 自适应推理 / 深度推理模式。
  • 「最大输出」为单次请求的最大输出 Token 数。Gemini 4 Argon 突破百万输出上限。
  • 开源模型权重通常发布在 Hugging Face,协议以各厂商实际声明为准。