🤖 AI模型对比

全面对比主流大模型,benchmark、价格、能力一目了然

排序:
GPT
#1

GPT-4o

OpenAI

OpenAI旗舰多模态模型,文本、图像、音频全能处理,综合能力最强

编程
推理
创意
速度
闭源多模态
$0.005/1K tokens
Claude
#2

Claude 4

Anthropic

Anthropic最新模型,擅长长文本理解和复杂推理,安全性突出

编程
推理
创意
速度
闭源多模态
$0.003/1K tokens
o3
#3

o3

OpenAI

OpenAI推理模型,擅长复杂逻辑、数学和代码推理,推理能力顶尖

编程
推理
创意
速度
闭源多模态
付费
Gemini
#4

Gemini 2.5 Pro

Google

Google最强模型,100万token超长上下文,多模态能力顶尖

编程
推理
创意
速度
闭源多模态
$0.0025/1K tokens
DS
#5

DeepSeek V3

DeepSeek

国产开源大模型,性价比极高,代码能力媲美GPT-4

编程
推理
创意
速度
开源纯文本
免费/极低
Llama
#6

Llama 3.1

Meta

Meta开源模型,405B参数规模最大,可本地部署

编程
推理
创意
速度
开源纯文本
免费
Qwen
#7

Qwen 2.5

Alibaba

阿里通义千问,中文理解能力强,开源可商用

编程
推理
创意
速度
开源多模态
免费/低价
Grok
#8

Grok-3

xAI

xAI推出的多模态大模型,支持实时网络搜索,回答风格直接幽默

编程
推理
创意
速度
闭源多模态
付费
Groq
#9

Groq

Groq

Groq LPU推理芯片驱动,推理速度全球最快,延迟极低

编程
推理
创意
速度
闭源纯文本
$0.0005/1K tokens
Mixtral
#10

Mixtral 8x22B

Mistral AI

Mistral稀疏专家混合模型,176B参数规模,推理效率极高

编程
推理
创意
速度
开源纯文本
免费
Mistral
#11

Mistral Large 2

Mistral AI

欧洲最强AI模型,多语言能力优秀,推理能力强

编程
推理
创意
速度
闭源纯文本
$0.002/1K tokens
R+
#12

Command R+

Cohere

Cohere企业级模型,RAG检索增强能力突出,适合商业应用

编程
推理
创意
速度
闭源纯文本
$0.003/1K tokens
文心
#13

文心4.0

Baidu

百度文心大模型4.0,中文理解能力顶尖,知识增强技术突出

编程
推理
创意
速度
闭源多模态
免费版可用
GLM
#14

智谱GLM-4

Zhipu AI

智谱AI GLM-4,全自研通用大模型,代码和数学能力突出,开源可商用

编程
推理
创意
速度
开源多模态
免费版可用
Phi
#15

Phi-4

Microsoft

Microsoft小型高效模型,14B参数媲美70B模型,推理成本极低

编程
推理
创意
速度
开源纯文本
免费
Kimi
#16

Kimi K2

Moonshot AI

月之暗面长文本模型,200K上下文,文档处理能力突出

编程
推理
创意
速度
闭源多模态
免费版可用
星火
#17

讯飞星火4.0

iFlytek

科大讯飞星火认知大模型4.0,语音交互能力领先,多语种支持强

编程
推理
创意
速度
闭源多模态
免费版可用
Gemma
#18

Gemma 2

Google

Google开源模型,27B参数小体积高性能,适合端侧部署

编程
推理
创意
速度
开源纯文本
免费
MiniMax
#19

MiniMax

MiniMax

MiniMaxabab6.5,支持超长上下文,角色扮演和创意写作能力突出

编程
推理
创意
速度
闭源多模态
免费版可用
Step
#20

阶跃星辰

Stepfun

阶跃星辰Step-2,万亿参数大模型,多模态理解和推理能力优秀

编程
推理
创意
速度
闭源多模态
免费版可用

详细对比表

模型公司参数量上下文多模态开源价格基准测试
GPT
GPT-4o
OpenAI1.8T128K$0.005/1K tokens
MMLU88.7%
HumanEval90.2%
MATH76.6%
Claude
Claude 4
AnthropicUnknown200K$0.003/1K tokens
MMLU86.5%
HumanEval92.1%
MATH74.3%
o3
o3
OpenAIUnknown200K付费
MMLU89.5%
HumanEval93.2%
MATH82.1%
Gemini
Gemini 2.5 Pro
GoogleUnknown1M$0.0025/1K tokens
MMLU87.2%
HumanEval89.5%
MATH78.1%
DS
DeepSeek V3
DeepSeek671B64K免费/极低
MMLU85.2%
HumanEval91.8%
MATH75.9%
Llama
Llama 3.1
Meta405B128K免费
MMLU84.1%
HumanEval88.3%
MATH73.2%
Qwen
Qwen 2.5
Alibaba72B128K免费/低价
MMLU83.5%
HumanEval87.2%
MATH72.8%
Grok
Grok-3
xAIUnknown128K付费
MMLU85.8%
HumanEval89.5%
MATH76.3%
Groq
Groq
GroqVarious128K$0.0005/1K tokens
MMLU82.1%
HumanEval85.3%
MATH70.2%
Mixtral
Mixtral 8x22B
Mistral AI176B (8x22B)64K免费
MMLU83.8%
HumanEval87.2%
MATH72.5%
Mistral
Mistral Large 2
Mistral AI123B128K$0.002/1K tokens
MMLU82.8%
HumanEval86.5%
MATH71.4%
R+
Command R+
Cohere104B128K$0.003/1K tokens
MMLU83.2%
HumanEval86.8%
MATH71.5%
文心
文心4.0
BaiduUnknown8K免费版可用
MMLU80.5%
HumanEval84.2%
MATH69.8%
GLM
智谱GLM-4
Zhipu AIUnknown128K免费版可用
MMLU81.2%
HumanEval85.8%
MATH71.5%
Phi
Phi-4
Microsoft14B16K免费
MMLU81.5%
HumanEval86.2%
MATH70.8%
Kimi
Kimi K2
Moonshot AIUnknown200K免费版可用
MMLU81.5%
HumanEval85.2%
MATH70.8%
星火
讯飞星火4.0
iFlytekUnknown8K免费版可用
MMLU79.8%
HumanEval83.5%
MATH68.2%
Gemma
Gemma 2
Google27B8K免费
MMLU80.2%
HumanEval84.5%
MATH68.5%
MiniMax
MiniMax
MiniMaxUnknown200K免费版可用
MMLU78.5%
HumanEval82.3%
MATH67.8%
Step
阶跃星辰
StepfunUnknown200K免费版可用
MMLU77.8%
HumanEval81.5%
MATH66.2%

订阅 AI 商业实战周刊