AI 模型横向对比

选择 2–4 个模型,横向对比 Agent Arena 性能、上下文窗口,以及各渠道最便宜的 API token 价格。

各厂当前可用 API 领先模型

每家厂商保留一个当前可购买的通用模型;官方明确指定旗舰时优先采用,否则按 Agent Arena 分数选择,没有可比分数时才按发布时间选择。点击模型加入横向对比,或查看同一模型的全部渠道价格。

厂商当前可用模型发布时间Agent 分数上下文窗口最便宜输入 / 1M最便宜输出 / 1M最低价渠道渠道比价
OpenAI2026年9月5日12.55%1.1MUS$0.88US$5.25XiuRouter对比 4 个渠道
Anthropic2026年9月2日14.51%1MUS$2.30US$11.50XiuRouter对比 4 个渠道
Gemini(Google)2026年9月2日4.01%1MUS$0.38US$1.88OpenRouter对比 4 个渠道
Grok / X.AI2026年7月8日3.93%500KUS$0.20US$0.60XiuRouter对比 3 个渠道
DeepSeek2026年8月12日4.43%1MUS$0.39US$0.78XiuRouter对比 6 个渠道
智谱 AI (ChatGLM)2026年6月17日4.64%1MUS$0.70US$2.20OpenRouter对比 5 个渠道
月之暗面 (Moonshot/Kimi)2026年7月16日6.59%128KUS$2.34US$11.70OpenRouter对比 5 个渠道
Qwen(阿里)2026年8月3日3.9%1M¥12.00¥36.00Qwen(阿里)对比 2 个渠道
Minimax2026年6月1日-5.26%1MUS$0.30US$1.20OpenRouter对比 5 个渠道
选择要对比的模型已选 2 / 4

可选择 2–4 个模型。选中第 5 个时会替换最早选中的那个。

Agent 分数
12.55%
上下文窗口
1.1M
最便宜输入 / 1M
US$0.88
最便宜输出 / 1M
US$5.25
Agent 分数
14.51%
上下文窗口
1M
最便宜输入 / 1M
US$2.30
最便宜输出 / 1M
US$11.50
AI 模型横向对比GPT 6 AstraClaude Fable 5.1
性能
Agent Arena 分数12.55%14.51%最强
GPQA DiamondArtificial Analysis current suite · Diamond · ACCURACY96.1%最强93.7%
Humanity's Last ExamArtificial Analysis current suite · Text only · ACCURACY54.7%59.1%最强
SciCodeArtificial Analysis current suite · Main · PASS_RATE56.5%63.1%最强
MMMU-ProArtificial Analysis current suite · Main · ACCURACY86.9%
上下文与限制
上下文窗口1.1M最大1M
API 价格(每百万 token)
最便宜输入US$0.88最便宜US$2.30
最便宜输出US$5.25最便宜US$11.50
对比官方-91%-77%
链接
查看全部渠道价格详情 详情
对比订阅套餐对比套餐 对比套餐

一目了然

当前所选模型中的各项优胜者。

GPT 6 Astra
上下文最大 价格最低
Claude Fable 5.1
评分最高

常见问题

哪款 AI 模型的 API 性价比最高?

取决于你的任务。对高并发、对延迟不敏感的场景,DeepSeek、通义千问等开源模型在聚合渠道上每百万 token 通常最便宜;Claude Opus、GPT 系列等前沿模型价格更高但在 Agent Arena 性能上领先。在本页横向对比各模型的最便宜渠道价格——比较时统一折算为美元,但展示时保留各渠道的原始货币。

不同渠道、不同货币的 API token 价格是怎么对比的?

每个渠道价格在取最小值前都会按缓存汇率换算成美元,因此 ¥3/1M 的人民币渠道会被正确地与 $0.78/1M 的美元渠道排序。以最便宜的输入价作为推荐渠道,并同时展示输出价和缓存输入价。“对比官方”一行显示该渠道相对模型厂商官方 API 便宜(或更贵)的百分比。

一次最多能对比几个模型?

可以同时对比 2 到 4 个模型。在搜索框中选择即可;也可以直接分享 URL——?models= 的 slug 列表会为打开链接的人预先选中同一组对比。