AI 模型横向对比
选择 2–4 个模型,横向对比 Agent Arena 性能、上下文窗口,以及各渠道最便宜的 API token 价格。
各厂当前可用 API 领先模型
每家厂商保留一个当前可购买的通用模型;官方明确指定旗舰时优先采用,否则按 Agent Arena 分数选择,没有可比分数时才按发布时间选择。点击模型加入横向对比,或查看同一模型的全部渠道价格。
| 厂商 | 当前可用模型 | 发布时间 | Agent 分数 | 上下文窗口 | 最便宜输入 / 1M | 最便宜输出 / 1M | 最低价渠道 | 渠道比价 |
|---|---|---|---|---|---|---|---|---|
| OpenAI | 2026年9月5日 | 12.55% | 1.1M | US$0.88 | US$5.25 | XiuRouter | 对比 4 个渠道 | |
| Anthropic | 2026年9月2日 | 14.51% | 1M | US$2.30 | US$11.50 | XiuRouter | 对比 4 个渠道 | |
| Gemini(Google) | 2026年9月2日 | 4.01% | 1M | US$0.38 | US$1.88 | OpenRouter | 对比 4 个渠道 | |
| Grok / X.AI | 2026年7月8日 | 3.93% | 500K | US$0.20 | US$0.60 | XiuRouter | 对比 3 个渠道 | |
| DeepSeek | 2026年8月12日 | 4.43% | 1M | US$0.39 | US$0.78 | XiuRouter | 对比 6 个渠道 | |
| 智谱 AI (ChatGLM) | 2026年6月17日 | 4.64% | 1M | US$0.70 | US$2.20 | OpenRouter | 对比 5 个渠道 | |
| 月之暗面 (Moonshot/Kimi) | 2026年7月16日 | 6.59% | 128K | US$2.34 | US$11.70 | OpenRouter | 对比 5 个渠道 | |
| Qwen(阿里) | 2026年8月3日 | 3.9% | 1M | ¥12.00 | ¥36.00 | Qwen(阿里) | 对比 2 个渠道 | |
| Minimax | 2026年6月1日 | -5.26% | 1M | US$0.30 | US$1.20 | OpenRouter | 对比 5 个渠道 |
选择要对比的模型已选 2 / 4
可选择 2–4 个模型。选中第 5 个时会替换最早选中的那个。
| AI 模型横向对比 | GPT 6 Astra | Claude Fable 5.1 |
|---|---|---|
| 性能 | ||
| Agent Arena 分数 | 12.55% | 14.51%最强 |
| GPQA DiamondArtificial Analysis current suite · Diamond · ACCURACY | 96.1%最强 | 93.7% |
| Humanity's Last ExamArtificial Analysis current suite · Text only · ACCURACY | 54.7% | 59.1%最强 |
| SciCodeArtificial Analysis current suite · Main · PASS_RATE | 56.5% | 63.1%最强 |
| MMMU-ProArtificial Analysis current suite · Main · ACCURACY | 86.9% | — |
| 上下文与限制 | ||
| 上下文窗口 | 1.1M最大 | 1M |
| API 价格(每百万 token) | ||
| 最便宜输入 | US$0.88最便宜 | US$2.30 |
| 最便宜输出 | US$5.25最便宜 | US$11.50 |
| 对比官方 | -91% | -77% |
| 链接 | ||
| 查看全部渠道价格 | 详情 | 详情 |
| 对比订阅套餐 | 对比套餐 | 对比套餐 |
一目了然
当前所选模型中的各项优胜者。
GPT 6 Astra
上下文最大 价格最低
Claude Fable 5.1
评分最高
常见问题
哪款 AI 模型的 API 性价比最高?
取决于你的任务。对高并发、对延迟不敏感的场景,DeepSeek、通义千问等开源模型在聚合渠道上每百万 token 通常最便宜;Claude Opus、GPT 系列等前沿模型价格更高但在 Agent Arena 性能上领先。在本页横向对比各模型的最便宜渠道价格——比较时统一折算为美元,但展示时保留各渠道的原始货币。
不同渠道、不同货币的 API token 价格是怎么对比的?
每个渠道价格在取最小值前都会按缓存汇率换算成美元,因此 ¥3/1M 的人民币渠道会被正确地与 $0.78/1M 的美元渠道排序。以最便宜的输入价作为推荐渠道,并同时展示输出价和缓存输入价。“对比官方”一行显示该渠道相对模型厂商官方 API 便宜(或更贵)的百分比。
一次最多能对比几个模型?
可以同时对比 2 到 4 个模型。在搜索框中选择即可;也可以直接分享 URL——?models= 的 slug 列表会为打开链接的人预先选中同一组对比。
