AI 模型横向对比
选择 2–4 个模型,横向对比 Agent Arena 性能、上下文窗口,以及各渠道最便宜的 API token 价格。
选择要对比的模型已选 2 / 4
可选择 2–4 个模型。选中第 5 个时会替换最早选中的那个。
| AI 模型横向对比 | gemini-2.5-flash-(batch) | gpt-5.6-sol |
|---|---|---|
| 性能 | ||
| Agent Arena 分数 | — | 9.81%最强 |
| 上下文与限制 | ||
| 上下文窗口 | 1M | 1.1M最大 |
| API 价格(每百万 token) | ||
| 最便宜输入 | US$0.15最便宜 | US$2.00 |
| 最便宜输出 | US$1.25最便宜 | US$10.00 |
| 对比官方 | 暂无官方渠道 | -50% |
| 链接 | ||
| 查看全部渠道价格 | 详情 | 详情 |
| 对比订阅套餐 | 对比套餐 | 对比套餐 |
一目了然
当前所选模型中的各项优胜者。
gemini-2.5-flash-(batch)
价格最低
gpt-5.6-sol
评分最高 上下文最大
常见问题
哪款 AI 模型的 API 性价比最高?
取决于你的任务。对高并发、对延迟不敏感的场景,DeepSeek、通义千问等开源模型在聚合渠道上每百万 token 通常最便宜;Claude Opus、GPT 系列等前沿模型价格更高但在 Agent Arena 性能上领先。在本页横向对比各模型的最便宜渠道价格——比较时统一折算为美元,但展示时保留各渠道的原始货币。
不同渠道、不同货币的 API token 价格是怎么对比的?
每个渠道价格在取最小值前都会按缓存汇率换算成美元,因此 ¥3/1M 的人民币渠道会被正确地与 $0.78/1M 的美元渠道排序。以最便宜的输入价作为推荐渠道,并同时展示输出价和缓存输入价。“对比官方”一行显示该渠道相对模型厂商官方 API 便宜(或更贵)的百分比。
一次最多能对比几个模型?
可以同时对比 2 到 4 个模型。在搜索框中选择即可;也可以直接分享 URL——?models= 的 slug 列表会为打开链接的人预先选中同一组对比。
