使用场景指南

最强能力的旗舰 LLM API

当任务确实需要某服务商提供的最大、最强模型 — 而非中间档位 — 以下是我们追踪的所有旗舰档位模型,按价格从低到高排列。

当一个任务确实需要某家厂商能力最强的模型——复杂推理、细腻的写作、棘手的边缘情况——价格就要让位于能力,但了解这个能力上限要花多少钱仍然值得。以下是各厂商自己定位为旗舰级别的模型,按输入价格从低到高排序。

ℹ️该列表的筛选方式: 筛选旗舰档位模型,按输入价格升序排列。
5 个模型
模型 服务商 输入 /百万 输出 /百万 上下文
Google $2.00 $12.00 ≤20万 tokens 档位
xAI $2.00 $6.00 50万 tokens
Anthropic $5.00 $25.00 100万 tokens
Anthropic $10.00 $50.00 100万 tokens
OpenAI $10.00 $50.00 约105万 tokens

我们不针对特定任务的质量做基准测试 — 此列表仅基于核实价格和公开上下文窗口构建。用它按成本筛选候选模型,再自行评估输出质量。

查看所有使用场景 →

常见问题

我们根据厂商自己在其产品线和定价页面中的定位,把模型分为旗舰、均衡或经济型——而不是根据我们自己做的跑分。

我们不测试模型能力,所以无法这么说。请把这份榜单当作旗舰级别的价格地图,而不是质量排名。

通常是因为答错了代价很高、事后难以发现或修正,或者任务涉及的情况经济型和均衡型模型更容易出错。如果出错成本低、可以轻松重试,更便宜的档位往往在经济上更划算。