使用场景指南
最强能力的旗舰 LLM API
当任务确实需要某服务商提供的最大、最强模型 — 而非中间档位 — 以下是我们追踪的所有旗舰档位模型,按价格从低到高排列。
当一个任务确实需要某家厂商能力最强的模型——复杂推理、细腻的写作、棘手的边缘情况——价格就要让位于能力,但了解这个能力上限要花多少钱仍然值得。以下是各厂商自己定位为旗舰级别的模型,按输入价格从低到高排序。
ℹ️该列表的筛选方式: 筛选旗舰档位模型,按输入价格升序排列。
我们不针对特定任务的质量做基准测试 — 此列表仅基于核实价格和公开上下文窗口构建。用它按成本筛选候选模型,再自行评估输出质量。
常见问题
我们根据厂商自己在其产品线和定价页面中的定位,把模型分为旗舰、均衡或经济型——而不是根据我们自己做的跑分。
我们不测试模型能力,所以无法这么说。请把这份榜单当作旗舰级别的价格地图,而不是质量排名。
通常是因为答错了代价很高、事后难以发现或修正,或者任务涉及的情况经济型和均衡型模型更容易出错。如果出错成本低、可以轻松重试,更便宜的档位往往在经济上更划算。