为什么同一个「最便宜」,换个场景答案就变了?
很多人挑大模型时只看一个「每百万 token 多少钱」的单价榜,但真实账单取决于你的输入和输出各有多长。同样一份价目表,长文档摘要(输入 8 万 token、输出很短)和复杂推理(输入短、输出上万)算出来的「最便宜」几乎是两拨模型。
这个工具替你把每个场景的典型 token 用量预设好,代入所有模型的官方输入价、输出价,再算单次成本排序。所以你不用自己填数字,直接选场景就能看到答案。
- 💰 性价比之选:满足该场景硬性要求(上下文、模态、能力)里单次成本最低的那个 —— 走量、跑批时看它。国内数据里这一档通常是国产模型。
- 🏁 国产旗舰:国产大厂顶配里满足要求最强的一个(DeepSeek / 通义 / GLM / Kimi 等)。中文与合规友好,效果优先时的国产之选。
- 🌐 海外旗舰:海外大厂顶配里满足要求最强的一个(GPT / Claude / Gemini 等)。业务指定海外大厂、或追求最强效果时看它。
想要更精确?每个场景的用量是「典型值」,你自己的 prompt 可能不同。把真实文本粘进 Token 成本计算器 能按你的实际长度精算;想看每个模型的完整参数,去 大模型价格对比。