Token 成本是怎么算出来的?
算大模型 API 的账,其实只有两步。单次成本 = 输入 tokens × 输入单价 + 输出 tokens × 输出单价(单价一般按每百万 token 报价);再 × 每天调用次数 × 30,就是月度预算。这个工具替你把这两步算好,并把所有模型横着排一遍。
为什么要把输入、输出分开填?因为几乎所有厂商的输出价都比输入价贵,常见 2–4 倍 —— 生成比阅读更耗算力。于是同样是一万 token,「长输入短输出」(比如文档摘要)和「短输入长输出」(比如内容创作)的账单可能差好几倍。只盯着一个混合单价,很容易估歪。
一个客服机器人:每次输入约 800 token、输出约 200 token,每天 3 万次。假设某模型输入 ¥1、输出 ¥4(每百万 token)——
单次 =(800×1 + 200×4)÷ 100 万 = ¥0.0016;一个月 ≈ 0.0016 × 3 万 × 30 = ¥1,440。
换一个输出更便宜的模型,这笔月账常常能直接砍半 —— 这正是上面那张表帮你看清的事。
表里的国产模型(豆包 / 通义 / 文心 / Kimi 等)用的是各厂商官方人民币价,海外模型按实时汇率折算,¥ / $ 一键切换。想看每个模型的上下文窗口、能力标签和更多参数,去 大模型价格对比。