mofcloud

AI 大模型月账单计算器

填上你的调用量,立刻排出 172 个国产与海外模型按「月成本」从低到高的账单榜。不确定单次多少 token?先用 Token 成本计算器 粘文本估一下。

套用一个典型用量预设只预填 token 用量,不代表推荐用这个模型
缓存命中率60% 重复前缀走缓存价 · 仅对已公布缓存价的模型生效

各模型月账单排行 (按月成本升序)

# 输入 / 输出 / 1M VS 最省
使用指南

月账单是怎么算出来的?

月账单其实是两步乘法。单次成本 = 输入 tokens × 输入单价 + 输出 tokens × 输出单价(单价按每百万 token 报价);再 × 每天调用次数 × 30 天,就是月度账单。这个工具替你把所有模型算好、横着排一遍,最省的排最前。

为什么输入、输出要分开?几乎所有厂商输出价都比输入价贵,常见 2–4 倍。所以「长输入短输出」(文档摘要)和「短输入长输出」(内容创作)在同样的 token 数下,月账单可能差好几倍——只盯一个混合单价很容易估歪。缓存命中率则针对固定 system prompt、知识库这类重复前缀:命中部分按更便宜的缓存价计费。

举个例子

一个客服机器人:每次输入约 800 token、输出约 200 token,每天 3 万次。某模型输入 ¥1、输出 ¥4(每百万 token)——
单次 =(800×1 + 200×4)÷ 100 万 = ¥0.0016;一个月 ≈ 0.0016 × 3 万 × 30 = ¥1,440
换一个输出更便宜的模型,这笔月账常常能直接砍半——这正是上面这张榜帮你看清的事。

国产模型(豆包 / 通义 / 文心 / Kimi 等)用各厂商官方人民币价,海外模型按实时汇率折算,¥ / $ 一键切换。想看每个模型的上下文窗口、能力标签,去 大模型价格对比

常见问题

月成本是怎么算出来的?

单次成本(输入 tokens × 输入单价 + 输出 tokens × 输出单价)× 每天调用次数 × 30 天。缓存命中的输入部分按更便宜的缓存价计费。

为什么按 30 天算,而不是当月实际天数?

用固定 30 天是行业惯用的预算口径,方便横向比较不同月份。若要精确到当月天数,把结果按天数比例换算即可。

「缓存命中率」是什么?

很多模型对重复的输入前缀(固定 system prompt、知识库上下文)提供缓存价,通常远低于普通输入价。命中率越高,越省——但只有已公布缓存价的模型会受影响。

国产模型价格是人民币还是美元?

国产模型(豆包 / 文心 / 混元 / 星火 / Qwen 等)用官方人民币价;海外模型为美元价。页面可 ¥ / $ 切换,按最新汇率折算。

和 Token 成本计算器有什么区别?

Token 计算器侧重「粘文本估 token + 单次成本」;月账单计算器侧重「按调用量排月度账单榜」。两者数据同源、可互相跳转。