生成一次 AI 预测究竟要花多少钱
一次预测的模型算力成本是 US$0.01229,约合 一美分多一点,分摊在每次运行的 74 次模型调用上。即便如此,在 2.99 美元的月付方案上,刷卡手续费仍比整月的 AI 成本高出约 3.1 倍。一款廉价 AI 产品里最贵的部分,通常并不是 AI。
作者: Zinedine · 发布于 2026 年 8 月 26 日 · 更新于 2026-08-27
更正 — 2026 年 8 月 27 日
本页最初给出的数字是每次预测 US$0.000479,并称支付处理成本是 AI 的 81 倍。对当时的引擎而言那是准确的:那时一次预测只有一次模型调用。此后我们把它换成了真正的多智能体模拟——从你的场景中生成 24 位利益相关者,在 3 轮中相互反应——运行成本约为原来的 26 倍。下方的数字来自新引擎。 旧数字我们保留可见,而不是悄悄覆盖掉。
一次运行到底做了什么
一次预测不是一次模型调用,而是 74 次:一次调用从你的场景中生成 24 位各不相同的利益相关者;这些智能体在 3 轮中并行反应——共 72 次调用,每一轮都能看到上一轮的摘要,因此立场会发生变化;最后一次调用则根据他们产生的完整对话记录撰写报告。整个过程约需 29 秒。
正是这个结构决定了成本几乎不随场景长度变化:一次运行的形状是固定的,你付的是角色阵容和轮次的钱,而不是你写了多少字。
方法
这项测量直接导入生产环境的模拟引擎并跑完整场景,因此它走的是付费客户走的同一条代码路径,而不是复刻版本。成本按 OpenAI 自身返回的每次调用 token 计数逐项累加,采用 gpt-4o-mini 的公开定价:输入每百万 token 0.15 美元,输出每百万 token 0.60 美元。
每一次运行
| 运行 | 调用数 | 成本 |
|---|---|---|
| 场景 (中) | 74 | US$0.01328 |
| 场景 (短) | 74 | US$0.01159 |
| 场景 (中) | 74 | US$0.01200 |
| 平均 | 74 | US$0.01229 |
区间 US$0.01159 至 US$0.01328 · 每次运行约 29 秒
AI 依然不是花钱的大头
| 在一份 2.99 美元的月付方案上 | 成本 |
|---|---|
| 刷卡处理费 — Stripe 公开的美国费率 | US$0.387 |
| AI 算力 — 全部 10 次预测 | US$0.123 |
支付处理的花费仍约为整月 AI 用量的 3.1 倍——比旧引擎时代报告的 81 倍窄了很多,但结论一样。0.30 美元的固定手续费在 2.99 美元和 29.99 美元的方案上收得一模一样,这才是廉价订阅真正的约束。
支付处理这一栏采用 Stripe 公开的美国费率(2.9% + 0.30 美元),而不是我们实际结算的费率——后者随发卡国而变。国际卡更贵,因此这是一个保守下限。
这个数字不包含什么
这是生成一次预测的*边际*成本,不是经营一家公司的成本。未计入的有:服务器、数据库、事务性邮件、域名、失败与退款的支付、拒付、客服时间,以及构建和维护这一切的工程投入。其中大部分是固定成本或阶梯成本,并不会因为某个客户少跑几次预测而下降。
我们公开算力这个数字,是因为它恰恰是大家猜得最多、也错得最离谱的一个。把真实数字摆到台面上,会让任何关于 AI 定价的讨论——包括针对我们自己的——都更有质量。
常见问题
跑一次 AI 预测要花多少钱?
在 gpt-4o-mini 上对生产引擎完整运行 3 次实测,一次预测平均成本 US$0.01229,约合一美分多一点。单次运行会发出 74 次模型调用:一次从场景中生成 24 位利益相关者,3 轮中共 72 次智能体反应,以及一次根据对话记录撰写报告。
一款 2.99 美元的 AI 产品里最贵的是什么?
仍然不是 AI,尽管在我们把单次调用引擎换成真正的多智能体引擎后,差距已大幅收窄。在 2.99 美元的月付方案上,按 Stripe 公开的美国费率,刷卡处理约花费 US$0.387;而整月额度 10 次预测的算力成本是 US$0.123——支付处理约为 AI 成本的 3.1 倍。0.30 美元的固定手续费在 2.99 美元与 29.99 美元的方案上收费相同,这正是廉价订阅难做的原因。
场景写得更长、更详细会更贵吗?
比你以为的要小得多。成本主要由一次运行的固定形状决定——24 个智能体在 3 轮中反应——而不是你写了多少。在我们的实测中,区间为 US$0.01159 到 US$0.01328,而且最贵的那次并不是场景最长的那次。
既然算力只要一美分,MiroFish 为什么收 2.99 美元?
因为推理只是众多投入之一。之上还有支付处理、服务器、数据库、事务性邮件、域名、失败与退款的支付、客服,以及支撑这一切的工程;而且与算力不同,其中大多数并不会因为客户少跑几次预测而下降。按每次 US$0.01229 计算,若订阅者用完当月全部额度,算力约占 Starter 收入的 4.1%。我们把这个数字公开,是为了让这种比较可以摊开来做,而不是靠猜。
这是怎么测出来的?
直接导入生产环境的模拟引擎并跑完整场景,因此测量走的是付费客户走的同一条代码路径。成本按 OpenAI 自身返回的 token 计数,逐一累加一次运行中全部 74 次调用,采用公开定价:输入每百万 token 0.15 美元,输出每百万 token 0.60 美元。
这个数字为什么变了?
本页此前给出的是 US$0.000479,那是在一次预测只等于一次模型调用时测得的。此后我们换成了真正的多智能体引擎——24 位各不相同的利益相关者在 3 轮中反应——运行成本约高出 26 倍,产出的报告也明显更好。旧数字保留在上方可见,而不是被悄悄覆盖。
转载: 引用或制图使用这些数字时,请注明 MiroFish 并附上本页链接。模型价格和引擎设计都会变动——我们标注了测量日期,方便你判断它是否已经过时;更正会写在页面上,而不是悄悄改掉。另见 AI 预测产品的用户来自哪里.
看看 74 次模型调用究竟产出什么:一份完整的示例报告,在你付费之前。
查看示例报告