成本方法
Sakana Fugu 价格说明
Ultra 和 Cyber 可以根据公开固定费率估算;Fugu 不能被压成一个凭空捏造的平均价。正确做法是把能计算的算清,把会浮动的明确暴露,再用完整 usage 对象核对实际费用。
1. 从公开费率表开始
| 模型与上下文 | 输入 | 输出 | 缓存输入 |
|---|---|---|---|
| Fugu Ultra,不超过 272K context | $5.00 | $30.00 | $0.50 |
| Fugu Ultra,超过 272K context | $10.00 | $45.00 | $1.00 |
| Fugu Cyber,不超过 272K context | $6.00 | $36.00 | $0.60 |
| Fugu Cyber,超过 272K context | $12.00 | $54.00 | $1.20 |
Fugu Cyber 只支持按量计费,并需要获批访问。Ultra 同时出现在按量和订阅方案中。272K 门槛针对单次请求的 context,不是每月总 token。
很多短请求一个月可以累计数百万 token,但每次都仍在门槛以下。
2. 公式必须包含编排 token
Sakana AI 为 Ultra 和 Cyber 记录了额外 token 字段。编排输入、缓存输入和输出属于真实 usage,会按对应类别相同费率计费。
总输入 = 用户输入 + 编排输入
总输出 = 最终输出 + 编排输出
总缓存输入 = 用户缓存输入 + 编排缓存输入
估算费用 = 总输入 / 100 万 x 输入费率 + 总输出 / 100 万 x 输出费率 + 总缓存输入 / 100 万 x 缓存费率
建议同时保存原始数字和计算使用的费率版本。只存一个金额,未来价格改变或解释修正时就无法重新核对。
3. 完整计算示例
| 场景 | 计费 token 总量 | 估算 | 说明 |
|---|---|---|---|
| 小量 Ultra 月度使用 | 100 万输入、25 万输出、25 万缓存 | $12.63 | 轻量固定费率用量可能低于 $20 入门订阅价 |
| 可见任务相同,但有编排 | 300 万输入、75 万输出、75 万缓存 | $37.88 | 忽略编排会在本例中少算 $25.25 |
| Ultra 输出较重 | 200 万输入、200 万输出、无缓存 | $70.00 | 标准输出单价是输入的 6 倍,输出主导成本 |
| Ultra 长上下文 | 300 万输入、50 万输出、100 万缓存 | $53.50 | 高费率只能用于确实超过门槛的请求 |
| Cyber 标准上下文 | 100 万输入、25 万输出、25 万缓存 | $15.15 | 相同 token 组合下,Cyber 比 Ultra 高 20% |
| Cyber 长上下文 | 300 万输入、50 万输出、100 万缓存 | $64.20 | Cyber 只按量计费,不适用订阅对比 |
这些是算术演示,不是用量预测。多智能体 token 取决于任务、路由、工具调用与重试行为。
在计算器输入你的 usage4. 为什么本站不发布假的 Fugu 固定费率
官方对 Fugu 的计费规则取决于路由:
- 只有一个 agent 时,按具体底层模型标准费率计费。
- 多个 agent 时,费用不叠加,按参与模型中的最高档模型使用一种费率。
不知道实际 agent 和对应价格时,给一个数字只是制造假精确。可执行的预算办法是:先跑受控样本,导出实际 Fugu usage 与费用,再按任务类型统计中位数、90 分位和最差已观察成本。
把便宜常规路由和昂贵深度路由混成“每请求平均成本”,会掩盖工作负载变化。应按具名任务类型分别追踪。
5. 订阅价格清楚,但精确 token 等价物没有公开
| 方案 | 价格 | 官方定位 | 公开用量关系 |
|---|---|---|---|
| Standard | $20/月 | 轻量日常使用、偶发 API、小实验 | 基准额度 |
| Pro | $100/月 | 经常进行编程、审查、研究和分析 | Standard 的 10 倍 |
| Max | $200/月 | 长时间重负载 | Standard 的 20 倍 |
公开订阅层都包含 Fugu 与 Fugu Ultra。官方页面没有提供一个能干净映射全部编排路由的统一 token 数,所以计算器不能诚实地宣布通用“订阅回本点”。
只能做窄结论:如果固定费率按量估算低于 $20,它确实低于入门订阅价格;如果高于 $20,仍需结合 console 当前额度与服务优先级判断订阅是否覆盖工作负载。
官方页面称 2026 年 7 月 31 日前订阅可获第二个月免费。这是限时活动,不能当长期价格。
6. 用实际 usage 核对估算
- 保存原始 response usage 和请求关联 ID。
- 聚合前分开标准上下文与长上下文请求。
- 按类别相加用户 token 和编排 token。
- 应用请求日期对应的模型与上下文费率。
- 对照 console 费用,差异必须调查,不能藏掉。
外部价格数据获取失败时,保留最后核验费率及日期,明确提示可能过期,并链接到官方 console。悄悄回退到捏造值,比直接暴露限制更糟。
7. 常见价格错误
只计算最终输入与输出
会漏掉编排字段,让复杂运行看起来远比实际便宜。
把月度 token 当单次 context
272K 门槛关注每次请求的 context,不是月度总和。
捏造 Fugu 固定费率
它取决于实际路由或参与模型最高档,应使用真实样本。
直接宣布最便宜订阅胜出
价格本身无法证明额度、优先级和工作负载是否合适。
忘记重试也会花钱
若重试没有边界和日志,失败或断连可能重复触发昂贵任务。
永远使用上线促销
第二个月免费的活动有明确日期,不能写进长期成本模型。
第一方来源
- Sakana AI Pricing:费率、Fugu 计费规则、订阅层和活动日期
- Sakana AI Models:usage 字段定义和模型可用性
- Sakana AI Fugu 产品页:产品级价格与 FAQ
费率会变化。购买或生产部署前请重新检查官方 console。