计费与价格说明
计费与价格说明
在 puaai 里,用户最容易混淆的不是“能不能调用”,而是“余额、刀、倍率和真实扣费到底是什么关系”。这页把常见说法和实际阅读方法放在一起,方便你快速看懂价格。
先记住这三个判断
- 站内显示的余额、额度或“刀”,是站内结算单位,不等于实时外汇意义上的美元。
- 同一个模型在不同分组下价格可能不同,最常见原因就是分组倍率不同。
- 实际扣费通常会区分输入、补全、缓存读取、缓存创建、图片或音频等维度,而不是一个统一单价。
先分清你在看哪一层价格
Layer 01
充值汇率
先看充值时 1 元人民币能换多少站内额度。这决定你的站内余额是按什么比例生成的。
Layer 02
官方基准价
模型本身通常有官方输入、输出、缓存、图片或音频价格,这是计算的基准。
Layer 03
站内实际扣费
真正从余额里扣掉多少,要再叠加当前分组倍率和具体计费维度来看。
Layer 04
账单展示口径
有的页面显示每百万 tokens 价格,有的显示单次扣费或剩余额度,阅读时先确认单位。
常见说法怎么理解
| 说法 | 一般是什么意思 | 你该怎么理解 |
|---|---|---|
| 刀 | 站内常用的虚拟美元口径余额 | 通常是为了方便和官方美元定价对齐,不代表真实外汇结算 |
| 汇率 | 充值人民币换算成站内额度的比例 | 常见写法是 1 元 = 1 刀,活动时也可能出现 0.8 元 = 1 刀 |
| 分组 | Key 绑定的渠道或计费组 | 它会同时影响协议入口、模型可见性和扣费倍率 |
| 倍率 | 在官方基准价上再乘一次的系数 | 倍率越低,站内结算口径下通常越便宜 |
| 缓存读取 | 命中缓存后的读取成本 | 一般比完整输入便宜,但不是所有分组都会单独展示 |
| 缓存创建 | 首次写入缓存的成本 | 常见于带 prompt cache 的模型或站点展示口径 |
| 官转 / 官渠 | 更接近官方直连口径的渠道说法 | 一般用于描述能力体验和价格结构,实际仍以当前分组说明为准 |
| 逆向 | 不同于官方公开 API 的渠道说法 | 价格、稳定性和可用能力差异可能更大,需要单独看分组说明 |
看不懂“刀”时,先把它当成站内额度
社区里常说“跑了多少刀”,本质上是在说这次消耗了多少站内额度。它通常只是为了让用户更容易拿官方美元价格来对照,不是银行结汇意义上的真实美元。
价格通常是怎么计算的
可以先用一个足够实用的阅读公式来理解:
最终扣费 ≈ 官方基准价 × 当前分组倍率 × 对应维度用量如果某个模型把输入、补全、缓存读取、缓存创建分开计费,也可以理解成:
单次扣费 ≈
输入价格 × 输入 tokens
+ 补全价格 × 输出 tokens
+ 缓存读取价格 × 命中缓存 tokens
+ 缓存创建价格 × 新写入缓存 tokens上面这些“输入价格 / 补全价格 / 缓存读取价格 / 缓存创建价格”,本质上都是把官方基准价和你当前分组倍率折算之后得到的站内口径单价。
为什么同一个模型在不同分组价格不一样
最常见原因不是模型变了,而是分组变了。
- 分组本身可能对应不同渠道
- 不同分组会设置不同倍率
- 某些分组会把缓存、图片、音频等维度单独拉开
- 某些分组是订阅模式或专属模式,展示口径也会不同
更具体的分组含义见 。
一个好用的阅读顺序
- 先看充值页或套餐页,确认
1 元能换多少站内额度。 - 再看这把 Key 绑定到了哪个分组,以及这个分组的倍率。
- 最后再看模型或账单页,确认它是按输入、补全、缓存还是图片 / 音频维度展示。
这个顺序比只盯着一个“每刀多少钱”更接近真实使用成本。
两个例子
例子 1:先看充值汇率
如果站点当前规则是:
1 元人民币 = 1 刀那么充值 100 元,站内通常会得到 100 刀 额度。
如果活动规则变成:
0.8 元人民币 = 1 刀那么充值 100 元,站内通常会得到约 125 刀 额度。
这里变化的是充值换算比例,不是模型本身官方定价。
例子 2:再看分组倍率
假设某模型官方输入价格是:
3 刀 / 1M input tokens而你当前使用的分组倍率是 0.3x,那么在站内口径下,这个分组的输入成本大致可以理解为:
0.9 刀 / 1M input tokens如果你的充值活动恰好是 1 元 = 1 刀,那大致相当于 0.9 元 / 1M input tokens;如果是 0.8 元 = 1 刀,则等效人民币成本还会继续下降。
为什么有时会看到缓存计费
有些模型或渠道会区分:
- 完整输入
- 缓存读取
- 缓存创建
这意味着相同内容重复请求时,成本结构可能和第一次不同。很多用户看到“缓存命中”后会发现单次扣费明显下降,就是这个原因。
缓存不是所有分组都按同一种方式展示
有的分组会明确展示缓存读取和缓存创建价格,有的只展示最终折算后的单次扣费;也有社区里常说的“模拟缓存”口径。遇到这类分组时,优先以当前后台实际账单或分组说明为准。
看价格时最容易踩的坑
把“刀”直接当真实美元
不建议这样理解。对用户更有用的方式,是把“刀”当成站内余额单位,再结合当前充值汇率去换算。
只看模型官方价,不看分组倍率
官方价只是基准。你最终从余额里扣掉多少,通常还要看当前分组倍率。
只看一个统一单价,不看输入和补全拆分
很多模型输入和输出价格差异很大。只看总价,容易低估长输出场景的成本。
看到缓存就默认一定更便宜
缓存是否真正命中、命中后按什么口径计费,仍然要看当前分组和模型支持情况。
需要一个最稳的结论时,看哪里
实际扣费以当前页面展示为准
- 充值 / 套餐页:看人民币换站内额度的当前比例
- 分组页:看当前 Key 绑定到哪个分组,以及这个分组的倍率
- 模型或账单页:看输入、补全、缓存、图片、音频等具体计费维度
这页的作用是帮你理解“价格是怎么来的”,不是替代实时计费页。真正结算时,始终以你当前分组、当前模型和当前后台展示为准。
