Skip to main content
每个模型在定价目录里绑定一种计费单位。单位决定「按什么量计费」,费率决定「一个单位多少钱」。费率是随上游成本变动的运营数据,单位与算法是固定的——这一页讲的是后者。

六种计费单位

per_ten_thousand_characters 是为了对齐上游「元/万字符」的报价方式。若按单字符定价,费率会小到取整误差比费用本身还大。中文字符计 2、英文与数字计 1。

算法

单位换算:1 积分 = ¥0.01,即积分 = 售价(元)× 100。
三条贯穿所有单位的规则: 1. 最低 1 积分。 任何产生计费的操作,最终扣减都不低于 1 积分——不存在「算下来是 0.3 就不扣」这种情况。 2. token_split 的两次 ceil 是分别取整再相加,不是先求和再取整。短对话下这会让实际扣减略高于「按总量估算」的结果,最多多 1 积分。 3. 参数系数会再乘一层。 部分模型按参数档位(分辨率、质量等)配了系数,最终值是 ceil(基础值 × 系数)。多个系数连乘
拿不到输入/输出拆分时(少数上游不返回细分用量),会回落到混合费率:混合费率没配的话用 ceil((输入费率 + 输出费率) / 2) 顶上。所以同一个模型在不同上游行为下,估算可能有细微差异。

成本矩阵:覆盖上面全部公式

部分模型配了成本矩阵——按参数组合(分辨率 / 时长 / 质量 / token 区间)查表得出一个人民币成本,再套加价率:
矩阵一旦启用,上面的费率公式全部不走,直接走查表。这条路径会把命中的规则和参数快照记进消费记录,方便事后核对「为什么是这个价」。
矩阵没命中任何规则时,本次不扣费。 这是刻意的 fail-open:宁可漏收,不可乱收。

没配价 = 不扣费

计算结果为 0 意味着「这个模型没有定价配置」,此时跳过扣减、不写消费记录
不要把「这个模型现在不扣费」当成长期承诺。它更可能是定价还没配好,运营补上配置后就开始计费了。成本预期要以模型选择器里显示的当前费率为准。

一个具体例子

一轮对话:输入 12,000 token、输出 3,000 token,模型输入费率 4、输出费率 16(单位:积分/百万 token)。
注意这里两项都被向上取整到 1,实际扣 2 积分——而按总量粗算只有约 0.1 积分。短对话的成本主要由最低取整决定,不由 token 数决定。 反过来,长上下文对话里输入 token 常常是输出的十倍以上,此时成本几乎完全由输入侧驱动——这也是「适时开新对话」比「少说几句」有效得多的原因。

怎么省

按任务选模型

简单问答用轻量模型,复杂推理再切高端。费率差距通常是数量级的。

控制上下文长度

长会话的每一轮都要重发历史。换个话题就开新对话,比精简措辞管用。

缩小检索范围

知识库检索、网页抓取的结果都要进上下文。指定平台、指定来源比全量搜省。

留意委托与多任务

每个委托都是一轮独立对话,成本叠加。详见多专家委托

继续阅读

计费公式

完整算法与积分扣减顺序

积分系统

六种积分来源与过期规则

订阅套餐

套餐附赠积分与模型可见范围

限额表

平台各项硬限制