六种计费单位
per_ten_thousand_characters 是为了对齐上游「元/万字符」的报价方式。若按单字符定价,费率会小到取整误差比费用本身还大。中文字符计 2、英文与数字计 1。算法
单位换算:1 积分 = ¥0.01,即积分 = 售价(元)× 100。token_split 的两次 ceil 是分别取整再相加,不是先求和再取整。短对话下这会让实际扣减略高于「按总量估算」的结果,最多多 1 积分。
3. 参数系数会再乘一层。 部分模型按参数档位(分辨率、质量等)配了系数,最终值是 ceil(基础值 × 系数)。多个系数连乘。
成本矩阵:覆盖上面全部公式
部分模型配了成本矩阵——按参数组合(分辨率 / 时长 / 质量 / token 区间)查表得出一个人民币成本,再套加价率:矩阵没命中任何规则时,本次不扣费。 这是刻意的 fail-open:宁可漏收,不可乱收。
没配价 = 不扣费
计算结果为 0 意味着「这个模型没有定价配置」,此时跳过扣减、不写消费记录。一个具体例子
一轮对话:输入 12,000 token、输出 3,000 token,模型输入费率 4、输出费率 16(单位:积分/百万 token)。怎么省
按任务选模型
简单问答用轻量模型,复杂推理再切高端。费率差距通常是数量级的。
控制上下文长度
长会话的每一轮都要重发历史。换个话题就开新对话,比精简措辞管用。
缩小检索范围
知识库检索、网页抓取的结果都要进上下文。指定平台、指定来源比全量搜省。
留意委托与多任务
每个委托都是一轮独立对话,成本叠加。详见多专家委托。
继续阅读
计费公式
完整算法与积分扣减顺序
积分系统
六种积分来源与过期规则
订阅套餐
套餐附赠积分与模型可见范围
限额表
平台各项硬限制

