Appearance
计费与额度
DouDi 的费用理解可以拆成三层:账户额度、模型消耗、分组影响。
额度是什么
控制台里通常会用 quota 或余额来展示可用额度。你可以先把它理解成账户里的可用余额:调用模型会消耗它,充值或套餐会增加它。
你在控制台里看到的余额、套餐额度或兑换额度,最终都会在调用模型时被扣减。不同模型、不同分组、不同输入输出长度都会影响扣减速度。
文本模型的常见消耗逻辑
文本模型通常按 token 或等价用量计费。可以先用这个简化公式理解:
text
最终消耗 ≈ token 数量 × 模型倍率 × 分组倍率 × 输出/缓存等修正系数其中:
- 输入 token:你发给模型的消息、系统提示词、上下文。
- 输出 token:模型生成的回复,通常比输入更贵或有单独倍率。
- 模型倍率:不同模型本身消耗不同。
- 分组倍率:线路、渠道、稳定性或客户端适配造成的消耗差异。
- 缓存倍率:部分 Claude 或长上下文场景会涉及缓存读取、缓存创建等额外规则。
固定消耗模型
图片、视频或某些任务型模型可能不是按 token 计费,而是按请求、秒数或任务计费。控制台里这类模型可能会显示类似:
text
0.06 / request这表示每次请求按固定额度扣减,具体是否还受分辨率、质量、时长影响,需要以控制台显示和模型说明为准。
分组怎么影响消耗
分组不是单纯的分类标签,它可能影响:
- 最终倍率。
- 请求走哪类渠道。
- 是否适合 Claude Code、Codex CLI、生图视频等特定客户端。
- 是否允许某些高风险或特殊用途。
- 稳定性、延迟和失败切换策略。
新手建议优先使用 auto。当你明确知道自己要用某个客户端或某条线路时,再创建单独 Key 并绑定具体分组。
控制成本的建议
- 先用低倍率模型测试流程。
- 给测试 Key 设置额度上限。
- 批量任务先小样本运行,确认结果和消耗后再放大。
- 长文本任务注意上下文长度,没必要的历史消息要清理。
- 图片和视频任务先看固定消耗,再确认分辨率和质量参数。
- 多客户端分开 Key,方便定位哪个工具消耗最多。
额度异常排查
| 现象 | 可能原因 |
|---|---|
| 消耗比预期高 | 使用了高倍率模型或高倍率分组 |
| 一次请求扣很多 | 上下文太长,或输出特别长 |
| 图片任务扣费明显 | 固定消耗按次计费,可能还受规格影响 |
| 明明没用却有消耗 | 某个客户端在后台重试或自动同步 |
| 请求失败也有记录 | 客户端或网关可能发生了重试,请查看日志 |
