计费与缓存
了解输入、输出和缓存读取的人民币计费方式。
野生流动前台使用人民币展示模型价格。文本模型按照输入 Token、输出 Token和缓存读取 Token 分别 计费,价格单位均为每 100 万 Token。
计费项目
- 输入 Token:发送给模型的 system、user、历史 assistant 消息等输入内容;
- 输出 Token:模型生成的内容;
- 缓存读取 Token:命中上游上下文缓存并按缓存读取价格计算的输入部分。
缓存是否命中由实际请求和模型服务决定,不保证每次重复请求都会产生缓存 Token。控制台用量日志会 记录本次请求使用的模型、Token 数和扣费结果,是单次账单的查询入口。
当前价格
| 模型系列 | 输入 | 输出 | 缓存读取 |
|---|---|---|---|
| V4 Pro | ¥4.50 | ¥13.50 | ¥0.15 |
| V4 Flash | ¥1.50 | ¥4.50 | ¥0.05 |
完整模型名与版本请查看模型目录。如果请求被明确拒绝且没有产生模型用量,不应把一次 HTTP 错误简单理解为已经完成正常计费;最终以控制台消费日志和余额记录为准。