计费说明
平台提供 TokenPlan 套餐体系,按 Token 用量计费,一份额度多模型混用,用多少算多少。
- TokenPlan 系列 · 按 Token 计费:一份额度多模型混用,按所选模型实际单价实时扣减 Token。
TokenPlan 系列
根据各模型官网 API 费用及生产环境实际输入输出比例(按 输入:输出 ≈ 200:1估算),各档位套餐每月预计可用 Token 量如下表所示:
| 套餐档位 | 价格 | GLM-5.1 输入 ¥6 / 输出 ¥24 | GLM-5.2 输入 ¥8 / 输出 ¥28 | DeepSeek-V4 Flash 输入 ¥1 / 输出 ¥2 |
|---|---|---|---|---|
| 入门版 | ¥199/月 | ≈ 3,270 万 | ≈ 2,460 万 | ≈ 1.98 亿 |
| 进阶版 | ¥399/月 | ≈ 6,550 万 | ≈ 4,930 万 | ≈ 3.97 亿 |
| 旗舰版 | ¥699/月 | ≈ 1.15 亿 | ≈ 8,630 万 | ≈ 6.96 亿 |
套餐计费规则说明
- 模型自由切换:一份套餐额度内支持多种模型混合使用,系统将按所选模型的实际单价实时扣减消耗。
- 缓存增益:实际调用若命中上下文缓存,用户的实际可用 Token 量将高于上表估算值。
- ⚠️ 停服机制:当月套餐额度消耗完毕后,系统将自动停止推理服务。
使用场景测算参考(以 Flash 档为例)
按单次 AI 交互消耗 2 万–5 万 Token 估算:
- 入门版(¥199):约可对话 4 千 – 1 万次,大致满足中小项目单月重度开发。
- 进阶版(¥399):约可对话 8 千 – 2 万次,大致满足多项目并行开发。
- 旗舰版(¥699):约可对话 1.4 万 – 3.5 万次,大致满足全天候重度开发或 Agent 自动化工作流。
CodingPlan 系列 · 按次数计费
CodingPlan 系列以「调用次数」为计费单位:在每个 5 小时窗口内限制请求次数,并设 7 天周期上限,适合按对话轮次预估用量的场景。
| 套餐 | 月费 | 可用模型 |
|---|---|---|
| CodingPlan-Lite | ¥39/月 | — |
| CodingPlan-Plus | ¥199/月 | glm-5 |
| CodingPlan-Max | ¥699/月 | glm-5, glm-5.1 |
工作原理
- 从你的第一次 API 请求开始,系统为你开启一个 5 小时的计费窗口
- 窗口结束后,请求次数计数器自动归零,新的窗口随之开启
- 当计数器达到窗口限额时,触发超额策略(控制调度)
示例
假设你使用 Lite 套餐(窗口限额 120 次),在 10:00 发送了第一个请求,系统为你开启一个 10:00-15:00 的计费窗口。在这个窗口内发送了 120 次请求后达到限额,达到限额之后禁止访问。15:00 时窗口结束,计数器归零,新窗口开启,你重新获得 120 次免费请求。
支持的模型
不同套餐可访问的模型范围不同,高级套餐可解锁更多高性能模型。
| 模型 | 提供商 | 特点 |
|---|---|---|
glm-5.1 | 智谱 AI | 最强开源,持续输出 |
glm-5.2 | 智谱 AI | 最强开源,持续输出 |
deepseek-v4-flash | 深度求索 | 深度推理,复杂规划 |
最后更新于
这篇文档对你有帮助吗?
