九章智算云
计费说明

平台提供 TokenPlan 套餐体系,按 Token 用量计费,一份额度多模型混用,用多少算多少。

  • TokenPlan 系列 · 按 Token 计费:一份额度多模型混用,按所选模型实际单价实时扣减 Token。

TokenPlan 系列

根据各模型官网 API 费用及生产环境实际输入输出比例(按 输入:输出 ≈ 200:1估算),各档位套餐每月预计可用 Token 量如下表所示:

套餐档位价格GLM-5.1
输入 ¥6 / 输出 ¥24
GLM-5.2
输入 ¥8 / 输出 ¥28
DeepSeek-V4 Flash
输入 ¥1 / 输出 ¥2
入门版¥199/月≈ 3,270 万≈ 2,460 万≈ 1.98 亿
进阶版¥399/月≈ 6,550 万≈ 4,930 万≈ 3.97 亿
旗舰版¥699/月≈ 1.15 亿≈ 8,630 万≈ 6.96 亿

套餐计费规则说明

  • 模型自由切换:一份套餐额度内支持多种模型混合使用,系统将按所选模型的实际单价实时扣减消耗。
  • 缓存增益:实际调用若命中上下文缓存,用户的实际可用 Token 量将高于上表估算值。
  • ⚠️ 停服机制:当月套餐额度消耗完毕后,系统将自动停止推理服务。

使用场景测算参考(以 Flash 档为例)

按单次 AI 交互消耗 2 万–5 万 Token 估算:

  • 入门版(¥199):约可对话 4 千 – 1 万次,大致满足中小项目单月重度开发。
  • 进阶版(¥399):约可对话 8 千 – 2 万次,大致满足多项目并行开发。
  • 旗舰版(¥699):约可对话 1.4 万 – 3.5 万次,大致满足全天候重度开发或 Agent 自动化工作流。

CodingPlan 系列 · 按次数计费

CodingPlan 系列以「调用次数」为计费单位:在每个 5 小时窗口内限制请求次数,并设 7 天周期上限,适合按对话轮次预估用量的场景。

套餐月费可用模型
CodingPlan-Lite¥39/月
CodingPlan-Plus¥199/月glm-5
CodingPlan-Max¥699/月glm-5, glm-5.1

工作原理

  • 从你的第一次 API 请求开始,系统为你开启一个 5 小时的计费窗口
  • 窗口结束后,请求次数计数器自动归零,新的窗口随之开启
  • 当计数器达到窗口限额时,触发超额策略(控制调度)

示例

假设你使用 Lite 套餐(窗口限额 120 次),在 10:00 发送了第一个请求,系统为你开启一个 10:00-15:00 的计费窗口。在这个窗口内发送了 120 次请求后达到限额,达到限额之后禁止访问。15:00 时窗口结束,计数器归零,新窗口开启,你重新获得 120 次免费请求。

支持的模型

不同套餐可访问的模型范围不同,高级套餐可解锁更多高性能模型。

模型提供商特点
glm-5.1智谱 AI最强开源,持续输出
glm-5.2智谱 AI最强开源,持续输出
deepseek-v4-flash深度求索深度推理,复杂规划

最后更新于

这篇文档对你有帮助吗?

目录