阿里云百炼Token Plan的Credits可以理解为团队版订阅服务中的通用“积分”或“额度”,所有模型的调用消耗都统一用它来抵扣。
它的核心计算方式是动态的,单次请求消耗的Credits数量并不是固定的,而是由模型类型、处理的Token数量、以及是否开启某些功能(如联网搜索)等多种因素综合决定的。你可以在调用模型后查看账单来了解具体消耗。
阿里云百炼Token Plan 团队版:https://www.aliyun.com/benefit/scene/tokenplan?userCode=cb3vgkf5
百炼Token Plan概述帮助文档:https://help.aliyun.com/zh/model-studio/token-plan-overview?userCode=cb3vgkf5
💰 Credits的消耗机制与示例
为了让你更直观地理解,下面来拆解一下它的计算和消耗逻辑。
它是如何计算的?
单次请求消耗的Credits可以看作是以下几个部分的总和:
总消耗 Credits = (输入Token折算) + (输出Token折算) + (缓存Token折算) + (其他功能消耗)
不同模型、不同Token类型的折算比例都不一样。比如,输入和缓存Token的单价通常比输出Token更便宜。
💡 什么是Token?
Token是大模型处理文本的最小单位。1个Token可以是一个汉字、一个英文单词的一部分。粗略估算,1个汉字约等于1.5-2个Token。
一个具体的例子
根据官方文档,以 qwen3.6-plus 模型为例,一次包含了大量上下文(约5万Token)的请求,其Credits消耗估算如下:
| Token 类型 | 数量 | 消耗 Credits |
|---|---|---|
| 输入 tokens | 8,349 | 1.67 |
| 缓存 tokens | 40,794 | 1.63 |
| 输出 tokens | 573 | 0.69 |
| 合计 | – | 约 4 Credits |
从这个例子可以看出,虽然处理了接近5万的Token,但因为大量命中了成本更低的缓存Token,总的Credits消耗依然很低。
⚙️ Credits的消耗与补充规则
整个Credits的消耗和补充遵循一套清晰的逻辑:
抵扣顺序
-
优先消耗坐席额度:首先,系统会从你购买的坐席套餐(标准/高级/尊享)所包含的月度Credits里扣除。
-
再用共享用量包:只有当你的个人坐席额度用完后,系统才会开始扣除团队购买的“共享用量包”里的额度。
补充与恢复
-
额度用尽:当坐席额度和共享用量包的额度都耗尽时,服务会暂停,无法再调用模型。
-
恢复使用:有两种方式可以恢复服务:一是等待下个自然月,坐席额度会自动重置;二是立刻购买一个新的“共享用量包”。
共享用量包小贴士:它是一种弹性补充包,售价5000元,包含625,000 Credits。购买后有效期为1个月,优先抵扣快要过期的包,未用完的额度会清零。
CLOUD技术博