返回首页

CMCC-Token 计算器

把「计量 / 套餐 / CodingPlan」三种计费模式,统一折算成 元 每 百万Token,并与模型厂家直连报价横向对比,给一线一个能直接开口的比价口径。
自营+合作报价 48 个规格已录入 三通道 自营/合作/厂家直连 Token Plan 个人 11 档 + 团队版 2 档 CodingPlan 官方规则已录入 · 仅 MiniMax-M2.5

1用量输入

按 Token 用量计费:同一用量自动对比自营 / 合作 / 厂家直连三条通道,标出最省入口。支持夜间时段、缓存命中、分段长度、思考模式等特殊计价(见明细备注)。
%
命中部分按缓存价计费(若该模型支持)。

2模型单价明细

当前模型的计费单价(2026-09 官网核实价)。
项目单价(元/百万Token)
折算单价(元/百万Token)
¥0.00 / 1M

三通道对比:自营 / 合作 / 厂家直连

同一用量下,三条计费通道的成本差,自动标出最省通道。
渠道总费用元/百万Token差额

1套餐参数

移动云 Token Plan 分两套:个人版(算力豆 × 模型兑换率,面向个人开发者)与团队版(Token 额度池 × 模型抵扣系数,面向中大型企业、多 Key 额度管理)。核心变量都是利用率选对模型
实际消耗 = 包含 Token 额度 × 比例;月包耗尽后当期不可续用,需购次包或等次月刷新。
订阅须知:仅限编程工具(Claude Code、OpenClaw 等),严禁 API 调用;套餐为订阅人专享,账号共享可能导致权益受限;独立计费规格,不与 MoMA 免费tokens、按量、一次性资源包通用;生效期间不支持退订。

2算力豆换算

当前档位 × 当前模型的算力豆折算明细:豆数、兑换率、Token 额度、实耗与剩余。
换算项数值
实际摊薄单价(元/百万Token)
¥0.00 / 1M

利用率敏感度

同样一包,不同利用率下的真实单价。这张表是说服客户「按实际用量选档位」最直接的材料。
利用率实际消耗摊薄单价vs 名义价

套餐 vs 计量 平衡点

买包不如按量划算的临界用量在哪。
对比模型计量单价平衡点用量结论

1套餐档位

Coding Plan 按模型调用次数计费,不按 Token(2026-09 官方规则)。注意两个口径:一次提问 ≠ 一次调用——Agent 工具一次提问内部会发起 5~30+ 次模型调用;折算成百万 Token 的关键变量是单次调用的平均 Token 消耗——喂得越饱,单价越低。
单次请求 Token 模型
Token
Token
开发者感知的「一次提问」成本 = 单次调用成本 × 此倍数。
官方规则(2026-09):
  • 支持模型:仅 MiniMax-M2.5(抵扣系数 1,上下文 192K,每请求 1 次扣 1 次)——仅支持文本能力,不支持图片/多模态;服务资源有限,调用量大时易触发限流。更多模型需求建议用 Token Plan。
  • 额度刷新:每 5 小时限额按滑动窗口动态刷新;周限额每周一 00:00 重置;月限额每订阅月第 1 日 00:00 重置。周期内耗尽不可续用,需等下一周期自动恢复。
  • 提问消耗:单次提问按实际「模型调用次数 × 抵扣系数」扣减——简单任务约 5–10 次,复杂任务约 10–30+ 次,受任务难度、上下文及工具使用影响。
  • 有效期:按逻辑月计(01.31 13:00 购买 1 个月 → 02.28 13:00 到期)。
折算单价(元/百万Token)
¥0.00 / 1M
单次请求成本
¥0.00000
月度 Token 总量
0 百万
额度使用率
0 %
单次提问成本
¥0.000

单次 Token 敏感度(核心)

Coding Plan 最大的认知差:单次请求喂得越饱,单位 Token 成本越低。这是它跟计量/套餐模式的本质区别。
单次 Input月度总量元/百万Tokenvs 计量(M2.5混合)

三模式同场景对比

用当前 Coding Plan 的 Token 总量,反推走计量和套餐要花多少钱。对比模型固定为 MiniMax-M2.5(Coding Plan 仅支持该模型)。
模式月成本元/百万Tokenvs CodingPlan

1场景设定

设定一个统一的月度用量场景,把三种计费模式放在同一把尺子上量。这是给客户做方案选型时最有用的一张表。
Token

1选模型

同一模型放在同一把尺子上:官方 API 直连 / 官方 Token Plan / 移动计量 / 移动套餐(个人、团队),统一折算成「元/百万Token」。CodingPlan 按次计费、无法指定模型,不参与本页对比。仅收录移动在售模型。

2比价结果(综合价:输入×5 + 输出,÷6)

通道元/百万Tokenvs 官方API说明
口径说明:官方 API 直连按官网价原样呈现——无分时定价的注明"无分时"(如 MiniMax 永久五折价),有高峰/空闲分时的拆两行(DeepSeek),按上下文分档的逐档拆行(GLM-5.1);移动行 vs 官方取最低官方综合价为基准(保守口径)。套餐取满额名义口径(月包+次包全档与套餐页对齐;尝鲜包仅限 Auto 智能路由、无法指定模型,不参与单模型比价;实际按 85% 消耗会同比例上浮约 18%)。

3该系列在售模型总览

模型官方API移动计量个人套餐团队套餐移动最优 vs 官方

1模型单价表(修改后自动生效)

所有单价均可直接编辑。自营输入/输出价为移动云自营模式公示价(2026-09 录入,29 个规格)。 厂家输入/输出价按各厂家官网核实价录入(DeepSeek 2026-09 官网价已核:高峰价,空闲为 5 折,可另录空闲价 vi2/vo2),空白处待补充 —— 填入后「三方对比」页的厂家官网价对比表自动加行。 缓存命中、分时时段、分段长度、思考模式等特殊计价写入「备注」列,主计算按标准高峰价。
模型系列自营入自营出自营缓存合作入合作出合作缓存厂家入厂家出备注(夜间/分段/思考/显式缓存)

2套餐与 CodingPlan 参数

套餐档位与 Coding Plan 档位,同样可编辑。
个人 Token Plan 档位(算力豆)
档位价格(元)算力豆(个)类型
算力豆兑换率(1 豆 → Token)
模型兑换率(Token/豆)关联计量模型备注
Token Plan 团队版规格(额度池 + 抵扣系数)
规格价格(元/月)额度池(百万Token)Key 数
团队版抵扣系数(每消耗 M 个基础 Token 扣 M×N 额度)
模型抵扣系数 N关联计量模型备注
Coding Plan(按次模式)
档位月费(元)月请求数5小时限流周限流
全局参数
×
模型无官方缓存价时,缓存命中按 输入价×此系数 估算
CNY

3多模态模型参考价(非 Token 计费,不参与百万Token折算)

以下模型按秒 / 张 / 万字符计费,量纲与文本 Token 不同,硬折算会失真,单列参考。给客户报价时直接用原始单位。
视频与图片生成(合作通道,按秒/按张)
模型计费项单价
MiniMax-H3(海螺3)视频输入(768P)0.5 元/秒
视频输出(768P)0.5 元/秒
视频输入(2K)0.8 元/秒
视频输出(2K)0.8 元/秒
图片输入0.2 元/张
qwen-image-2.0-pro图片输出0.5 元/张
happyhorse-1.0-video-edit输入+输出(720P)0.9 元/秒
输入+输出(1080P)1.6 元/秒
happyhorse-1.1(r2v / i2v / t2v)输出(720P)0.9 元/秒
输出(1080P)1.2 元/秒
语音识别与合成(按秒/按万字符,输出均不计费)
模型计费单位输入单价
cosyvoice-v3.5-flash(语音合成)万字符0.8 元
qwen3-tts-flash(语音合成)万字符0.8 元
qwen3-asr-flash(识别)0.00022 元
qwen3-asr-flash-realtime(实时识别)0.00033 元
qwen-audio-3.0-asr-flash-streaming0.00033 元
fun-asr / fun-asr-flash-8k-realtime0.00022 元
fun-asr-realtime0.00033 元
全模态与实时翻译(Token 计费,但音视频差价大,单列参考)
模型输入输出
qwen3.5-omni-flash音频 18 / 文本图片视频 2.2文本 13.3 / 文本+音频 72
realtime 版:输入 27 / 3.3;输出 20 / 107
qwen3.5-omni-plus音频 53 / 文本图片视频 7文本 40 / 文本+音频 213
realtime 版:输入 80 / 10;输出 60 / 300
qwen3-livetranslate-flash音频 10 / 视频 4音频 40 / 文本 10
qwen3-livetranslate-flash-realtime音频 64 / 图片 8文本 64 / 音频 240
说明:以上均为元/百万Token 或标注单位(合作通道,2026-09 录入)。全模态模型输出价因输入模态不同差 3-10 倍,报价前必须先确认客户的输入输出模态构成。

数据来源与口径说明

已核实数据:
  • 自营 + 合作模式按量报价(2026-09-02 官方公示核实,已录入):主表 50+ 个规格,支持自营/合作/厂家三通道自动比价。特殊计价:夜间时段 00:00-08:00 仅按量模式(DeepSeek-V4-Flash)、缓存命中(V4-Flash-0731/GLM/Kimi)、输入长度分段(Qwen3.5/3-max/plus/flash、GLM-5.1)、思考模式差价(Qwen3-32B)、显式缓存(qwen3.x 商用系列)。GLM-5.3-Flash 合作 5 折限时价 2026-09-09 24:00 截止。
  • 渠道与口径说明(2026-09 核实):省移动渠道仅限本省政企账号订购、按量资费订购期 1 年,价格与移动云一致;移动云主账号可领 2500 万 Token 限时一个月免费体验(仅自营,Qwen3.5-35B-A3B 与机密模型除外,Qwen3.5-35B-A3B 需白名单订购);语音/视频/图像生成类模型(CosyVoice、SenseVoice、MiniMax-H3 海螺3、qwen-image、happyhorse 系列等)按字符/秒/张计费,不在本工具 Token 口径内。
  • Token Plan 个人版(2026-09 官方规则,已录入):月包 7 档 / 次包 3 档 / 尝鲜包,按算力豆折算,1 豆兑换 650~11000 Token(因模型而异)。仅限编程工具(Claude Code、OpenClaw 等),严禁 API 调用;独立计费,不与 MoMA 免费 tokens、按量、资源点通用;生效期间不支持退订。
  • TokenPlan 团队版(2026-09 官方规则,已录入):团队版 5000 元/月 · 55 亿 Token 额度池 · 50 Key;Lite 1000 元/月 · 10 亿 · 10 Key。按模型抵扣系数扣减(0.6~10):每消耗 M 个基础 Token,从额度池扣除 M×N 个;当月超额部分次月额度优先扣除;仅限 AI 编程工具,严禁 API 调用;生效期间不退订,支持到期退订。
  • Coding Plan(2026-09 官方规则,已录入):Lite 40元/月(每5小时约1200次 / 周9000次 / 月18000次);Pro 200元/月(6000 / 45000 / 90000,为 Lite 的 5 倍)。单次调用成本两档一致 ¥0.00222/次。仅支持 MiniMax-M2.5(抵扣系数 1、192K 上下文、仅文本);单次提问按实际调用次数扣减(简单 5–10 次、复杂 10–30+ 次);额度 5小时滑动窗口 / 周一 00:00 / 订阅月第1日 00:00 刷新;有效期按逻辑月;生效期间不退订退款,支持到期退订;严禁 API 调用,账号订阅人专享。
待补充确认的字段:
  • 厂家官网公开价持续补充 —— 已核实:DeepSeek-V4 系、GLM-5.1/5.2/5.3/5.3-Flash、qwen3.7-max/3-max(其余厂家/型号待官方页面开放抓取或截图补充)。
  • 政企客户是否有独立折扣体系。
  • 九天自研系列模型报价(本次表格未包含)。
把规则发我,我直接覆盖默认值,不用重做工具。