国产 Coding Plan 怎么选:方舟、MiniMax、智谱 GLM 与小米 MiMo 横向对比
posts posts 2026-06-21T14:06:11+08:00从九块九到上千元,月费上百倍的跨度,买错比买贵更常见。四套方案不在同一维度竞争,比价之前先统一口径,再用一次跨文件重构推演各家算法,最后拿一周数据决策。思考与随笔Coding Plan, MiniMax, GLM, MiMo, 方舟, TRAE上周帮朋友算账:他花 538 元订了 GLM Pro,实际只用代码、不用 MCP,方舟同样接入 GLM-5.3,Lite 档限时 9.9 就够了,差了 50 倍。这不是砍价能解决的事——两家卖的根本不是同一种东西。
从九块九的限时套餐到上千元的顶配,月费差了上百倍。挑最便宜的,最容易买错——买错类型,比买贵更常见。
方舟卖多模型入口,GLM 卖单一模型配额,MiniMax 和 MiMo 把代码、多模态打包在一起。DeepSeek 是按量 API,WorkBuddy 和 TRAE Work 做的是办公平台,不在 Coding Plan 这一层。
信息快照:套餐与价格已按 2026 年 9 月 7 日口径更新,关键数字对照各家官方文档核过。主要变动——智谱 GLM Coding Plan 于 7 月 30 日改版,涨价并转为积分制;GLM-5.3 于 8 月 14 日上线并接入 Coding Plan,GLM-5.2/5.1 请求自动路由到 5.3;Kimi 于 7 月 20 日发公告,因算力限制暂缓新用户订阅;MiniMax 音乐生成接口自 8 月 20 日起停止向新用户开放。 价格、模型名单、限额和活动都会调整,下单前以官方页面为准。文中部分入口带邀请码,新用户注册能拿积分或优惠,笔者也会获得一点邀请奖励,但不影响比较结论。
先给结论
四套 Coding Plan 怎么选
| 你的工作方式 | 优先考虑 | 原因 |
|---|---|---|
| 经常在 Doubao、GLM、DeepSeek、Kimi、MiniMax 之间切换 | 方舟 Coding Plan | 一个订阅覆盖多个模型,支持手动切换和 Auto 调度 |
| 已确认 GLM 是主力,代码任务占绝大多数 | GLM Coding Plan | 额度和 MCP 权益都围绕 GLM 编程链路设计 |
| 编程之外还要生成图片、语音或视频 | MiniMax Token Plan | 文本、代码和媒体生成共用一套额度 |
| 想用 MiMo,并需要全模态、语音或 MiMo Claw | Xiaomi MiMo Token Plan | 四档订阅覆盖 MiMo 模型、主流编程工具与可选 Claw |
不是 Coding Plan 但值得知道的三个方案
这三家卖的不是"编程配额",是另外一层东西。
| 你的工作方式 | 优先考虑 | 原因 |
|---|---|---|
| 用量很低,或要把模型接进线上服务 | DeepSeek API 等按量方案 | 按 Token 付费,低频不背月费,也更符合生产调用 |
| 主要交付文档、PPT、数据分析,依赖腾讯办公生态 | WorkBuddy | 办公任务编排平台,不是 Coding 配额 |
| 各类办公杂事想整包交给 Agent | TRAE Work | AI 办公平台,试错成本几乎为零 |
拿不准的,先别买年费。花一周记下模型调用、峰值时段、长任务数量和多模态用量,数据会替你选。
四套方案到底差在哪
| 方案 | 模型 × 能力 | 计量与窗口 | 起步价 | 适合谁 |
|---|---|---|---|---|
| 方舟 Coding Plan | 多模型入口 / 纯代码 | 请求数;5 小时 + 周 + 月三层 | 限时 9.9 元起 | 频繁切模型的开发者 |
| GLM Coding Plan | GLM 单家族 / 代码 + MCP | 积分(含 MCP);5 小时 + 周 | Lite 118 元/月 | 已锁定 GLM 的编码者 |
| MiniMax Token Plan | M3、M2.7 / 代码 + 全模态 | Token;5 小时 + 周 | Plus 49 元/月 | 代码与内容生产混合 |
| Xiaomi MiMo Token Plan | MiMo V2.5 / 代码 + 语音 | Credits;非高峰 0.8 倍 | Lite 39 元/月 | 用 MiMo、要语音或 Claw |
两个维度就能把四家分开:模型范围(单家族 ↔ 多入口)和能力范围(纯代码 ↔ 多模态)。方舟在模型轴的一端,GLM 走单家族深度,MiniMax 和 MiMo 偏多模态。常切模型的人选方舟省事;团队已固定 GLM 的,不必为"模型自由"多花钱。
起步价只用来判断档位,不能拿它除出"每元多少次调用"。方舟 9.9 元是限时首购价(两个月后恢复 40 元/月),MiniMax 邀请活动会改变实付金额,GLM 在 7 月改版后已取消首购优惠、只留季付年付折扣,MiMo 则保留首购与年付折扣。下单看续费价和取消规则,首月折扣只算一次。
比价之前,先校准五个口径
四个方案的额度单位互不相通,横向比价前先校准这五件事。
1. 额度单位不能直接换算
方舟按请求数算,GLM 用积分、MiMo 用 Credits、MiniMax 用 Token——四套四种口径,同一个 Claude Code 任务在不同方案里消耗的单位完全不同。长上下文、思考模式、Agent Team(多个 Agent 并行协作的模式)和模型倍率都会进一步改变消耗。
“方舟每 5 小时 1,200 次请求"和"GLM 每 5 小时 2,000 积分"看着都能比大小,但一个数的是模型被调了几次,一个数的是按 token 折算的积分池,直接除没有意义。要靠自己的典型任务在每套方案里跑一遍,看能完成多少次,比翻评测准确。
口径乱不是巧合。MiniMax 3 月就把 Coding Plan 升级成了按 Token 计的 Token Plan,GLM 7 月底跟进积分制,方舟名义上按次,官方文档也写明实际可用次数会因上下文长度和模型差异大幅波动。Agent 任务的消耗天然不可预测,“包 N 次"的承诺越来越难做,各家都在从按次走向按 token 折算。对买家的含义很直接:比价的分子分母都捏在厂商手里,只能拿自己的任务去校准。
2. 月度总量之外,先碰到的是短窗口
方舟、MiniMax 和 GLM 都公开了 5 小时或周窗口,MiMo 是例外——它没有 5 小时限制,按月度 Credits 结算,只有档位和时段倍率。并发数叠加上高峰限流,实际先撞墙的是局部窗口,不是页面上最醒目的月度总量。白天同时跑多个 Agent 的要看短窗口;偶尔做一次大重构的,更容易被单次长任务和周额度卡住。
3. 个人套餐不能当生产 API 用
个人 Coding Plan 面向交互式编程工具,不是生产通道。方舟明确额度只在支持的 Coding 工具里生效,GLM 限定指定工具和环境,MiniMax 官方建议生产环境走按量付费。要给网站、机器人或 SaaS 后端提供稳定服务,按 API 的价格、并发、SLA 重新评估;拿个人订阅 Key 当生产通道,被官方识别后会被封禁或限流。
4. 工具兼容不等于体验相同
“支持 Claude Code、Cursor、OpenCode"只说明能接入。模型支不支持图像、思考模式怎么开、工具调用稳不稳、上下文怎么计费、兼容层完不完整,都会影响实际体验。下单前用自己的仓库跑三轮,每轮盯一个验收信号:需求实现跑通且符合预期,跨文件重构后构建与测试全绿,失败排查能定位到具体错误并给出可落地修复。三个信号都拿到,兼容层才算经得起真实任务;只跑通一个示例项目,说明不了什么。
5. 缓存命中率决定真实成本
订阅页的积分、Credits 和 Token 都按官方标价折算,但这些标价分两套:命中缓存远低于未命中。MiMo 的 mimo-v2.5-pro 输入命中缓存 2.5 Credits/Token、未命中 300,差价 120 倍(mimo-v2.5 是 2 对 100,差价 50 倍);GLM-5.3 缓存命中输入系数 1.7、未命中 6.9;MiniMax M3 同样对缓存命中单列低价。Agent 任务恰恰缓存命中率最高——系统提示词、项目文件、历史对话反复读入。拿 MiMo V2.5 Pro 算:同一轮跨文件重构(系统提示词 + 项目文件反复读入),缓存命中率 90% 的场景大概花 2,500 Credits,命中率 20% 要 100,000,差了 40 倍。两套标价相同的套餐,谁的 Agent 缓存命中率高,谁的实际成本可能低一个量级。比价时先看自己的任务里有多少内容是重复读入的。
方舟 Coding Plan:多模型入口
Lite 和 Pro 两档,Pro 用量约为 Lite 的 5 倍。接入的模型以控制台展示为准,2026 年 9 月上旬官方接入文档列了 9 个:doubao-seed-evolving、doubao-seed-2.1-turbo、doubao-seed-2.0-lite、minimax-m3、glm-5.3、glm-5.3-flash、deepseek-v4-pro、deepseek-v4-flash、kimi-k2.7-code。同一套餐可在 Claude Code、Cursor、Cline、Kilo Code、OpenCode 等工具间共享额度。
切模型有两条路:在工具配置里写 Model Name 实时切换,或者在方舟控制台选模型(3~5 分钟生效)。Auto 模式只能在控制台开启,工具配置里写不了 Auto;它能减少手动选模型的次数,但需要可复现结果时应固定模型——把同一任务交给动态路由,复盘会很难。两条边界:套餐额度只在支持的 Coding 工具里生效,不能用于普通 API 调用;额度耗尽后不继续扣余额,只能等窗口恢复。另有一个防坑点:用 Claude Code 时把 CLAUDE_CODE_DISABLE_NONESSENTIAL_TRAFFIC 设为 1 关掉后台遥测请求,方舟文档明确提示这类请求也走套餐地址、会静默吃额度。
Lite 套餐的三层额度上限是每 5 小时约 1,200 次请求、每周约 9,000 次、每月约 18,000 次,Pro 是其 5 倍。这组数字是官方基于 Doubao Seed 2.0 Lite、Claude Code 未开 Agent Team 模式的预估——请求数不是数"模型被调了几次”:重模型、长上下文和 Agent Team 都会放大单次请求的折算倍率,1,200 次是折算后的上限,不是 1,200 次原始调用。同样的活儿,选 GLM-5.3 这类重模型会更快撞墙。拿这组数字推"方舟比 GLM 多 15 倍额度"不成立——一边数的是折算后的请求数,一边数的是积分,单位不同。
方舟还有一条 Agent Plan 产品线(5 月上线),打包全模态模型和联网搜索等 Harness 能力,面向跑 Agent 的场景,与 Coding Plan 分开销售。想跑多模态 Agent 的可以单独去看,本文只比 Coding Plan。
- 方舟 Coding Plan 活动页
- 方舟 Coding Plan 用量与使用边界
- 邀请码:
MEY8M6BZ
MiniMax Token Plan:代码和多模态共用额度
三档月费:Plus 49 元、Max 119 元、Ultra 469 元。都支持文本、图像和语音,Ultra 含每日 5 条视频生成额度(音乐生成接口自 8 月 20 日起停止向新用户开放,历史付费用户可继续用,免费音乐接口同日停服);档位越高,可并行 Agent 数和月度 Token 越多。可在 MiniMax Code 里直接用,也能用订阅 Key 接入 Claude Code、Codex CLI、OpenCode、Cursor 等工具——订阅 Key 和按量 API Key 不互通。
名字里的"Token"有来历:3 月那次升级后,旧 Coding Plan 到期会自动转入新计划,从"包次"改成"包 Token”——上一节说的行业转向,MiniMax 就是头一个。
限流比价格更值得关注:额度受 5 小时和周窗口控制,高峰时段可能动态调整(官方口径通常出现在工作日 15:00~17:30),未用完的不结转。代码和配图混着做的人,共享额度省事;纯编程用户先算清楚——多模态权益用不上时,它只是套餐介绍里的一行字。
GLM Coding Plan:围绕单一模型家族做深
Lite、Pro、Max 三档。2026 年 7 月 30 日改版后涨价并转为积分制:月付原价 118 / 538 / 1078 元(改版前是 49 / 149 / 469 元;老用户价格与权益不受影响,可按原价续订升档),取消每日限量抢购、改为开放订阅,连续包月、季付、年付另有折扣。所有档位支持 GLM-5.3 和 GLM-5.3-Flash(GLM-5.3 于 8 月 14 日上线,支持 1M 上下文);调用 GLM-5.2/5.1 自动路由到 GLM-5.3,调用 GLM-5-Turbo/GLM-4.7 自动路由到 GLM-5.3-Flash。可接入 Claude Code、Kilo Code、OpenClaw(开源的个人 Agent 框架,擅长挂机跑长任务)、OpenCode、TRAE、CodeBuddy。
额度按积分算,与 MCP(模型上下文协议,Agent 调用外部工具的统一接口)共享同一个池:Lite 每 5 小时 2,000 积分、每周 10,000,Pro 约 6 倍、Max 约 14 倍。模型按输入/输出 token 折算消耗:GLM-5.3 输入系数 6.9、输出 24、缓存命中输入 1.7(命中价约为未命中的四分之一),GLM-5.3-Flash 低得多,对应 2.3 / 8 / 0.56。联网搜索、网页读取、开源仓库三类 MCP 每次调用按 1.2 系数从同一积分池扣,不再有独立的月度次数上限。非高峰时段(工作日 14:00~18:00 之外,周末全天)模型调用按 50% 抵扣——长任务挪到夜间或周末,成本直接减半;官方另设夜间活动,每天 23:00 到次日 9:00,ZCode 端的 GLM-5.3-Flash 不限额度,其他工具额度翻倍。想知道积分够用多少,官方给过一个换算:按 98% 缓存命中率算,Lite 的周积分约折合 0.5~1 亿 token 的 GLM-5.3 用量,区间下限对应纯高峰、上限对应纯非高峰。
已经在自家仓库里跑顺 GLM 的人,这种套餐比多模型入口更直接,省掉频繁切模型的功夫。不过 7 月改版涨价后,它已是四家里最贵的:如果只想用 GLM-5.3 写代码、不需要智谱的视觉/搜索/仓库 MCP,方舟同样接入了 GLM-5.3,起步价低得多。还没确定主力模型就上高档年费,钱可能白花。
Xiaomi MiMo Token Plan:四档订阅 + Claw 加购
MiMo Token Plan 是完整订阅:Lite、Standard、Pro、Max 四档,月付原价 39 / 99 / 329 / 659 元,首购与年付另有折扣;Lite 月包含 4.1B Credits,官方按 mimo-v2.5 口径估算约够跑 200 轮中等复杂任务。覆盖 mimo-v2.5-pro、mimo-v2.5 和语音模型,兼容 Claude Code、OpenCode、Codex、OpenClaw 等工具。计费上有个容易忽略的点:TTS 合成系列限时免费、不扣套餐额度,语音识别按输入音频时长折算扣减(30M Credits/小时)。
MiMo 用 Credits 计量,模型和时段倍率不同;北京时间 00:00~08:00 按 0.8 倍消耗。MiMo Claw 有免费入口(新用户可直接用,单次会话有时长限制),完整版是单独的加购订阅(限时 14.9 元/月,标准价 19.9 元/月),把与 OpenClaw 框架深度适配的 MiMo-V2.5-Pro、云端托管环境和金山办公生态打包——不用本地部署,浏览器打开就能用,面向 7×24 小时任务和并行执行,和 Token Plan 不是一种权益,分开核算。
迁移已经完成:V2 系列已于 2026 年 6 月 30 日下线,V2.5 是当前唯一在线系列。项目若还在引用旧的 mimo-v2-* 模型名,现在会直接报错。
- Xiaomi MiMo Token Plan
- Xiaomi MiMo API 定价
- 邀请码:
HM58L7
一次跨文件重构,四套方案怎么走
抽象对比看多了容易晕,不如推演一次真实任务。把一个 2,000 行的 payment_service.py 拆成 validator、gateway、retry 三个模块并补测试,在 Claude Code 里发起,预计 90 分钟——够小,能在一轮窗口内跑完;也够复杂,能同时触发模型切换、MCP 调用和倍率消耗。validator 做输入校验(金额格式、卡号 Luhn、风控),gateway 封装三方支付的 HTTP 通信和签名,retry 处理重试、退避和幂等。三者接口边界清晰,却都依赖 payment_service.py 里散布的共享状态和配置常量,拆解前得先提取公共依赖,再逐个切割。下面四段里每家模型的"脾气”,是笔者近几个月日常使用攒下的主观印象,只当推演的输入假设,不当跑分结论。
方舟。 开工前手动切到 GLM-5.3 做主重构——它对 Python 类型注解和接口抽象理解到位,适合处理 gateway 的签名和异常封装。撞上正则边界(卡号 Luhn、金额格式)时切 Doubao 另写一版替代实现,它处理边界更直接,但偶尔省略异常分支;最后用 DeepSeek 复查测试覆盖,它习惯多覆盖几个边界场景。90 分钟里约 6~8 次切换,切换不耗配额,每次调用都计入 5 小时窗口。Lite 的 1,200 次/5 小时够用;若同时还在跑文档 Agent,就看窗口有没有被吃满。Auto 模式在这里不合适——重构要可复现,交给动态路由难以复盘。
GLM。 全程固定 GLM-5.3。改版后按积分计费,Lite 每 5 小时 2,000 积分、每周 10,000;GLM-5.3 输出系数偏高,长重构的积分消耗不小。把任务挪到非高峰时段能按 50% 抵扣,90 分钟的重构成本直接减半。GLM-5.3 拆共享状态时,一次 prompt 就能识别出 CONFIG 字典、数据库连接池和日志实例三处全局依赖,省掉后续修正轮次。视觉 MCP 这次用不上,仓库 MCP 能快速调出 payment_service.py 的历史变更和关联文件,算额外收益。
MiniMax。 主重构用 M3。它代码风格偏保守,拆共享状态时倾向保留原接口签名、改动幅度小,正合支付模块对稳定性的要求。中间要生成一张支付流程图插进文档——代码和图片共享同一套 Token,不必换账户或另付费。但 5 小时窗口有限:上午跑过一轮编码,下午的重构可能正好撞上窗口恢复。纯代码任务在这里没有额外优势。
MiMo。 MiMo V2.5 对 Python 的掌握和 GLM-5.3 接近,但处理装饰器、元类更有把握,retry 的重试装饰器能一次生成到位。任务在 00:00~08:00 发起,Credits 打 8 折,90 分钟实费约 72 分钟;必须在工时跑就没这优惠。MiMo Claw 用不上——它是 7×24 长任务和并行执行的加购项。用之前确认 Claude Code 配置里的模型名是 V2.5(旧 V2 名已下线),否则任务跑到一半会直接报模型不存在。
四套都能完成这次重构,省下的东西不一样:方舟省的是维护多入口的功夫,GLM 把配额围绕单一模型算得更准,MiniMax 在代码加配图的混合任务里一份额度两用,MiMo 奖励愿意把工作挪到低谷时段的人。核心区别只有一句话:你是不是已经锁定主力模型、是不是需要多模态、愿不愿意在低谷时段跑重任务——三个问题的答案组合起来,就能把四套里最优那一套找出来。
买不到的 Kimi:从方舟借入口
K3 是 Kimi 旗舰,2.8 万亿参数、1M 上下文、主打 agentic coding,长上下文跨文件改需求时表现稳,适合频繁重构的仓库。想先用起来不必等会员——Kimi 在方舟里就能切到。注意:因算力紧缺,Kimi 于 2026 年 7 月 20 日发公告,暂缓新用户订阅(老用户不受影响),恢复时间待定;急用可以走方舟。
为什么这三家不是 Coding Plan
主表之外还有三套常见方案容易混淆,但它们卖的不是"编程配额"—— DeepSeek 是按量 API,WorkBuddy 和 TRAE Work 是办公平台。
DeepSeek:按量 API,不是订阅套餐
DeepSeek 按输入、输出 Token 计费,从账户余额扣款,有 Claude Code 等 Agent 集成文档,但没有名为"DeepSeek Coding Plan"的订阅。低频调用、要精确核算单次成本,或要把模型接进生产服务时,按量更合适。代价是 Agent 长任务可能连续发起大量请求,没有预算上限和调用监控,账单比固定订阅更难预测。
WorkBuddy:交付办公结果,不是 Token 配额
方案、PPT、数据分析、软件生成、音视频制作在一个工作台完成,并接入腾讯文档、企业微信、微信、邮箱等协同工具。它的价值在办公覆盖和腾讯生态,不在模型 API 或 Coding 配额。整天整理材料、做演示的人,WorkBuddy 比再买一个编码模型更贴需求;核心工作是持续改大型代码库的,就回到前面几套 Coding Plan 里挑。
TRAE Work:Agent 平台,和 Coding 配额不同层
写作、整理、分析、生成都交给 Agent 跑,交付的是结果而不是模型调用次数——Coding Plan 卖编程工具里的额度,TRAE Work 把任务整个接过去。它和 GLM Coding Plan 不冲突(GLM 兼容列表里就有 TRAE),可以搭配用。
用 7 天数据选套餐
从最低档起。先用 API 余额、免费额度或月付最低档跑一轮测试——前文各家的新人积分和邀请优惠正好用上(GLM 的体验卡一张就含 2,000 积分,够拿典型小任务先试试水),零成本换一周真实用量。测试期间每天记五项:
- 真实任务数:需求实现、重构、测试、排错各完成多少次,不记聊天轮数。
- 最重的 5 小时窗口:连续编码是否触发限额、排队或降速。
- 模型切换次数:切换是为了质量,还是因为某个模型常失败。
- 非代码用量:图片、语音、视频、搜索和 MCP 调用占多少。
- 溢出成本:套餐耗尽后是等恢复,还是必须转按量 API。
一周后把账算成:
有效月成本 = 订阅费 + 溢出调用费 + 闲置权益成本 + 切换与维护成本
订阅费买高了可惜,买低了溢出更贵;闲置权益是为用不上的功能付钱,切换成本是多入口却只用一个模型的浪费。一周数据填进这四格,哪个环节漏钱,一算就清楚。
下单前最后过一遍
- 先月付,再决定季付或年付,至少跑完一次完整迭代周期。
- 同时记短窗口、周窗口和并发限制,别只看月度总量。
- 确认套餐是否只限个人使用、是否限定工具,额度耗尽后怎么办。
- 查续费原价、自动续费取消时间、退款规则和邀请优惠期限。
常见问题
几个人合买一个套餐行不行? 不建议。个人 Coding Plan 多绑单账户、限交互式工具,多地同时登录容易触发限流,也违反条款;团队用应选团队版或按量 API。
邀请积分和首购折扣能叠加吗? 通常属于不同活动:首购价下单时生效,邀请积分注册后到账,多数互不冲突(GLM 改版后已取消首购优惠,属例外)。各平台规则不一,以下单页和积分到账说明为准。
要不要等大促再入手? 月付最低档的试错成本,一般低于等大促省下的差价。先月付拿一周用量数据,大促时再用数据决定要不要年付。
Kimi 在方舟里能切,和直接买 Kimi 会员有差吗? 有差。方舟里的 Kimi-k2.7-code 是 Coding Plan 共享额度下的一个模型入口,消耗方舟套餐的请求数;Kimi 会员是独立订阅,额度和权益(如长上下文、Agent Team 并发上限、专属资源池)不与方舟互通。方舟能解决"现在就想用 Kimi"的应急需求,但如果 Kimi 是主力模型,会员到期后还是得自己单独订阅(当前算力紧缺暂缓新用户订阅,恢复时间待定)。
邀请码和首购折扣怎么用才不亏? 首购价是套餐的首次月费折扣,邀请积分是注册后到账的独立额度,两者大多互不冲突。实际操作:先用首购价下单最低档(方舟 9.9、MiMo 39、MiniMax 49、GLM 118),再用邀请码领积分(方舟 50 次请求、GLM 2,000 积分、MiMo 和 MiniMax 各约 5~10 万 Credits),零成本拿一周真实用量数据再决定升档或退订。注意 GLM 改版后已取消首购优惠,只剩季付/年付折扣,属例外。
最后:顺序不能反
方案细节会变,价格会调,模型会迭代,但判断顺序不变:先确定自己的需求落在哪一层——多模型入口、单模型深度、多模态额度、办公平台,还是按量 API;再花一周用真实任务测出短窗口和溢出成本;最后才轮到比价格。顺序一旦颠倒,就成了先看价格、再迁就功能,最后为用不上的部分持续付费。
错过一次折扣无非多等一阵,选错产品类型,月费却会持续打水漂。
更新记录
| 日期 | 变更 |
|---|---|
| 2026-08-05 | 按 GLM 7 月 30 日改版(涨价转积分制)、Kimi 7 月 19 日暂停新订阅更新价格与口径;同步各套餐当前模型名单与限额,见文首信息快照 |
| 2026-08-19 | 纳入 GLM-5.3 于 8 月 14 日上线(GLM-5.2/5.1 自动路由至 5.3)、MiniMax 音乐模型 8 月 20 日退出 Token Plan;校准口径新增"缓存命中率";明确 GLM 周末全天非高峰抵扣、MiMo 无 5 小时窗口 |
| 2026-09-03 | 修正方舟请求数口径(按模型与上下文折算,非固定次数);方舟补 Agent Plan 产品线边界;口径 1 增补"从按次走向按 token 折算"的行业转向;MiniMax 补 Token Plan 由 Coding Plan 升级而来;GLM-5.3 标注 1M 上下文;MiMo Claw 补云端托管细节;任务推演补充模型个性判断的来源声明 |
| 2026-09-07 | 全文数字对照各家官方文档复核:修正 GLM 支持模型口径(档位内为 GLM-5.3 与 GLM-5.3-Flash,GLM-5-Turbo/GLM-4.7 请求自动路由到 Flash),补两套模型的三档系数与官方 token 换算,老用户政策修正为"可按原价续订升档",补夜间活动;方舟模型名单精确到 9 个,补 Auto 仅控制台可开、遥测开关避免额度静默消耗与官方预估基准;MiMo 缓存差价注明对应模型(pro 120 倍、v2.5 50 倍),补月度 Credits、TTS 限时免费与 Claw 免费入口;MiniMax 音乐调整改为官方口径(8 月 20 日起停止向新用户开放),补 Ultra 每日 5 条视频、订阅 Key 不与按量 Key 互通、高峰时段口径;Kimi 暂停订阅改为 7 月 20 日公告口径,补 K3 参数规模 |
后续价格、模型名单或限额变动,优先改文首"信息快照"和上表,再顺着正文核对对应套餐段落的数字。
参与讨论
使用 GitHub 登录。欢迎补充事实、异议与实践。
讨论暂时无法加载。