惯性聚合 高效追踪和阅读你感兴趣的博客、新闻、科技资讯
阅读原文 在惯性聚合中打开

推荐订阅源

Martin Fowler
Martin Fowler
Blog — PlanetScale
Blog — PlanetScale
Vercel News
Vercel News
L
LangChain Blog
Google DeepMind News
Google DeepMind News
H
Hackread – Cybersecurity News, Data Breaches, AI and More
F
Fortinet All Blogs
The GitHub Blog
The GitHub Blog
Recent Announcements
Recent Announcements
D
DataBreaches.Net
云风的 BLOG
云风的 BLOG
OSCHINA 社区最新新闻
OSCHINA 社区最新新闻
A
About on SuperTechFans
博客园_首页
N
Netflix TechBlog - Medium
Y
Y Combinator Blog
Hugging Face - Blog
Hugging Face - Blog
Last Week in AI
Last Week in AI
酷 壳 – CoolShell
酷 壳 – CoolShell
B
Blog
Apple Machine Learning Research
Apple Machine Learning Research
罗磊的独立博客
美团技术团队
V
V2EX

问与答

智谱的 code plan 和 api 有什么区别么 你每天用的最多的 app 是啥? 有人做过 AI 标书吗? 星巴克用的什么牌子微波炉?加热好均匀 codex 中的 gpt5.5 出来了吗? 你们都用 coding plan 做什么? chatgpt 忽然间打不开了 想问下哪个 AI 可以生成网站? 我做了一个叫「订阅斩」的 iOS App,专门对付那些悄悄扣钱的订阅 求分享 SDD 相关实践经验 Grok 不充会员是不是会显示系统繁忙嘞 想要多人拼车开 gpt pro 100 刀 MiniMax 和 Kimi 便宜的 coding plan 真的恶心啊 国内的校友关系的网站为什么都没了? 请分享你的 clash 规则配置,开了 tun 模式,实在太卡了。 目前国产哪个模型 chat 最强? 现在做工具类小程序还能挣钱吗 老婆第一个母亲节,送点什么礼物呢 选哪种模型? vscode 插件 codex,一写代码 mac 风扇转个不停怎么解? 大家对于软件部门领导不参与代码工作有什么看法 为什么有那么多 V 友通过阴阳各种国货来质疑主流价值观? 好用的果蔬清洗机推荐 某网站的 HTTP API 和 WSS 都套了 CF,有什么办法找到真实服务器部署位置吗? 是我的幻觉吗,我为什么感觉国产模型现在真的很强, glm5.1 我斥巨资买了一个域名,准备做一个面向全球用户的校友社区,大家帮忙看看域名是否合适? 安卓淘宝每次启动进入淘宝精选,有办法不这样吗? 动态 JSON 序列化对强类型语言很难吗? 怎么做到说话简洁有条理且让人容易理解? 有没有在线实时语音识别的羊毛呢?
看到小米 AI 降价的消息,这个 Plan 是不是并没有比按量 API ...
LittleTree · 2026-05-27 · via 问与答

主要想用在文本处理优化、普通多轮问答、多模态理解,已经有 codex 了,所以不太做编程 Agent 。

我咨询了一下 GPT ,如果只是纯文字普通问答,Token Plan 似乎并没有比直接用 DeepSeek / MiMo 按量 API 省很多,大家有没有实际使用的分享一下体感?

下面是 GPT 给的一些计算逻辑:

一、官方按量 API 价格

小米 MiMo-V2.5-Pro 最新按量价:

  • 国内:缓存命中输入 ¥0.025 / M tokens ,未命中输入 ¥3 / M ,输出 ¥6 / M
  • 海外:缓存命中输入 $0.0036 / M ,未命中输入 $0.435 / M ,输出 $0.87 / M

小米 MiMo-V2.5 最新按量价:

  • 国内:缓存命中输入 ¥0.02 / M ,未命中输入 ¥1 / M ,输出 ¥2 / M
  • 海外:缓存命中输入 $0.0028 / M ,未命中输入 $0.14 / M ,输出 $0.28 / M

这个价格基本贴近 DeepSeek V4:

  • DeepSeek V4-Pro:$0.003625 / $0.435 / $0.87
  • DeepSeek V4-Flash:$0.0028 / $0.14 / $0.28

所以单看按量 API ,MiMo-V2.5-Pro ≈ DeepSeek V4-Pro ,MiMo-V2.5 ≈ DeepSeek V4-Flash 。

二、Token Plan 的 Credits 扣费规则

小米 FAQ 写的是:

MiMo-V2.5-Pro:

  • 缓存命中输入:2.5 Credits / token
  • 未命中输入:300 Credits / token
  • 输出:600 Credits / token

MiMo-V2.5:

  • 缓存命中输入:2 Credits / token
  • 未命中输入:100 Credits / token
  • 输出:200 Credits / token

Lite 套餐是 4.1B Credits 。官方例子也写了:用 10M MiMo-V2.5-Pro 未命中输入 token ,会消耗 3000M Credits ,还剩 1100M Credits 。

按这个比例推,人民币口径下大概可以理解为:

1B Credits ≈ ¥10 的按量 API 价值。

因为:

  • V2.5-Pro 输入 ¥3/M ,对应 300 Credits/token ,也就是 300M Credits ≈ ¥3
  • V2.5-Pro 输出 ¥6/M ,对应 600 Credits/token ,也就是 600M Credits ≈ ¥6
  • V2.5 输入 ¥1/M ,对应 100 Credits/token ,也就是 100M Credits ≈ ¥1
  • V2.5 输出 ¥2/M ,对应 200 Credits/token ,也就是 200M Credits ≈ ¥2

所以我理解是:Credits 的设计基本就是按最新按量 API 价格倒推出来的。

三、套餐实际价值粗算

按人民币口径,如果 1B Credits ≈ ¥10 API 价值:

  • Lite:4.1B Credits ≈ ¥41 API 价值
  • Standard:11B Credits ≈ ¥110 API 价值
  • Pro:38B Credits ≈ ¥380 API 价值
  • Max:82B Credits ≈ ¥820 API 价值

如果对应月费是大约:

  • Lite ¥39
  • Standard ¥99
  • Pro ¥329
  • Max ¥659

那正常月付的折扣大概是:

  • Lite:¥39 买约 ¥41 API 价值,约省 5%
  • Standard:¥99 买约 ¥110 API 价值,约省 10%
  • Pro:¥329 买约 ¥380 API 价值,约省 13%
  • Max:¥659 买约 ¥820 API 价值,约省 20%

也就是说,小套餐几乎不省钱,大套餐才有一点批发折扣。这个结论有点超过我的预期,因为“包月 Plan”听起来应该比按量 API 明显便宜很多。

四、海外社区也有人类似换算

我看到 Reddit / opencodeCLI 有人按 Lite $6 / 4.1B Credits 计算:

Lite 档下 MiMo-V2.5-Pro 大约是:

  • cache hit input:$0.00366 / M
  • cache miss input:$0.439 / M
  • output:$0.878 / M

这几乎贴着 DeepSeek V4-Pro:

  • $0.003625 / $0.435 / $0.87

Max 档 $100 / 82B Credits 才会低一些,大概变成:

  • V2.5-Pro cache miss input:$0.366 / M
  • output:$0.732 / M

也就是 Max 大概比 DeepSeek / 按量基准便宜 15% 左右。

五、我的疑问

  1. 我这个换算逻辑有没有问题?
  2. Token Plan 是不是本质就是“预付 Credits 包”,不是传统意义上的包月订阅?
  3. 如果按量 API 已经这么便宜,Token Plan 对普通用户的意义是不是主要只有:
    • 首购 / 年付 / 自动续费优惠
    • 非高峰 0.8x
    • 避免频繁充值
    • 多模态 + TTS 免费期
  4. 对普通多轮问答用户来说,是不是 Lite / Standard 够试水,Pro / Max 只有在稳定高用量且能用完额度时才划算?