惯性聚合 高效追踪和阅读你感兴趣的博客、新闻、科技资讯
阅读原文 在惯性聚合中打开

推荐订阅源

奇客Solidot–传递最新科技情报
奇客Solidot–传递最新科技情报
人人都是产品经理
人人都是产品经理
爱范儿
爱范儿
aimingoo的专栏
aimingoo的专栏
博客园 - 叶小钗
H
Help Net Security
Microsoft Security Blog
Microsoft Security Blog
The Cloudflare Blog
S
SegmentFault 最新的问题
小众软件
小众软件
钛媒体:引领未来商业与生活新知
钛媒体:引领未来商业与生活新知
博客园 - 司徒正美
The GitHub Blog
The GitHub Blog
量子位
H
Hackread – Cybersecurity News, Data Breaches, AI and More
V
V2EX
Martin Fowler
Martin Fowler
博客园 - 【当耐特】
J
Java Code Geeks
D
DataBreaches.Net
云风的 BLOG
云风的 BLOG
F
Fortinet All Blogs
Blog — PlanetScale
Blog — PlanetScale
Last Week in AI
Last Week in AI

LINUX DO - 最新话题

谷歌云盘下载700g数据集,求方法 OpenAI推出了100美元的Pro订阅后,plus的Codex 5小时限额大幅缩水 之前买的super grok居然还没掉 关于CPA认证文件周限 佬们,默认CDK的要求是什么等级啊? 最新版本的微信群聊机器人方案 有没有人知道如何free号没有封,那么是否可以循环使用,因为我看主要是周限 L站改版了?吓我一跳,我以为我浏览器崩了 淘宝这种宽带可信吗,500兆移动宽带月费8元到2099年 docker内部应用访问宿主机mysql和redis时被拒绝connection refuse Erp全栈想转行做Ai有什么推荐的吗 boost有bug 佬们,有没有靠谱点的 Plus 购买渠道 大妈,狗妈用的 lg 服务有源头开源项目吗? 有人有能过验证码打码的嘛 上次帖里好像发过通过大模型来打码的 gpt plus 封号似乎也太快了点,一天就给封号了 按流量/token收费的国产官方AI推荐 我算是知道了为什么Oracle总是ABC了 佬友们帮我分析一下 ChatGPT Team账号只有一个人使用和4个席位邀请满了使用的总额度是一样的吗? gpt-free 10个带rt CPA反代claude是默认1m吗? 我终于敢说我做出来windows上tmux的替代了,目标windows/全平台最强的终端Ai编程工具 claude pro升级max,除了原来的$20,好像还能再领一次$100 关于AI agent的知识框架 独乐乐不如众乐乐,分享一下我的的AI对话程序 佬们自建网站支付问题是怎么解决的 怎么能让gpt模仿claude风格输出 codex free已经死了,下一个会是plus或者team吗 请问chatgpt pro里的fast模式,速度快了,降智吗
关于开源国模的一些问题
Autsun (Autsun) · 2026-06-19 · via LINUX DO - 最新话题

因为最近自己工作上的项目会跑一些开源小规模的模型,比如Qwen 3.6 35BA3B之类的
我发现主要的显存占用和模型规模大小有关
而国内的模型定价里,比如智谱的GLM-5,5.1,5.2,这三个模型其实都是744B(激活 40B)的moe模型,抛开GLM-5.2的1M上下文会更占用资源,其实5和5.1应该资源消耗是一样的,同理Kimi的K2.5-K2.7也都是1T(激活32B)的moe模型
但是定价却有区别,想知道为什么这些厂商不把早点模型都更新到最新的淘汰掉老的,还把资源留在老的模型上呢,特别是一些第三方渠道(比如腾讯和阿里之前的codingplan都还停留在GLM5,KIMIK2.5,实际上更新到5.1甚至限制256K上下文的5.2和KIMIK2.7并不会增加算力消耗)
难道这些厂商都只是因为不想继续升级模型然后让存量用户自己不续订亏钱的codingplan,不惜把算力都留在老模型上吗,因为算力是有限的,他优化掉老的模型,把算力用在并没有增大消耗的新模型上,肯定是有利的吧

HeriX (HeriX) 2

因为阿里就是不想让coding plan用新的, 然后推它的token plan
你看它的token plan新的模型都有

zhongruan (钟阮) 3

有的企业,是要用旧版本的,并不是都和用户一样,只需要最新旗舰

lucyna (lucyna) 4

有的是懒得换了,毕竟模型之间还是有去别的,万一跑不通了呢

Autsun (Autsun) 5

是的,我想过这个理由,但是他不可能一直就这样不更新吧,现在tokenplan里面还有老模型,如果之后为了把算力用到新模型上,把tokenplan里的GLM-5,KIMI-K2.5这种老模型去掉了,难道还会为了这个理由,继续为了codingplan保留GLM-5,KIMI-K2.5的算力吗,而不是干脆一起更新了?