惯性聚合 高效追踪和阅读你感兴趣的博客、新闻、科技资讯
阅读原文 在惯性聚合中打开

推荐订阅源

Vercel News
Vercel News
OSCHINA 社区最新新闻
OSCHINA 社区最新新闻
雷峰网
雷峰网
有赞技术团队
有赞技术团队
罗磊的独立博客
博客园 - 叶小钗
Jina AI
Jina AI
博客园 - 司徒正美
让小产品的独立变现更简单 - ezindie.com
让小产品的独立变现更简单 - ezindie.com
T
Tailwind CSS Blog
钛媒体:引领未来商业与生活新知
钛媒体:引领未来商业与生活新知
人人都是产品经理
人人都是产品经理
Apple Machine Learning Research
Apple Machine Learning Research
阮一峰的网络日志
阮一峰的网络日志
Microsoft Security Blog
Microsoft Security Blog
大猫的无限游戏
大猫的无限游戏
量子位
MyScale Blog
MyScale Blog
V
Visual Studio Blog
博客园 - 聂微东
The Cloudflare Blog
Engineering at Meta
Engineering at Meta
小众软件
小众软件
宝玉的分享
宝玉的分享

量子位

AI自主监测宠物健康,陪狗都不用自己来了!涂鸦Hey Tuya打造全屋智能“超级入口” 燃油SUV车主熬出头了!华为乾崑智驾加持,全新奥迪Q5L率先实现智能化 华人再破硅谷天花板!AI黑马新任CTO,中科大80后 0博士组合拿下ICLR时间检验奖!两个GPT天才本科生+二本逆袭LeCun弟子,十年论文终封神 DeepSeek V4报告太详尽了!484天换代之路全公开 优必选发布Thinker cosmos:加码开发者生态,推动人形机器人走向规模化 DeepSeek-V4发布,华为云首发适配 Mobileye 2026财年一季度营收增长27%,自动驾驶商业化进程持续推进 100%主流车企的共同选择:一个AI“通用底座”正在汽车行业成型 真有人做AI小猫啊?!生产力和情绪价值都拉满了 Coordination Engineering关键一环,JiuwenClaw再发布Team Skills技能新范式 DeepSeek V4终于发布!打破最强闭源垄断,明确携手华为芯片 荣耀WIN游戏本等多款新品正式发布,荣耀PC家族全面爆发 刚刚,GPT-5.5发布!内测英伟达工程师:失去它像被截肢 河南师傅,左手扳手,右手飞书,竟然能搞数据分析! 国内首家百亿估值纯推理GPU独角兽诞生!专访曦望联席CEO王湛:谁的推理成本更低谁就是赢家 印奇站上AI+车浪潮之巅:7个月,千里科技和华为「五五开」 飞书项目开放平台焕新升级,全面迈向“AI Friendly” 半壁华人!GPT Image 2团队曝光:无锡才俊带队,13人4个月封神 Nature封面:机器人乒乓球干翻人类职业选手 特斯拉开源硬件,中国公司回应来了:直接把机器人大脑开源了 挖漏洞何必Mythos,国产智能体早跑通了 “不造车的特斯拉”亮出“舱驾一体”全家桶,汽车长出“主动理解力”,奇瑞比亚迪等10+巨头力挺 科大讯飞发布燎原N30m笔记本,重塑全栈国产AIPC新标杆 神秘模型「大象」:仅100B拿下SOTA,Token效率超高! 香港科创标杆奖项!商汤首席科学家林达华荣获中银香港科创奖 国产多模态Agent拿下医学分割SOTA!不用改模型、不加token 这些人读个博一年能挣几十万?2026苹果学者名单公布了 大厂AI抢人大战,从实习生开始 全球首个世界统一模型发布,机器人家庭成员来了!
DeepSeek V4永久降价!缓存命中再打1折,实测编程成本骤降83%
梦晨 · 2026-04-27 · via 量子位

< img id="wx_img" src="https://www.qbitai.com/wp-content/uploads/imgs/qbitai-logo-1.png" width="400" height="400">

2026-04-27 12:35:49 来源:量子位

5块钱干完30块的活

梦晨 发自 凹非寺
量子位 | 公众号 QbitAI

DeepSeek两天连续两次降价!

输入输出2.5折的基础上,命中缓存的输入折上折再打1折。

划重点了,输入缓存的折扣没有规定时限哦~

DeepSeek研究员陈德里也确认,输入缓存是永久降价,还打上了AGIforEveryone标签。

有学者表示,这将彻底改变人们处理AI记忆的方式。

原来发布时候的“迈入百万上下文普惠时代”是这个意思啊?

那么打折后到底省了多少钱?

只能说,比表面看起来还要更多

实测编程整体节省83%

首先,Agent编程任务场景下,输入的比例远高于输出

而且DeepSeek的缓存优化本来就做得好,V4-Pro的输入缓存命中率约95%,V4-Flash约91%

也就是说,真实花费的绝大部分token,都是按输入(命中缓存)计算的

在这一点上,V4-Pro每百万token只比V4-Flash贵了0.5分钱。

此前量子位测试消耗约3500万token,花费31.73元。

把数据发给DeepSeek,让他计算一遍,与真实花费相差无几。

但是!

按照打折后的新价格计算,只需要花5.34元了。

整体节省约83%,只花打折前17%的成本,就能获得同样的产出。

实际测试打折后消耗了1300万的V4-Pro token。

缓存命中率稍有提升到了约96%,输出token的占比与打折前测试的也差不多。

实际使用1300万token,花费2.36元,也基本符合计算结果。

价格屠夫回来了

降价引发行业震动,DeepSeek不是第一次干了。

这种商业策略与他们的技术理念高度一致,通过底层架构和算法的持续创新来压低模型推理成本,并将这些成本优势迅速转化为市场竞争力

早在2024年8月,DeepSeek就给V3降价,引发阿里云、字节等大厂更近,引发第一轮token价格战。

R1发布后,更是通过夜间空闲时段额外打折的方法,让价格战进一步升温。

这一次V4在开启价格战,对海外用户的心理冲击力还要更大。

如果按美元标价,小数点后有几位都快数不清楚了。

有网友总结,学生和AI初学者、小型企业都将受益匪浅。

最后,别忘了那行小字。

期待下半年,DeepSeek大规模部署华为算力后,价格还能给大家什么惊喜。

参考链接:
[1]
https://x.com/deepseek_ai/status/2048440764368347611?s=20
[2]
https://x.com/victor207755822/status/2048442362800804159

版权所有,未经授权不得以任何形式转载及使用,违者必究。