惯性聚合 高效追踪和阅读你感兴趣的博客、新闻、科技资讯
阅读原文 在惯性聚合中打开

推荐订阅源

Hugging Face - Blog
Hugging Face - Blog
云风的 BLOG
云风的 BLOG
大猫的无限游戏
大猫的无限游戏
M
MIT News - Artificial intelligence
L
LangChain Blog
阮一峰的网络日志
阮一峰的网络日志
OSCHINA 社区最新新闻
OSCHINA 社区最新新闻
Recent Announcements
Recent Announcements
IT之家
IT之家
Google DeepMind News
Google DeepMind News
罗磊的独立博客
爱范儿
爱范儿
Last Week in AI
Last Week in AI
人人都是产品经理
人人都是产品经理
U
Unit 42
MongoDB | Blog
MongoDB | Blog
S
SegmentFault 最新的问题
B
Blog
博客园 - 叶小钗
月光博客
月光博客
Stack Overflow Blog
Stack Overflow Blog
V
Visual Studio Blog
C
Check Point Blog
钛媒体:引领未来商业与生活新知
钛媒体:引领未来商业与生活新知

博客园_首页

Linux实操--组管理、权限管理和定时任务 Java + EasyExcel 实现单个接口导出多个Excel Mem0 源码解析系列(二):提示词工程的深度剖析 Openclaw TaskFlow究竟是什么?和普通Skill技能有什么区别 博文阅读密码验证 - 博客园 嘉立创开源:应该是全网MicroPython教程最多的开发板 Hermes Agent 集成实践:从协议到生产 2026年AI编程工具横评:Cursor、Codex、Claude Code、Zed、Windsurf Java程序员必看的RAG入门教程 2026 AI效率神器:Superpowers + Claude Code 保姆级教程 本地大模型部署全攻略:从 0 到 1 玩转 Ollama 【从0到1构建一个ClaudeAgent】内存管理-上下文压缩 .NET 高级开发 | 设计、实现一个事件总线框架 电子小白入门之NE555 3. WorkBuddy:隐藏玩法,一键召唤专家,让 AI 以"专家身份"给你干活 和AI一起搞事情#3:Claude Teammate 游戏开发翻车实录 【OpenClaw】通过 Nanobot 源码学习架构---(7)Memory C# .NET 周刊|2026年3月3期 我在 Debian 11 上把 K8s 单机搭起来了,过程没你想的那么顺(/opt 目录版) 深度学习进阶(七)Data-efficient Image Transformer CLI+Skill搭建浏览器AI自动化框架,告别一切重复枯燥任务 告别Token账单无底洞:OpenClaw本地部署,重塑企业数据主权的唯一解 FastAPI+Vue:文件分片上传+秒传+断点续传,这坑我帮你踩平了! SBTI 爆火后,我做了个程序员版的 CBTI。。已开源 + 附开发过程 多模态检索开始进入工程期:用 Sentence Transformers 搭建可落地的 Multimodal RAG 100多行代码实现一个最简单的Agent(用ReAct) Claude Code 通关手册(八):推荐 5 个 Hooks,代码质量提升 3 倍 老板:“有人截图了!”。安全部门:“收到,马上查暗水印!” - why技术 技术之外,皆是人间 C#/.NET/.NET Core技术前沿周刊 | 第 69 期(2026年4.01-4.12)
再次感谢梁文锋和DeepSeekV4,历史性的一天!
贾克斯的平行世界 · 2026-04-25 · via 博客园_首页

今天DeepSeek放了个大的。但让行业沸腾的可能不是模型本身。

和昨天OpenAI 刚发的 GPT-5.5定价30 美元/百万输出 token相比,DeepSeek V4依旧伟大,必须感谢梁文锋!

30 美元啊朋友们。DeepSeek只需要2块!

今天,DeepSeek 直接把 V4 开源了。MIT 许可证,随便用。

1、极端的抠门,把闭源巨头干趴了

两个模型,V4 Flash和V4 Pro,直接开源。Pro是1.6万亿参数、49B激活,Flash是284B参数、13B激活,都支持100万token的上下文窗口。

坦率的讲,参数量不是重点。重点是这玩意的效率。

V4,混合注意力架构,在100万token的场景下,推理算力只需要V3.2的27%,KV缓存只要10%。

你想想看,同样的活儿,只用四分之一的算力和十分之一的存储。

这不是「更快了一点」,这是把成本结构直接掀翻了。

性能呢?直接看数据吧,感觉这次完全不是一个量级的事情。

图片

这玩意在数学、STEM、竞赛型代码这些硬核评测上面,直接超越了目前所有已公开评测的开源模型。所有。不是某几个,是所有。而且总成绩已经比肩世界顶级闭源模型了。

什么概念呢?以前我们说开源和闭源之间有一道鸿沟,开源永远在追赶。现在这道沟,被 V4-Pro 给填了一大半。

图片

说真的,开源模型做到这个程度,我是真的没想到。

但最让我觉得炸裂的,其实不是推理性能。

2.Agent才是这次的重头戏

DeepSeek 自己内部的员工,现在已经在用 V4 来做 Agentic Coding 了。他们内部的评测反馈是,使用体验优于 Sonnet 4.5,交付质量接近 Opus 4.6 的非思考模式。

你想想这对整个行业意味什么。以前你要用一个好的编程 Agent,你得买 Anthropic 的 API,一个月烧不少钱。现在有一个开源的、免费的模型,体验居然比人家的付费产品还好?

当然了,跟 Opus 4.6 的思考模式比还有差距,这个 DeepSeek 自己也承认了。但说实话,Opus 4.6 思考模式那是什么级别的存在,能接近就已经很离谱了。

而且 V4 不光是给自己家的产品用。它专门针对 Claude Code、OpenClaw、OpenCode、CodeBuddy 这些主流 Agent 产品做了适配和优化。你没看错,一个国产模型,主动去适配 Claude Code。

这格局,我是真的服了。

下图是 V4-Pro 在某 Agent 框架下生成的 PPT 内页示例,大家随便看看:

图片

3.今天最炸的不是跑分。是芯片。

DeepSeek V4在推理部署上全面转向了华为昇腾950PR,底层架构从英伟达的CUDA迁移到了华为自研的CANN框架。

这四个字的重量,可能比 V4 本身还要大。

为啥?

因为英伟达的 CUDA 就跟当年的 Windows 一样。所有的软件、工具、教程、开发者全围着它转。你一直用 CUDA,就等于把自己的命根子交给英伟达。它一涨价,你扛不住。它一断供,你直接傻眼。

所以 DeepSeek 做的这件事,不只是「我换了个芯片」这么简单。它证明了一件事,华为的芯片,能跑世界顶级的大模型。能跑,而且跑得动。

对于股市有关注的朋友应该还有印象,去年V3开源的时候,一度英伟达的股价跌到了最低点,限于一些神秘规则,这里我不说太多

黄仁勋之前在播客里说了一句话,「如果DeepSeek先在华为平台上发布,那对我们国家来说将是灾难性的」。注意,他说的不是「如果中国做出好模型」是灾难,而是「好模型不再以CUDA为默认优化起点」是灾难。

这非常精准地暴露了一件事,英伟达真正害怕的,从来不是中国做出好模型,而是好模型不再需要它。

这对于所有被卡算力的国内互联网公司来说,是一个历史性的信号。

今晚 7 点,昇腾 CANN 会直播 DeepSeek V4 在昇腾平台的首发。DeepSeek 也说了,下半年随着华为昇腾 950 超节点批量上市,Pro 版本的价格还会大幅下调。

华为做芯片,DeepSeek 做模型,昇腾做平台。一整条国产 AI 的链路,正在慢慢跑通。

4.另一个非常值得讲的小插曲

就在V4发布的同一周,DeepSeek终于开放融资了。

这家公司成立三年,之前一直靠幻方量化养着,拒绝了所有外部资金。梁文锋说过,面临的问题从来不是钱,而是高端芯片被禁运。幻方2025年收益率56.55%,管理规模超700亿,确实不差钱。

现在,忽然开放了,50亿起投。腾讯、阿里都在等着谈

有人说是人才,比如郭达雅跳去了字节,有人说是要扩张算力规模,我也不敢乱说,大家想想是什么原因?

好了,回到正题:

想用DeepSeek V4的朋友,现在就可以登录 chat.deepseek.com 或者官方 App 体验 V4 了。

API 也同步更新了,model 参数改成 deepseek-v4-pro 或者 deepseek-v4-flash 就能调用,兼容 OpenAI 和 Anthropic 两套接口标准。

顺便提醒一下,旧的 API 接口 deepseek-chat 和 deepseek-reasoner 会在三个月后停止使用,也就是 7 月 24 号。现在这俩名字分别指向 V4-Flash 的非思考模式和思考模式。

这个是 DeepSeek 的价格,你可以自行对比一下就知道相比 ChatGPT 是便宜了多少了。

图片

开源权重在 HuggingFace 和 ModelScope 上都有。

DeepSeek-V4 技术报告:

https://huggingface.co/deepseek-ai/DeepSeek-V4-Pro/blob/main/DeepSeek_V4.pdf

最后说两句我自己的感受。

我一直觉得,AI这个行业最迷人的地方,不是技术有多酷,而是总有人愿意把最好的东西分享给所有人。

OpenAI当年也是这么起步的,虽然后来走了另一条路。Google的TensorFlow和PyTorch当年也是开源改变了一切。现在轮到DeepSeek了。

雄起,雄起!感谢梁文峰!