惯性聚合 高效追踪和阅读你感兴趣的博客、新闻、科技资讯
阅读原文 在惯性聚合中打开

推荐订阅源

Engineering at Meta
Engineering at Meta
G
GRAHAM CLULEY
Attack and Defense Labs
Attack and Defense Labs
Threat Intelligence Blog | Flashpoint
Threat Intelligence Blog | Flashpoint
T
Tor Project blog
T
Threat Research - Cisco Blogs
阮一峰的网络日志
阮一峰的网络日志
H
Hackread – Cybersecurity News, Data Breaches, AI and More
Vercel News
Vercel News
Google DeepMind News
Google DeepMind News
U
Unit 42
freeCodeCamp Programming Tutorials: Python, JavaScript, Git & More
Spread Privacy
Spread Privacy
C
CXSECURITY Database RSS Feed - CXSecurity.com
量子位
T
The Blog of Author Tim Ferriss
Project Zero
Project Zero
Webroot Blog
Webroot Blog
雷峰网
雷峰网
C
Cyber Attacks, Cyber Crime and Cyber Security
Microsoft Azure Blog
Microsoft Azure Blog
Microsoft Security Blog
Microsoft Security Blog
Scott Helme
Scott Helme
T
The Exploit Database - CXSecurity.com
cs.AI updates on arXiv.org
cs.AI updates on arXiv.org
A
About on SuperTechFans
NISL@THU
NISL@THU
AWS News Blog
AWS News Blog
Security Latest
Security Latest
S
Schneier on Security
W
WeLiveSecurity
K
Kaspersky official blog
有赞技术团队
有赞技术团队
Cyberwarzone
Cyberwarzone
P
Palo Alto Networks Blog
TaoSecurity Blog
TaoSecurity Blog
G
Google Developers Blog
Exploit-DB.com RSS Feed
Exploit-DB.com RSS Feed
Schneier on Security
Schneier on Security
博客园_首页
博客园 - 司徒正美
Application and Cybersecurity Blog
Application and Cybersecurity Blog
D
Darknet – Hacking Tools, Hacker News & Cyber Security
C
Check Point Blog
www.infosecurity-magazine.com
www.infosecurity-magazine.com
Recent Commits to openclaw:main
Recent Commits to openclaw:main
cs.CV updates on arXiv.org
cs.CV updates on arXiv.org
Know Your Adversary
Know Your Adversary
P
Privacy & Cybersecurity Law Blog
Hacker News - Newest:
Hacker News - Newest: "LLM"

博客园 - iTech

AI Agent 写完代码谁来测?这个开源沙箱把 CI/CD 和多 Agent 协作全包了 7万星的AI交易框架:让大模型模拟投行多空辩论,自动做交易决策 71000颗星的AI交易团队:让大模型模拟投行分工,自动做交易决策 13400颗星的开源项目:输入一句话,AI全自动帮你做短视频 102颗星的沙盒:当AI学会自己写代码、跑测试、做部署 AI 技术日报 - 2026-05-08 29k 星的 PageIndex:不用向量数据库,靠推理就能做 RAG 每天花两小时刷信息?这个开源项目帮你全自动搞定 读源码像读小说?试了 DeepWiki 和 Zread,我再也不想裸读 GitHub 了 Matt Pocock 开源的这套 .claude 技能,为什么让工程师集体上头? Cursor Team Kit:Cursor 官方团队在用的 17 个 AI 工作流 AI 技术日报 - 2026-05-07 AI 技术日报 - 2026-05-06 AI 技术日报 - 2026-05-05 Anthropic CEO 说 12 个月内程序员要失业,我扒完他的底牌,发现事情没那么简单 把工程师的肌肉记忆装进 Claude Code,这个 4300 Star 的项目我后悔没早用 AI 技术日报 - 2026-05-04 AI 技术日报 - 2026-05-03 AI 技术日报 - 2026-05-02 六大 Agent 框架横评:谁支持 Skills?谁能自动创建 Agent?MCP 呢? Wechatsync:一个 Chrome 插件,一键把文章同步到 31 个平台 LangChain 开源了 Open SWE:Stripe、Ramp、Coinbase 内部都在造的编程 Agent Cockpit:把 Claude Code 从终端里搬出来,装进浏览器 Cursor 把自家的 AI Agent 开放了:写几行 TypeScript 就能调 Cursor 干活 AI 技术日报 - 2026-05-01 AI 写代码每次结果都不一样?Archon 用 YAML 工作流把 AI 编程变成流水线 AI 写代码比你快了,但你还是得学编程——只不过学法得换 腾讯的龙虾特工队:4 个 AI Agent 同日更新,全家桶正式成型 Agno 不做更聪明的 Agent,它要把所有 Agent 框架包进同一个操作系统 Hermes Agent 终于有了像样的 Web 界面,而且还支持远程访问 Datawhale 出了一套 29 学科知识地图,把 AI 的底牌全掀了 Hermes Agent 在聊天框里就能用的 20 种高级功能 一份 AGENTS.md 能顶一次模型升级?Augment Code 用数据说了算 NVIDIA 开源了一个「AI 沙箱」,20K Star,让 Agent 跑代码不再裸奔 60ms 冷启动、5MB 内存:腾讯开源的这个沙箱让 Docker 安全隔离像笑话 AI 技术日报 - 2026-04-30 AI 技术日报 - 2026-04-29 AI 技术日报 - 2026-04-28 Goose:Linux 基金会亲儿子,能撼动 Claude Code 和 OpenCode 吗? AI 技术日报 - 2026-04-27 AI 技术日报 - 2026-04-26 Google 把价值20美元/月的东西免费了,102K人已经抢到了 OpenClaw 和 Claude Code 网络搜索配置指南 AI 技术日报 - 2026-04-25 Anthropic 为什么遥遥领先:从 Cat Wu 专访看AI霸主的底层逻辑 Mac 本地跑大模型完全指南:你的苹果电脑就是 AI 工作站 同样 70B 参数,为什么 MoE 只激活 13B 就能打平 Dense? DeepSeek-V4 技术报告里藏着一条线:华为昇腾 NPU 已完成推理验证 MacBook Air 跑大模型实测:Ollama、llama.cpp、LM Studio 谁才是本地推理之王? AI 技术日报 - 2026-04-24 OpenCode:Claude Code 的最佳平替 2026 开源大模型五国杀:Qwen 3.6 vs Gemma 4 vs Llama 4 vs GLM-5.1 vs DeepSeek V4 MCP 与 Skills 的你死我活:Anthropic 的 Agent 生态野心与开发者的站队困境 给 AI Agent 配搜索,国内能用的搜索 API 实测对比 AI 技术日报 - 2026-04-23 CC Switch:49K Star 的 Claude Code 登录绕过神器,还能管 Codex 和 Gemini CLI NVIDIA 开出 32 万美元年薪招 AI Agent 工程师,JD 里藏着这些信号 fast-mirror-skill 技术拆解:一个小而完整的 Claude Skill 是怎么设计的 Cursor 值 600 亿美元?马斯克这次赌的不是技术,是入口 AI 技术日报 - 2026-04-22 别再问 AI 能不能赚钱了:3 个上班族亲测有效的副业方法(2026 最新版) 10 分钟从零搞定 Hermes Agent:飞书微信双通道丝滑上线 AI 技术日报 - 2026-04-21 Anthropic 实战总结:AI Agent 的 3 种工作流模式,选错代价很大 安装 openclaw,hermes 慢的想发疯,fast-mirror-skill 来救了 Claude Routines:你下班睡觉了,Agent 还在为你干活 微信飞书里敲一个斜杠就能干活:Hermes Quick Command 到底多省事 AI 正在疯狂吃电:算力尽头是电力,谁能解这道题? AI 技术日报 - 2026-04-20 3K 行代码造一个越用越聪明的 AI Agent:GenericAgent 登顶 GitHub Trending 高德途途封神机器人半马,背后的 ABot-Claw 到底是什么 人们希望 AI 能干啥?Anthropic 调查:第一名不是赚钱,是变强 AI 时代人们在担心什么?Anthropic 的 13 条焦虑排行榜 OpenAI 官方 Agent SDK 来了:22k Star,支持 100+ 模型,Python 10 行代码上手 AI 技术日报 - 2026-04-19 OpenAgents Workspace:让 Claude Code 和 Codex 在同一个群里干活 Claude 是要干掉整个软件行业吗? Claude 官方推荐多 Agents 设计模式 多 Agent 系统的 5 种协调模式:选错了模式,再强的 Agent 也白搭 AI 技术日报 - 2026-04-18 AI 技术日报 - 2026-04-17 Better-Harness:让AI Agent自己优化自己的革命性框架 OpenClaw Workspace 完全指南:我的AI编程工作流 DeepSeek内蒙草原高薪招聘:AI时代的数字牧民梦,还是营销噱头? 2 核 2G 的阿里云 ECS 能跑 OpenClaw 吗?能,但有点折腾 AI 技术日报 - 2026-04-16 OpenCLI:一个命令行搞定 16+ 内容平台的神器 从零到精通:OpenClaw CLI 命令完全指南 AI 技术日报 - 2026-04-15 AI Agent 如何自我进化?Hermes Agent Self-Evolution 深度解析 AI 技术日报 - 2026-04-14 为什么你的飞书 Bot 总是连不上?OpenClaw Gateway 架构深度解析 OpenClaw 连接飞书的原理:Gateway、Channel 与消息流转 国内安装 Hermes Agent 踩坑全记录:从 GitHub 超时到正常跑起来的每一步 35 万 Star 的 OpenClaw:5 分钟部署你的私人 AI 助手,直连飞书 AI 技术日报 - 2026-04-13 公司用 AI 筛简历,这个开源项目让候选人用 AI 反选公司 为什么 Google ADK 可能是你下一个 Agent 框架——7 个改变游戏规则的特性 Microsoft Agent Framework 深度解析:架构设计与实战落地 AI 技术日报 - 2026-04-11
DeepSeek-V4 深夜炸场:1M 上下文、384K 输出、双模型,API 定价直接卷到底
iTech · 2026-04-24 · via 博客园 - iTech

一觉醒来,大模型又变天了

2026年4月24日,DeepSeek 官方公众号深夜推送了一篇文章——DeepSeek-V4 预览版正式上线

没有提前预热,没有发布会,没有大佬站台。就一个公众号推文,一个 API 文档更新。但就这么一个"低调"的发布,信息量直接炸裂。

让我们先把硬数据列出来,再聊它到底意味着什么。

硬核参数:每一条都在重新定义行业标准

DeepSeek 这次直接上了两个版本

DeepSeek-V4-Flash DeepSeek-V4-Pro
上下文长度 1M tokens 1M tokens
最大输出 384K tokens 384K tokens
思考模式 ✅(默认开启) ✅(默认开启)
JSON Output
Tool Calls
Chat Prefix Completion ✅(Beta) ✅(Beta)
FIM Completion ✅(Beta,仅非思考模式) ✅(Beta,仅非思考模式)
API 兼容 OpenAI + Anthropic 格式 OpenAI + Anthropic 格式

几个关键点拎出来单独说:

1M 上下文——一百万 tokens。这意味着你可以把整本《红楼梦》塞进去,还有大把余量。长文档处理、代码库分析、多轮对话……之前的瓶颈直接消失了。

384K 最大输出——这个数字比很多模型的总上下文都长。一次输出能写一本中篇小说。对批量文档处理、长代码生成场景来说,这是质的飞跃。

双模型策略——Flash 走性价比路线,Pro 走旗舰路线。简单任务用 Flash,复杂推理用 Pro。像不像手机芯片的标准版和 Pro 版?但这是在大模型领域第一次这么明确地做产品分层。

定价:Flash 继续屠夫价,Pro 贵得有道理

V4-Flash V4-Pro 对比 GPT-4o
输入(缓存命中) $0.028/M $0.145/M ~$1.25/M
输入(缓存未命中) $0.14/M $1.74/M ~$2.50/M
输出 $0.28/M $3.48/M ~$10/M

Flash 的价格……我反复确认了三遍。

每百万 tokens 输入 $0.14,输出 $0.28。缓存命中更是只要 $0.028。

换算一下:用 Flash 处理一篇 10 万字的文章,大概花不到 1 分钱。这个价格已经低于很多开发者对"白菜价"的想象了。

Pro 虽然看起来贵不少(输出 $3.48/M),但考虑到 1M 上下文 + 384K 输出 + 思考模式的能力密度,对标的是 Claude Opus / GPT-4o 这个级别——但价格依然低了一个量级。

技术细节:从 DeepSeek 的技术基因说起

虽然这次预览版还没放出技术报告,但基于 DeepSeek 一贯的技术路线,我们可以合理推测:

MoE(混合专家)架构大概率延续并进化。 从 V2 到 V3,DeepSeek 的 MoE 架构已经非常成熟。V4 在这个基础上继续优化毫不意外——更高效的专家路由、更低的激活参数比,意味着更强的能力、更低的推理成本。

MLA(多头潜在注意力)应该全面应用。 这是 DeepSeek 的招牌技术,通过将 KV Cache 压缩到低维空间,大幅降低显存占用。1M 上下文能在合理成本下实现,MLA 功不可没。

训练效率持续拉满。 DeepSeek 团队开源的 DeepGEMM(FP8 GEMM 内核)、FlashMLA、DeepEP(专家并行通信库)等基础设施,一直在为自家的模型训练和推理铺路。V4 大概率也是这一整套高效训练栈的产物。

原生支持 Anthropic API 格式是个信号——DeepSeek 在积极争夺 Claude 用户。迁移成本几乎为零,换一下模型名就行。

API 迁移:老用户要注意

官方明确说:

deepseek-chatdeepseek-reasoner 将在未来弃用。当前为了兼容性,它们分别对应 deepseek-v4-flash 的非思考模式和思考模式。

也就是说,如果你现在用的是 deepseek-chat,已经在悄悄用 V4-Flash 了。

新项目建议直接用 deepseek-v4-flashdeepseek-v4-pro,别再依赖旧名称。

这对行业意味着什么

对开发者:Flash 的价格让"AI-native"应用的算力成本几乎可以忽略不计。之前因为 token 费用不敢做的功能——实时文档分析、全代码库索引、超长对话——现在可以放开手脚了。

对竞争对手:压力山大。1M 上下文 + 384K 输出 + Flash 级定价,这是一个几乎不可能三角的组合。OpenAI、Anthropic、Google 的产品经理今晚大概睡不好了。

对开源生态:DeepSeek 一贯的开源策略(V2/V3/R1 都开源了权重),让社区对 V4 的开源充满期待。如果 V4 也开源,那对整个开源大模型生态又是一针强心剂。

对"国产大模型"叙事:DeepSeek 再次证明,中国团队能做出世界顶级的大模型。而且不是靠堆资源,是靠架构创新和工程效率。从 V2 的 MLA 到 V3 的 MoE 到 V4 的双模型分层,每一步都有明确的技术思考在里面。

写在最后

从 DeepSeek-V2 开始惊艳业界,到 V3 开源引爆全球开发者社区,再到 R1 证明推理能力可以和 OpenAI 掰手腕——DeepSeek 的每一步都在重新定义"性价比"的边界。

现在 V4 来了。1M 上下文、384K 输出、Flash/Pro 双模型、史上最低的 API 定价。

这不是什么"小步迭代"。这是又一次的跨越。

模型能力没有天花板,价格也没有地板。这场游戏的节奏,被 DeepSeek 又加快了一拍。

——来自公众号:人生几十年噢耶