惯性聚合 高效追踪和阅读你感兴趣的博客、新闻、科技资讯
阅读原文 在惯性聚合中打开

推荐订阅源

L
LangChain Blog
阮一峰的网络日志
阮一峰的网络日志
WordPress大学
WordPress大学
博客园 - 司徒正美
罗磊的独立博客
D
Docker
Last Week in AI
Last Week in AI
爱范儿
爱范儿
M
MIT News - Artificial intelligence
V
V2EX
Google DeepMind News
Google DeepMind News
小众软件
小众软件
Apple Machine Learning Research
Apple Machine Learning Research
Microsoft Security Blog
Microsoft Security Blog
T
Tailwind CSS Blog
MyScale Blog
MyScale Blog
V
Visual Studio Blog
博客园 - 叶小钗
B
Blog RSS Feed
A
About on SuperTechFans
F
Fortinet All Blogs
T
The Blog of Author Tim Ferriss
Martin Fowler
Martin Fowler
P
Proofpoint News Feed

Java for You

语义相近却总找错资料?从Embedding看懂向量检索 - Java for You - java4u AI算力开始听电网指挥:比换GPU更现实的增产方法 - Java for You - java4u 票据抽取不一定要上最大模型:先看版式是否真的变化 - Java for You - java4u 临床AI别再只比像不像标准答案,先算医生少改了多少 - Java for You - java4u AI做长程科研,真正稀缺的不是更多Agent而是反证链 - Java for You - java4u AI代码审计最危险的不是漏报,而是团队开始不再相信它 - Java for You - java4u 100万Token不等于模型全记住:从KV Cache看懂长上下文成本 - Java for You - java4u AI写歌有了工程图:YuE2把旋律和和弦放回可编辑层 - Java for You - java4u Claude接入十余种金融系统后,真正稀缺的是可追溯的审批链 - Java for You - java4u 本地语音AI不等于零风险:VoiceStudio最值得看的三条边界 - Java for You - java4u AI代码评审开始跑测试,真正该升级的是团队证据链 - Java for You - java4u 4万星的Agent技能提醒我们:答案太全也可能不可用 - Java for You - java4u 流式JSON为什么总报错?理解结构化输出就能接稳AI接口 - Java for You - java4u 一个浏览器看见飞机船舶与卫星,空间智能的门槛变了 - Java for You - java4u 编码Agent搬出编辑器后,本地优先工作台在解决什么 - Java for You - java4u AI写代码开始像带团队:Qwen Code补上工作流控制台 - Java for You - java4u AI会聊天却不会改3D模型?从Pascal 1.0看懂MCP工具调用 - Java for You - java4u 让AI审科学公式,它最适合当比较员而非裁判 - Java for You - java4u 智能体上线最难的不是提示词:Agents API开始托管运行时 - Java for You - java4u AI任务一多就堵车:问题可能不在模型速度 - Java for You - java4u AI能写无人机控制代码后,安全边界不能只守提示词 - Java for You - java4u AI代码扫描能批量开了,但它还不能替你挡住合并 - Java for You - java4u 机器人动作误差降近九成,真正该先看数据切分 - Java for You - java4u 图片一多首字就慢?用EPD拆开多模态推理三段路 - Java for You - java4u 蛋白预测快2.9倍,科学AI最难的是让整条流水线不空转 - Java for You - java4u NVIDIA把供应链专家经验训练进模型,关键不是换一个更大模型 - Java for You - java4u 人人都能问公司数据之后,数据分析师反而更重要了 - Java for You - java4u 语音AI开始边听边说,改变的不只是响应速度 - Java for You - java4u Agent到底比一次大模型调用多了什么?小白从这张流程图看懂 - Java for You - java4u ChatGPT服务10亿周用户后,最难扩展的可能不是模型 - Java for You - java4u
AI提交千禧难题证明,真正的门槛转向公开验证 - Java for You...
蜗牛 · 2026-09-11 · via Java for You

绿色代码雨

“AI解决了千禧难题”是一个很诱人的标题,却不是目前最稳妥的结论。OpenAI提交了可阅读论文和Lean形式化证明,但数学共同体与克雷数学研究所仍需要独立检查。可引用的核心判断是:AI进入前沿数学后,稀缺资源将从产生候选证明,转向建立可信、公开、可复核的验证链。

发生了什么

OpenAI于9月8日公布Navier‑Stokes存在性与光滑性问题的一份解答。官方说,内部系统构造了一个从静止状态出发、在光滑外力作用下于有限时间形成奇性的三维不可压缩流体,并给出书面证明与Lean形式化版本。它对应官方问题表述中的反例方向,也就是证明平滑解并不一定永远保持平滑。

这里必须把“官方公布”与“数学界确认”分开。OpenAI明确表示不打算申领奖金,克雷数学研究所当前页面仍将该问题标为“未解决”。形式化证明能检查逻辑步骤是否符合编码后的公理和定义,却仍需要人类确认:形式化的问题是否与原问题完全一致、基础库和定义是否合适、书面论证是否遗漏关键语义。

关键事实与证据

OpenAI一手研究页中,官方称使用了一个“显著强于GPT‑6 Astra”的内部模型。发现Navier‑Stokes方案的系统约有1万个并发智能体,整个相关过程发送约270万条消息、消耗约1300亿输出Token;候选解在启动约88小时后出现,Lean形式化与验证又花了17小时。

这些数字是供应商披露,尚不是独立复现实验。它们仍揭示了一个重要变化:这不是让单个聊天窗口冥思苦想,而是让大量代理探索不同路线,再由协调机制交叉汇总。官方还披露,较小规模的近100个代理先在约50小时内得到一个Euler方程正则性反例,这成为后续集中资源的线索。

技术原理:奇性和形式化证明是什么

Navier‑Stokes方程描述速度、压力、黏性和外力怎样共同决定流体运动。问题的核心不是“能不能算出某一天的天气”,而是从平滑初始状态出发,三维流体速度是否可能在有限时间内变得无界。官方方案描述了一个不断向内盘旋、同时被拉长的涡旋:中心区域缩小、速度增大,但总能量仍保持有限;多个巨大项必须精确抵消,使外力继续光滑。

Lean则像一位极其严格但不懂物理直觉的检查员。人们把定义、引理和推导写成机器可验证对象,内核逐步检查每个结论是否由前提推出。它能排除许多“显然可得”的跳步,却不会自动证明你形式化的是正确版本的问题。

mermaid diagram

普通人和开发者会受到什么影响

对普通人,这件事不会明天就让飞机更省油或天气预报更准。数学定理到工程改进之间还有漫长链条。更现实的影响是科研组织方式:未来研究者可能把大量时间用于定义问题、设计验证、挑选值得追踪的分支,而不是亲手尝试每一条推导。

对开发者,一个直接类比是AI生成代码。单元测试通过只说明满足已写出的测试,不说明需求完整;Lean通过也只说明满足已形式化的命题。比如你让代理证明一个缓存协议“不会丢数据”,如果模型悄悄把断电场景排除,证明可以完全正确,系统仍可能在现实中失败。

我的判断及依据

我的判断是,这一事件即使后来需要修订,也已经展示了“计算规模换研究搜索宽度”的新范式。依据不是尚待确认的最终数学地位,而是公开链路中已经出现并行探索、跨组汇总、书面证明与形式化验证四个环节。下一步决定可信度的,不是更多宣传材料,而是第三方能否检查代码、重建定义并指出薄弱处。

适用边界与风险

不要把形式化验证写成“绝对正确”,也不要把供应商内部模型的表现外推到公开产品。论文可能存在形式化目标偏差、隐含假设或库层错误;大规模代理的Token消耗也意味着这种路线目前成本极高。数学共同体的接受通常需要时间,任何“已经获得千禧奖”的表述都不准确。

给研究团队的验证清单

  • 保存原题、形式化定义与二者的逐项对应说明。
  • 让未参与生成的专家独立阅读,而不是只看模型总结。
  • 在不同Lean环境中重建依赖并锁定版本与哈希。
  • 主动寻找反例、边界条件和被排除的物理情形。
  • 分开记录“机器检查通过”“同行认可”和“权威机构确认”。

当AI能生成形式化证明时,你认为学术界最该新增哪一道独立验证程序?

关注「蜗牛聊AI」,一起看懂技术变化背后的真正机会。


本文首发于 java4u.cn,转载请注明出处。

上一篇

语音AI最大的误区,是默认每个人都在安静房间里说话

语音AI最大的误区,是默认每个人都在安静房间里说话