惯性聚合 高效追踪和阅读你感兴趣的博客、新闻、科技资讯
阅读原文 在惯性聚合中打开

推荐订阅源

罗磊的独立博客
美团技术团队
Apple Machine Learning Research
Apple Machine Learning Research
Hugging Face - Blog
Hugging Face - Blog
让小产品的独立变现更简单 - ezindie.com
让小产品的独立变现更简单 - ezindie.com
月光博客
月光博客
WordPress大学
WordPress大学
The Cloudflare Blog
阮一峰的网络日志
阮一峰的网络日志
freeCodeCamp Programming Tutorials: Python, JavaScript, Git & More
博客园_首页
博客园 - Franky
博客园 - 司徒正美
酷 壳 – CoolShell
酷 壳 – CoolShell
爱范儿
爱范儿
Jina AI
Jina AI
Last Week in AI
Last Week in AI
雷峰网
雷峰网
IT之家
IT之家
OSCHINA 社区最新新闻
OSCHINA 社区最新新闻
博客园 - 聂微东
小众软件
小众软件
奇客Solidot–传递最新科技情报
奇客Solidot–传递最新科技情报
V
V2EX

Java for You

《Java核心技术卷 2 高级特性》.PDF - Java for You - java4u 2.8万亿参数上云之后,Kimi K3的门槛变低了吗 - Java for You - java4u 平均延迟很快用户还在卡?用AIPerf看懂P99尾延迟 - Java for You - java4u AI越懂你越好吗?五天实验给出一个不舒服的答案 - Java for You - java4u Agent会互相调用了,但A2A 1.0真正解决的是协作边界 - Java for You - java4u AI给面试打分不够,求职者更需要可核对的证据 - Java for You - java4u AI写了80万行Rust,最值得学的却是它花十倍精力读代码 - Java for You - java4u 部署大模型别先选GPU,先回答你愿意承担多少运维 - Java for You - java4u 语音AI为什么总抢话?用VAD和打断机制做对实时对话 - Java for You - java4u AI每次提交都查漏洞,真正的升级是把证明链放进评审 - Java for You - java4u 把评测员请进AI实验室,独立性反而更难证明了 - Java for You - java4u 《深入分析Java Web技术内幕》.pdf - Java for You - java4u 《JAVA网络编程》.pdf - Java for You - java4u 《Java 工程师成神之路》.pdf - Java for You - java4u Copilot开始统计“真正用过什么”:AI落地终于不只看活跃人数 - Java for You - java4u 多Agent最怕的不是答错,而是崩溃后不知道做到哪一步 - Java for You - java4u Claude放宽生命科学限制:代价是验证、分级和30天留存 - Java for You - java4u Anthropic公开内部AI研发速度:真正该盯的是三个分母 - Java for You - java4u 4 bit模型为何不等于显存缩小四倍?量化账单这样算 - Java for You - java4u GPU抢不到就换一种:训练任务需要先声明可替代性 - Java for You - java4u Agent不是多想几步就能上线:用状态机管住自动行动 - Java for You - java4u 数据不能集中,算力也不统一:联邦学习终于面对运维现实 - Java for You - java4u OpenAI开始公开模型失配个案:真正重要的是这套报告制度 - Java for You - java4u 广告开始和你对话:Sponsored Agents改变的不是文案 - Java for You - java4u 语义相近却总找错资料?从Embedding看懂向量检索 - Java for You - java4u AI算力开始听电网指挥:比换GPU更现实的增产方法 - Java for You - java4u 票据抽取不一定要上最大模型:先看版式是否真的变化 - Java for You - java4u 临床AI别再只比像不像标准答案,先算医生少改了多少 - Java for You - java4u AI做长程科研,真正稀缺的不是更多Agent而是反证链 - Java for You - java4u AI代码审计最危险的不是漏报,而是团队开始不再相信它 - Java for You - java4u
NVIDIA把老师傅的判断变成了训练数据 - Java for You - java4u
蜗牛 · 2026-09-11 · via Java for You

电路板特写

企业最难复制的往往不是数据库,而是老师傅在邮件、天气、供应商语气和历史经验之间做出的判断。可引用的核心判断是:企业AI真正稀缺的数据,不只是“最后选了什么”,而是决策当时看到了什么、为何修改、后来结果怎样。NVIDIA与Palantir公开的供应链案例,把这条经验做成了一套可追溯训练闭环。

发生了什么

NVIDIA需要每周决定把短缺的GPU、CPU、HBM和其他组件分配到哪些制造地点。cuOpt先把问题写成混合整数线性规划,在产能、物料到货、客户承诺等约束下,最小化物料在厂停留的Time of Ownership。

但历史回测显示,人类规划师经常胜过纯数学模型,因为他们还掌握供应商邮件、天气、地缘事件和电话纪要。于是NVIDIA与Palantir把分配决定、理由、预期和真实产出统一写入Ontology,再用这些记录后训练一个开放权重的Nemotron 3.5 Lightning模型,为规划师提供建议。

关键事实与证据

NVIDIA技术文章,所用模型约300亿参数,每次前向激活约30亿参数;训练通过LoRA只更新少量适配参数。官方称一次训练在两张B200上用数分钟完成。

在团队自建的开发集上,微调后模型的分配决策准确率为86.7%,高于Nemotron 3 Ultra的55.5%和未微调基座的17.5%。更值得看的是平衡准确率58.6%和Macro-F1 57.5%,远低于普通准确率,说明类别不均衡且少数决策仍难。官方也明确说,未来生产风险预测依然困难;这些内部成绩没有给出独立审计,不能外推成供应链整体效率提升。

技术原理:让每次决策都能回到当时

这套系统有两条互补链路。cuOpt处理能写成约束和目标函数的部分,给出分配方案与当前“卡脖子”约束;小模型处理非结构化证据和专家策略,给出建议范围、理由与风险。人仍做最终决定。

训练前先匿名化敏感字段,用合成数据补齐少见的增配、减配和中断场景,再做LoRA微调。评估采用时间点回放:只向模型展示那一天已经知道的信息,隐藏后来结果。这避免把未来信息泄漏进测试,也回答了更有业务意义的问题——如果模型当时已上线,它会不会作出正确建议。

mermaid diagram

一个具体场景

假设两家工厂都缺HBM。优化器按公开产能把更多物料给A厂;资深规划师却知道台风可能影响A厂物流,而且B厂刚在会议里承诺新增班次。传统系统只记录“改给B厂”,模型以后看不懂原因。若系统同时保存当时的天气预报、供应商纪要、人工修改和两周后的产出,就能形成一条可复核样本。

这不是把直觉神秘化,而是把直觉拆成证据与结果。模型学到的是受限决策策略,人也能反查建议依赖了哪条信息。

对岗位和开发者的影响

对业务专家,工作重点会从重复重建背景,转向解释例外、校正建议和定义风险边界。对数据与AI团队,任务不再只是接表训练,而是设计决策对象、时间点快照、反馈字段和权限链。最稀缺的新角色,可能是懂业务又能把“为什么”变成结构化记录的人。

这个案例也提醒开发者,小模型是否够用要看任务边界。明确的输入、有限的动作空间和稳定的评分规则,往往比盲目升级通用大模型更重要。

我的判断及依据

我的判断是,未来两年企业AI的分水岭会是“有没有高质量决策日志”,而不是“买了哪个模型”。依据是,案例中的通用大模型已经能读文本,却输给了经过领域记录微调的小模型;同时,普通准确率与Macro-F1差距又暴露出数据分布和少数场景的重要性。

适用边界与风险

这是NVIDIA与Palantir的自述案例,数据规模、样本划分和线上收益披露有限。历史决策也可能包含旧偏见;把专家选择当标签并不等于它总是正确。合成数据可能放大人为假设。反馈必须经过批次审核后再训练,不能让模型在生产环境里根据每次点击自动改写自己。

今天就能建立的决策日志

  • 为一个高频决策记录时间、可见证据、可选动作、人工选择和理由。
  • 延迟补录真实结果,并标明结果受到哪些外部因素影响。
  • 回测时严格按时间切分,禁止使用决策日之后的信息。
  • 同时看Macro-F1、少数类召回和高损失错误,不只看总体准确率。
  • 先做只读建议和人工否决,再讨论自动执行。

你所在团队有哪些关键判断只存在于少数人的经验里,却从未连同依据和结果被系统记录?

关注「蜗牛聊AI」,一起看懂技术变化背后的真正机会。