惯性聚合 高效追踪和阅读你感兴趣的博客、新闻、科技资讯
阅读原文 在惯性聚合中打开

推荐订阅源

G
Google Developers Blog
博客园 - 聂微东
J
Java Code Geeks
Engineering at Meta
Engineering at Meta
Jina AI
Jina AI
D
Docker
B
Blog
S
SegmentFault 最新的问题
宝玉的分享
宝玉的分享
D
DataBreaches.Net
freeCodeCamp Programming Tutorials: Python, JavaScript, Git & More
Y
Y Combinator Blog
N
Netflix TechBlog - Medium
月光博客
月光博客
F
Fortinet All Blogs
爱范儿
爱范儿
H
Help Net Security
腾讯CDC
奇客Solidot–传递最新科技情报
奇客Solidot–传递最新科技情报
WordPress大学
WordPress大学
The Cloudflare Blog
有赞技术团队
有赞技术团队
T
Tailwind CSS Blog
U
Unit 42

雷峰网

1.8亿人在小红书读书:图书业在小红书电商营收规模年增超30% | 雷峰网 减重300kg,首搭5nm智驾芯片:2026款乐道L90正式亮相 | 雷峰网 阶跃和千⾥科技官宣战略合作:打造原⽣智驾基座模型,提升物理AI能⼒上限 | 雷峰网 “还债骑手”被强制下线240次:“开始我很反感过劳提醒,影响赚钱” | 雷峰网 石头科技:2025年营收高增56.51%,2026Q1营收增23.31% | 雷峰网 Mythos引爆攻击工业化时代,奇安信:构建三位一体内生安全体系是破解之道 | 雷峰网 曝两家科技大厂争投DeepSeek,估值飙至200亿美元;小米深夜放大招!最强大模型MiMo-V2.5系列发布;微软 Xbox 部门将裁员15% | 雷峰网 RGB-Mini LED电视普及风暴,海信正式发布小墨E5S Pro | 雷峰网 标配8255芯片与CDC,奇瑞试图终结“燃油车无智驾”时代 | 雷峰网 德赛西威也不相信,智驾能让Tier1躺着赚钱 | 雷峰网 找来刘翔做代言人,可能是智己LS8最好的一步棋 | 雷峰网 「中国版Grok上车」分水岭:阶跃交出首份量产答卷 | 雷峰网 百度Create大会双主论坛议程揭晓,多项重磅升级发布将集中亮相 | 雷峰网 泄露用户隐私!曝某AI助手将B用户简历发给A用户;苹果更换CEO原因曝光;微信宣布5国可用微信支付;航旅纵横「崩」了一天,借钱功能却正常 | 雷峰网 一季度交付1200件精益工具,希音深入技术创新提升按需时尚竞争力 | 雷峰网 从“替代”到“重构”:联想开天“1+2+N”如何重写信创AI PC逻辑? | 雷峰网 中山大学郭裕兰团队:数据充足却训练失败,多智能体到底卡在哪丨CVPR 2026 | 雷峰网 上交大 x vivo 团队:一个简单改动,让 diffusion 全面提升丨CVPR 2026 死亡率「99%」的芯片创业淘汰赛,为旌科技为何能活下来? | 雷峰网 清华段岳圻团队论文:从调参数到做控制,文生图迎来一次方法论升级丨CVPR 2026 | 雷峰网 东南大学耿新团队:模型不是不会做,而是被「挤掉了能力」丨CVPR 2026 | 雷峰网 西湖大学张驰团队:不重训,也能让视频生成更长更稳丨CVPR 2026 | 雷峰网 西湖大学张驰团队:从视觉合成到空间理解,视频 AI 正在「转向」丨CVPR 2026 | 雷峰网 21.0975 公里,是人形机器人的里程碑,也是 RISC-V 的新起点 | 雷峰网 独家 | 华为19级天才少年赵立晨离职创业,瞄准具身 Agentic OS 独家 | CMU系⼜诞⽣⼀家具⾝智能公司「Zeno AI」 | 雷峰网 Token消耗量翻10倍才算企业转型及格线?三位产业一线大佬教你用出性价比 | 雷峰网 阿里发布Qwen3.6-Max预览版,登顶最佳国产模型 | 雷峰网 郭达雅加入巨头背后:顶尖AI人才为何向大厂「回流」? | 雷峰网 解决机器人散热困境,华科冷芯高速悬浮泵液冷方案助力荣耀人形机器人“闪电”夺冠 | 雷峰网
ICRA 2026 | 新加坡国立大学提出FD-VLA:力蒸馏视觉语言动作...
2026-05-28 · via 雷峰网

论文原文链接

arXiv预印本页面:https://arxiv.org/abs/2602.02142v2

arXiv全文PDF:https://arxiv.org/pdf/2602.02142v2

DBLP页面:https://dblp.uni-trier.de/pid/00/9938.html(内含更详细的引用信息)

Semantic Scholar页面:https://www.semanticscholar.org/paper/FD-VLA:-Force-Distilled-Vision-Language-Action-for-Zhao-Wang/84496e9c36fa5b863f5702abb1dbc5560ee7db5b

原文作者:公众号“计算机顶会大全”

原文链接:https://mp.weixin.qq.com/s/SbiHonAq0qYEP-sC-sB-bA

ICRA 2026| FD-VLA: Force-Distilled Vision-Language-Action Model for Contact-Rich Manipulation

 ICRA 2026 | 新加坡国立大学提出FD-VLA:力蒸馏视觉语言动作模型,攻克接触丰富操作

过去,VLA模型主要依赖视觉和语言来完成机器人操作,但在真实场景中,很多任务并不是看见就能做好。比如插头插入、按钮按压、擦白板等接触丰富任务,真正影响成功率的是接触力、阻力变化、摩擦和细微形变。

这篇论文关注的正是VLA的力觉短板。论文提出FD-VLA,通过力蒸馏机制,让模型在训练阶段利用真实力信号学习潜在力表示;在推理阶段,则不再依赖实体力传感器,而是根据视觉观察和机器人本体状态预测力标记,并与视觉语言信息共同生成动作。这样既保留了力觉对接触操作的帮助,又降低了真实部署时对昂贵、脆弱传感器的依赖。

 ICRA 2026 | 新加坡国立大学提出FD-VLA:力蒸馏视觉语言动作模型,攻克接触丰富操作

创新点主要在于三方面:一是把力觉信息以蒸馏方式融入VLA,而不是简单拼接原始力信号;二是利用视觉和本体状态预测接触相关力表示,提升任务相关性和鲁棒性;三是在真实机器人平台上验证擦白板、按按钮、插头插入等典型接触任务。实验表明,FD-VLA整体成功率明显高于无力觉版本和直接输入原始力信号的方法,说明可学习的力表示比粗暴使用传感器数据更有效。

这篇论文的价值在于,它把VLA从看懂再行动推进到理解接触再行动。对具身智能研究来说,力觉蒸馏、触觉增强、状态建模和接触丰富操作,正在成为VLA实用化落地的重要发文切口。

雷峰网(公众号:雷峰网)