惯性聚合 高效追踪和阅读你感兴趣的博客、新闻、科技资讯
阅读原文 在惯性聚合中打开

推荐订阅源

量子位
雷峰网
雷峰网
博客园 - 三生石上(FineUI控件)
月光博客
月光博客
有赞技术团队
有赞技术团队
阮一峰的网络日志
阮一峰的网络日志
Last Week in AI
Last Week in AI
G
Google Developers Blog
腾讯CDC
B
Blog
Microsoft Azure Blog
Microsoft Azure Blog
酷 壳 – CoolShell
酷 壳 – CoolShell
Microsoft Security Blog
Microsoft Security Blog
人人都是产品经理
人人都是产品经理
博客园_首页
T
Tailwind CSS Blog
C
Check Point Blog
博客园 - 【当耐特】
MongoDB | Blog
MongoDB | Blog
A
About on SuperTechFans
Y
Y Combinator Blog
L
LangChain Blog
Engineering at Meta
Engineering at Meta
GbyAI
GbyAI

雷峰网

1.8亿人在小红书读书:图书业在小红书电商营收规模年增超30% | 雷峰网 减重300kg,首搭5nm智驾芯片:2026款乐道L90正式亮相 | 雷峰网 阶跃和千⾥科技官宣战略合作:打造原⽣智驾基座模型,提升物理AI能⼒上限 | 雷峰网 “还债骑手”被强制下线240次:“开始我很反感过劳提醒,影响赚钱” | 雷峰网 石头科技:2025年营收高增56.51%,2026Q1营收增23.31% | 雷峰网 Mythos引爆攻击工业化时代,奇安信:构建三位一体内生安全体系是破解之道 | 雷峰网 曝两家科技大厂争投DeepSeek,估值飙至200亿美元;小米深夜放大招!最强大模型MiMo-V2.5系列发布;微软 Xbox 部门将裁员15% | 雷峰网 RGB-Mini LED电视普及风暴,海信正式发布小墨E5S Pro | 雷峰网 标配8255芯片与CDC,奇瑞试图终结“燃油车无智驾”时代 | 雷峰网 德赛西威也不相信,智驾能让Tier1躺着赚钱 | 雷峰网 找来刘翔做代言人,可能是智己LS8最好的一步棋 | 雷峰网 「中国版Grok上车」分水岭:阶跃交出首份量产答卷 | 雷峰网 百度Create大会双主论坛议程揭晓,多项重磅升级发布将集中亮相 | 雷峰网 泄露用户隐私!曝某AI助手将B用户简历发给A用户;苹果更换CEO原因曝光;微信宣布5国可用微信支付;航旅纵横「崩」了一天,借钱功能却正常 | 雷峰网 一季度交付1200件精益工具,希音深入技术创新提升按需时尚竞争力 | 雷峰网 从“替代”到“重构”:联想开天“1+2+N”如何重写信创AI PC逻辑? | 雷峰网 中山大学郭裕兰团队:数据充足却训练失败,多智能体到底卡在哪丨CVPR 2026 | 雷峰网 上交大 x vivo 团队:一个简单改动,让 diffusion 全面提升丨CVPR 2026 死亡率「99%」的芯片创业淘汰赛,为旌科技为何能活下来? | 雷峰网 清华段岳圻团队论文:从调参数到做控制,文生图迎来一次方法论升级丨CVPR 2026 | 雷峰网 东南大学耿新团队:模型不是不会做,而是被「挤掉了能力」丨CVPR 2026 | 雷峰网 西湖大学张驰团队:不重训,也能让视频生成更长更稳丨CVPR 2026 | 雷峰网 西湖大学张驰团队:从视觉合成到空间理解,视频 AI 正在「转向」丨CVPR 2026 | 雷峰网 21.0975 公里,是人形机器人的里程碑,也是 RISC-V 的新起点 | 雷峰网 独家 | 华为19级天才少年赵立晨离职创业,瞄准具身 Agentic OS 独家 | CMU系⼜诞⽣⼀家具⾝智能公司「Zeno AI」 | 雷峰网 Token消耗量翻10倍才算企业转型及格线?三位产业一线大佬教你用出性价比 | 雷峰网 阿里发布Qwen3.6-Max预览版,登顶最佳国产模型 | 雷峰网 郭达雅加入巨头背后:顶尖AI人才为何向大厂「回流」? | 雷峰网 解决机器人散热困境,华科冷芯高速悬浮泵液冷方案助力荣耀人形机器人“闪电”夺冠 | 雷峰网
ICRA 2026|KAN We Flow?(机器人控制) | 雷峰网
2026-05-29 · via 雷峰网

原文作者:用户“多多的贾维斯”

原文链接:https://www.xiaohongshu.com/

KAN We Flow? Advancing Robotic Manipulation with 3D Flow Matching via KAN & RWKV

ICRA 2026|KAN We Flow?(机器人控制)

一、整体概述

1. 本文提出KAN-We-Flow,一种用于机器人三维操作的高效流匹配策略模型。

2. 核心贡献在于用RWKV与KAN替代传统大规模UNet骨干,在保持甚至提升成功率的同时,大幅降低参数量与推理延迟。

3. 方法在Adroit、Meta-World、DexArt三大基准上取得当前最优或并列最优性能,参数量减少约86.8%,支持实时控制。

ICRA 2026|KAN We Flow?(机器人控制)

二、研究背景

1、扩散式策略

① 优点是动作分布建模能力强

② 缺点是需要多步去噪,推理慢、模型重,不利于真实机器人部署

2、流匹配策略

① 通过学习一步向量场实现快速生成

② 但现有方法仍大量依赖UNet,计算与存储开销依旧偏大

3、核心问题

如何在保证精度的前提下,进一步压缩模型规模并提升实时性

ICRA 2026|KAN We Flow?(机器人控制)

三、动机直觉

1、RWKV具备线性复杂度的时序建模能力,适合长时序动作预测

2、KAN基于可学习的一维函数逼近,能以更少参数表达复杂非线性映射

3、将二者结合,有望同时解决“长时序依赖”和“参数效率”问题

ICRA 2026|KAN We Flow?(机器人控制)

四、技术路线

1、整体框架

① 采用一致性流匹配,实现一步动作生成

② 输入为点云感知、机器人状态与时间编码

2、核心网络

① RWKV-KAN骨干网络

* RWKV负责时间与通道混合,建模动作序列上下文

* GroupKAN对特征通道进行分组的非线性函数校准,替代传统MLP

② Action Consistency Regularization(ACR)

* 通过欧拉外推,将一步预测动作与专家轨迹在末端对齐

* 提供额外监督,稳定训练,不增加推理成本

3、学习目标

联合一致性流匹配损失与ACR正则项进行端到端训练

ICRA 2026|KAN We Flow?(机器人控制)

五、实验结果

1、性能表现

① 在Adroit、Meta-World、DexArt上整体成功率优于FlowPolicy与DP3

② 在高难度、长时序任务中优势更明显

2、效率对比

① 参数量约33.6M,相比DP3减少86.8%

② 推理时间约8–11ms,满足100Hz实时控制

3、消融实验

① RWKV、GroupKAN与ACR均对性能有稳定增益

② ACR在长预测窗口下显著降低动作漂移

雷峰网(公众号:雷峰网)