UC Berkeley团队打通人类视频到机器人执行链路,让机器人从“看到”走向“做到” 【导语UC Berkeley团队提出的Do as I Do方法利用单目RGB视频将日常人类操作转化为Sharpa Wave可执行轨迹补上了类人灵巧操作从视频到机器人数据的关键链路有望解决机器人学习的数据转换难题。】Do as I Do补上类人灵巧操作数据链路人类学习灵巧操作往往从“看”开始而当前机器人学习更多靠“做”如遥操作、仿真执行等。YouTube等平台已有海量人手与物体交互的素材但关键在于将单目RGB视频转化为多指灵巧手能执行的动作轨迹。UC Berkeley团队跑通了从网络视频生成真实灵巧手实机执行轨迹的完整链路。三大难题制约机器人数据规模化要实现灵巧机器人数据规模化面临三个结构性难题。一是单目RGB视频中的手 - 物交互难以稳定重建真实场景视频存在运动模糊等问题现有跟踪方法存在局限性。二是带噪声的参考轨迹会让动作重定向失效之前的方法假设输入干净数据而网络视频重建的轨迹往往不干净导致优化失败率高。三是遥操作本身难以规模化成本高且难以覆盖海量人类视频。两阶段流程解决核心问题Do as I Do流程分两个阶段。阶段一用引导式扩散稳定跟踪物体先选定锚定帧固定物体形状后续帧的流匹配去噪过程让位姿采样结果靠拢还根据2D点跟踪估计的旋转速度自适应调整位姿在人工对比评估中表现优于FoundationPose。阶段二面向带噪声参考轨迹进行稳健动作重定向在SPIDER框架基础上加入三项设计将动作重定向成功率从25%提升到71%。实验成果与数据筛选要点该方法最终覆盖20类操作动作选取10项代表性动作在双UR3e机械臂 双Sharpa Wave平台上以50Hz完成实机执行动作覆盖多种物体形状和抓握方式。同时研究团队提醒不能盲目追求视频数量给出了数据筛选要点如检查手和物体是否在画面内等这将是打通“人类视频到机器人执行”流程的基础环节。编辑观点Do as I Do方法为机器人学习开辟了新途径利用海量人类视频数据有望推动类人灵巧操作的发展。不过仍需解决一些技术难题未来发展值得期待。

相关新闻

最新新闻

Python爬虫实战:requests+BeautifulSoup抓取影视公开榜单(附代码)

Python爬虫实战:requests+BeautifulSoup抓取影视公开榜单(附代码)

Python 爬虫实战:用 requests BeautifulSoup 抓取影视公开榜单信息(附完整代码)做技术开发久了,你会发现“手动复制粘贴网页上的数据”是一件非常低效的事情。比如业务上需要定期整理一批电影的片名、年份、评分,或者…

2026/8/30 9:08:20
Python爬虫学习路线全解析:从入门到分布式实战

Python爬虫学习路线全解析:从入门到分布式实战

网络上 Python 学习资料很多,但大部分要么太理论,要么直接甩一份代码让你抄。真正适合零基础入门、又能一路走到工程化实战的路线,反而很少被讲清楚。这次我们就把“Python 网络爬虫”这条学习路径完整拆一遍:从环境配置、基础请求…

2026/8/30 9:08:20
Python入门到实践:3小时掌握基础语法、数据分析与爬虫

Python入门到实践:3小时掌握基础语法、数据分析与爬虫

很多初学者看到“3小时入门 Python”“从入门到精通”这类标题,第一反应往往是:真的可以吗?会不会看完还是不会写代码?结合个人学习经验,3 小时无法把一个人从完全零基础变成数据分析专家,但确实可以完成 P…

2026/8/30 9:08:20
Claude Code实战指南:从安装配置到科研团队Agent应用

Claude Code实战指南:从安装配置到科研团队Agent应用

最近 AI 圈和科研圈同时被一条消息击中:Claude 面向科学家推出团队计划,开放 1 万个免费席位。表面看,这是一次面向学术圈的获客活动;往深一层看,这是大模型厂商正在把 Agent 从“个人效率工具”推向“团队基础设施”的…

2026/8/30 9:08:20
健康数据AI分析系统架构:从设备采集到模型推理的完整工程方案

健康数据AI分析系统架构:从设备采集到模型推理的完整工程方案

现代智能手环、智能手表、体脂秤、血糖仪、睡眠监测仪几乎覆盖了普通人的全部健康动作:心率、步数、血氧、睡眠分期、体重、饮食记录,甚至情绪状态。这些数据过去只是散落在各厂商 App 里的曲线图,而现在,越来越多的团队正在把它们…

2026/8/30 9:08:20
ARC-AGI-3争议解析:Agent框架与自我改进的harness真相

ARC-AGI-3争议解析:Agent框架与自我改进的harness真相

最近,开源社区里关于 Agent 框架和 ARC-AGI-3 的讨论非常多。不少开发者在群里转发某个开源项目刷榜的消息,紧接着又围绕 RLM 、 harness 、 自我改进 这些词展开激烈争论:这到底是大模型能力真的变强了,还是测试方式本身为…

2026/8/30 9:03:19