机器人数据

16 篇相关内容

ACE-Data-0 开源背后:我们和大晓机器人聊了聊具身数据的下一步

机器人看视频就能学会一切?那你就太高估它了。 比如生活中最简单的场景,从桌面拿起水杯。这件事人类几乎不需要思考;对机器人而言,却是一条由感知、移动、抓握、接触、物体状态变化和任务记忆共同组成的长链条。 视频可以告诉模型「拿起水杯」,但手指在…

上交卢策吾、浙大等团队提出 Track4Action:把「动作后的 3D 世界」蒸馏进 VLA

VLA 模型可以把图像和语言指令转换成机器人动作,训练的过程中,研究人员通常只评价机器人的动作像不像专家。至于机器人的动作会怎样改变物体、空间关系和任务状态,通常没有被明确交给模型学习。短任务可能掩盖这个缺口;一旦任务变长,或者视角、背景和…

首次!北大、南洋理工等 30 位研究者联手厘清具身数据金字塔

7 月 28 日,来自北京大学、南洋理工、港科大、新加坡国立、港大、上海交大等十余所机构的近 30 位研究者联合发布了一篇 72 页长文综述《Data Pyramid for Embodied Manipulation》。该综述通过一个五层…

0.04B 通吃异构相机,与地瓜机器人隋伟谈 X-Lens 取舍逻辑

鱼眼相机看得广但画面边缘是畸变弯曲的,针孔相机看得直但视野窄。 一台机器人身上往往同时挂着这两种相机,用于感知环境深度,而像 DAC、MapAnything 等深度估计模型,几乎没有既能同时适配好这两种相机,又能端侧跑起来的方案。 对此,地…

50 万小时第一视角视频,如何给具身世界模型补上「触觉」

一只机械手把葡萄从一串果实中摘下来,难点不在于「看见」葡萄,而在于何时接触、哪根手指承力、力道多大才不会把果肉捏坏。挤牙膏、从软袋里摸出被遮住的物品、用软笔写字,都是同一类问题:视觉能描述物体和姿态,却很难直接给出接触已经发生了没有、接下来…

不止于预测,小米将世界模型打造成数据引擎

7 月 14 日,小米放出其自研机器人在工厂中连续作业的任务视频,视频中可以看到机器人在面对不同尺寸工件依然可以长时间稳定作业。 然而,机器人在工厂里的稳定作业,只是最终呈现出来的结果。真正支撑这一结果的,是机器人背后的模型能力。模型能力决…

英伟达用 SimFoundry,打通机器人 Real2Sim 最后一公里

近年来, DexMimicGen 等自动化数据合成工具和 PolaRiS、Isaac Sim 等仿真工具为解决机器人数据与训练问题,提供了可扩展的替代方案。 但是让开发者通过「CAD 建模、提供物理约束、摆放场景」等步骤手动布置仿真环境,并…

机器人开始「吃数据」:从印度数据工厂到百亿美元人形机器人的隐秘生产链

在印度的某个服装加工厂中,工人们正在像往常一样整理布料,但这次不同的是,他们的头上多了一个摄像头,用来拍摄自己工作时的第一视角视频。 这些视频,将会在处理之后成为数据资产,出售给那些需要大量数据来训练机器人的具身智能公司。 类似的生意从今年…

VLA 终于摆脱后训练了?自变量开源 WALL-OSS-0.5,预训练完直接上真机

近年来,VLA 模型越来越强,但始终存在一个关键现实,几乎所有亮眼成绩,都依赖后训练。预训练模型本身,很少能直接部署到机器人本体上。 似乎任务微调才是那个让模型真正「干活」的东西,预训练到底有没有让机器人学会操作,离了后训练,模型还能不能直…

让机器人学会打鸡蛋、切番茄、弹钢琴,GENE-26.5 的秘密不只是在模型里

在经过一年的沉淀后,硅谷具身智能创企 Genesis AI 终于在今天带来了其首个机器人基础模型系统 GENE 26.5,在这套系统下,机器人能够自己复原魔方,还可以打鸡蛋、切番茄,展示出了不同以往的灵巧操作能力。 相较于以往许多厂商发布时…

速度提升 3 倍、成功率高达 99%,这家模型让机器人开始「精通」任务

当地时间 4 月 2 日,美国具身智能公司 Generalist AI 发布了最新的 GEN 1 模型,在一些具备商业价值的任务上平均成功率达到 99% 的同时,也将干活速度提升到了此前 SOTA 的 3 倍左右。 更重要的是,在实际应用中…

一副 200 美元手套,可能改变机器人训练方式

近日,Sunday Robotics 联合创始人兼 CTO 迟宬在 ETHZ Robot Learning 2026 上发表了公开演讲,针对机器人行业最关心的数据采集、硬件供应链等方面分享了 Sunday Robotics 的做法。 对于很…