
泛化能力
共 31 篇相关内容

模型之外,Ego2Robot 让数据处理管线当回主角
一台机器人在固定桌面上完成任务,和换了桌布、改了光照、挪了相机位置之后仍然做对,是两种完全不同的能力。前者说明策略已经收敛,后者才决定它能不能走出实验室。 众所周知,机器人遥操作天然比人类中心视频慢、贵。而此前工作仅在小规模单任务上验证过「…

星海图赵行:机器人的下一次 Scaling,不只发生在预训练
机器人抓起一个商品,只能说明它会做一个动作。展台上的机器人完成一次抓取,与它进入前置仓持续接单、拣选和打包,是两种不同的考验。 前者可以被压缩成一条成功轨迹,后者却要求机器人理解订单、定位货架、自主导航、处理随机摆放的商品,还要在多机协同时…

0.04B 通吃异构相机,与地瓜机器人隋伟谈 X-Lens 取舍逻辑
鱼眼相机看得广但画面边缘是畸变弯曲的,针孔相机看得直但视野窄。 一台机器人身上往往同时挂着这两种相机,用于感知环境深度,而像 DAC、MapAnything 等深度估计模型,几乎没有既能同时适配好这两种相机,又能端侧跑起来的方案。 对此,地…

不止于预测,小米将世界模型打造成数据引擎
7 月 14 日,小米放出其自研机器人在工厂中连续作业的任务视频,视频中可以看到机器人在面对不同尺寸工件依然可以长时间稳定作业。 然而,机器人在工厂里的稳定作业,只是最终呈现出来的结果。真正支撑这一结果的,是机器人背后的模型能力。模型能力决…

半年狂揽 4 亿美元的逐际动力,按下上市快进键
具身智能赛道的百亿独角兽,再添一员猛将。 7 月 14 日,通用人形机器人公司逐际动力宣布完成 Pre IPO 轮融资,融资金额近 2 亿美元,投后估值达 150 亿元。在过去的半年时间里,逐际动力已经累计完成 4 亿美元融资。 同时,这也…

英伟达用 SimFoundry,打通机器人 Real2Sim 最后一公里
近年来, DexMimicGen 等自动化数据合成工具和 PolaRiS、Isaac Sim 等仿真工具为解决机器人数据与训练问题,提供了可扩展的替代方案。 但是让开发者通过「CAD 建模、提供物理约束、摆放场景」等步骤手动布置仿真环境,并…

融资数亿美元后榜单登顶,无界动力发布 MWA 隐空间世界模型
6 月 29 日,无界动力正式发布「长时序双向物理因果链」隐空间世界模型——MWA 具身通用大脑,同时在由斯坦福大学等机构联合发起的具身智能榜单 RoboCasa GR1 TableTop 中刷新行业纪录、登顶全球第一。 MWA 摒弃了像素…

银河通用推出 AstraBrain-WBC 0.5 — 人形机器人「小脑」的 GPT 时刻
小脑之于人体,如同 AstraBrain WBC 0.5 之于机器人 —— 负责全身运动控制。 6 月 19 日,银河通用正式推出全球首个面向人形机器人的通用小脑基础模型—— AstraBrain WBC 0.5 。该模型被定义为人形机器人…

极佳视界再获 10 亿元融资,世界模型如何走进家庭和工厂?
6 月 15 日,极佳视界宣布完成 10 亿元 B2 轮融资。 本轮融资由新加坡跨境投资机构狮城资本(多轮持续追投)、中国 比利时基金、建投投资、万向钱潮、复星锐正、华盖创赢、金创投、德屹资本、华仓资本、元石基金等国家队基金、产业资本、财务…

机器人开始「吃数据」:从印度数据工厂到百亿美元人形机器人的隐秘生产链
在印度的某个服装加工厂中,工人们正在像往常一样整理布料,但这次不同的是,他们的头上多了一个摄像头,用来拍摄自己工作时的第一视角视频。 这些视频,将会在处理之后成为数据资产,出售给那些需要大量数据来训练机器人的具身智能公司。 类似的生意从今年…

VLA 终于摆脱后训练了?自变量开源 WALL-OSS-0.5,预训练完直接上真机
近年来,VLA 模型越来越强,但始终存在一个关键现实,几乎所有亮眼成绩,都依赖后训练。预训练模型本身,很少能直接部署到机器人本体上。 似乎任务微调才是那个让模型真正「干活」的东西,预训练到底有没有让机器人学会操作,离了后训练,模型还能不能直…

2030 年千亿营收目标背后,智元真正想做的是什么?
在过去两年的时间里,机器人给人们生活带来最大的震撼,莫过于能跑、能跳、能完成高难度动作。但是,这些花活放到 2026 年的今天,早就不新鲜了,头部公司多两个花活,腰部公司做得大差不差,尾部公司也能放出几个 Demo。 作为一个潜力巨大的行业…