多模态

35 篇相关内容

谷歌一出手就是王炸,这次给机器人安上了「新大脑」

谷歌放大招,Gemini Robotics 1.5 系列模型让通用具身智能又迈出了坚实的一步。 当地时间 9 月 25 日,谷歌核心 AI 研发部门 DeepMind 发布了为机器人打造的 Gemini Robotics 1.5 系列模型,…

外滩大会上,王兴兴对机器人有了新看法

9 月 11 日,在 2025 外滩大会上,宇树科技创始人兼首席执行官王兴兴发表了最新观点。针对机器人模型、数据和硬件等问题提出了自己的看法。 王兴兴认为,让 AI 干活整个领域目前都是荒漠,只是长了几棵小草,爆发性增长的前夜还没有到来。而…

半年狂揽 4 亿美元的逐际动力,按下上市快进键

具身智能赛道的百亿独角兽,再添一员猛将。 7 月 14 日,通用人形机器人公司逐际动力宣布完成 Pre IPO 轮融资,融资金额近 2 亿美元,投后估值达 150 亿元。在过去的半年时间里,逐际动力已经累计完成 4 亿美元融资。 同时,这也…

把 Codex、CC 搬进机器人训练? 朱玉可、Jim Fan 最新力作谈具身持续学习系统

让机器人去拿一罐可乐,听起来像一件很小的事。 但行动的每一步都可能翻车:没看清可乐罐,抓取姿态歪了,路径规划撞到了桌角,手指夹住了空气,或者好不容易拿起来,下一秒又把它放错了地方。 最后给你一句很没用的反馈:任务失败 。 这就像程序崩了,但…

不愿只做车企的理想,如今选择做 AI

看完这场 Livis Day,我最直接的感受是:理想正在变得越来越不像一家传统车企了。 当然,它不是贬义。 如果把时间往前倒几年,我们熟悉的理想,还是那家把家庭需求拆得极细的公司。它会认真告诉你为什么一台车要有冰箱、彩电、大沙发,为什么二排…

从底层本能出发,橡木果机器人发布「本能驱动」技术路线

6 月 2 日,橡木果机器人发布「本能驱动」技术路线,从底层本能出发,让机器人先获取操作本能,继而在与物理世界的交互中自主涌现操作智能。 从行业视角看,目前具身智能领域多数公司选择的是「自上而下」的路径:用大模型理解任务,用海量数据训练端到…

VLA 终于摆脱后训练了?自变量开源 WALL-OSS-0.5,预训练完直接上真机

近年来,VLA 模型越来越强,但始终存在一个关键现实,几乎所有亮眼成绩,都依赖后训练。预训练模型本身,很少能直接部署到机器人本体上。 似乎任务微调才是那个让模型真正「干活」的东西,预训练到底有没有让机器人学会操作,离了后训练,模型还能不能直…

2030 年千亿营收目标背后,智元真正想做的是什么?

在过去两年的时间里,机器人给人们生活带来最大的震撼,莫过于能跑、能跳、能完成高难度动作。但是,这些花活放到 2026 年的今天,早就不新鲜了,头部公司多两个花活,腰部公司做得大差不差,尾部公司也能放出几个 Demo。 作为一个潜力巨大的行业…

让机器人学会打鸡蛋、切番茄、弹钢琴,GENE-26.5 的秘密不只是在模型里

在经过一年的沉淀后,硅谷具身智能创企 Genesis AI 终于在今天带来了其首个机器人基础模型系统 GENE 26.5,在这套系统下,机器人能够自己复原魔方,还可以打鸡蛋、切番茄,展示出了不同以往的灵巧操作能力。 相较于以往许多厂商发布时…

智元酷拓发布全地形智能移动和作业平台,目标 2030 年实现规模出货 30 万台

在当下的具身智能领域,人形机器人与四足机器人正在形成清晰的能力互补,人形更擅长站立姿态下的精细操作与上肢作业,四足则以全地形通过性和稳定移动见长。在矿山、井下、管廊、废墟、极地等人类难以长期作业的场景里,四足机器人的价值更突出,它能抵达绝大…

它石智航联合六大机构发布 OmniVTA 视触觉世界模型

近期,它石智航联合新加坡国立大学、复旦大学、中科院自动化所、清华大学、中关村学院以及北京航空航天大学六大机构,推出 OmniVTA 视触觉操作框架和 OmniViTac 大规模视触觉数据集并发表相关论文,让机器人实现从被动感知,到对触觉进行…

机器人正在抛弃语言?GTC 2026 给出的真实答案

在这次 GTC 2026 上,黄仁勋在演讲中带来了迪士尼的经典 IP 雪宝机器人,来跟大家现场互动。 而雪宝的背后,其实也隐藏了英伟达面向机器人的一整套技术更新,包括新版 Isaac Platform、多模态基础模型,以及进一步强化仿真与现…