T-RO综述重构Foundation Model时代机器人操作知识版图
T-RO综述重构Foundation Model时代机器人操作知识版图过去几年,机器人操作领域几乎被一批新概念重新 “刷屏”。 LLM Planner、VLA、Diffusion Policy、Flow Matching、Latent Action、World Mode
搜索
过去几年,机器人操作领域几乎被一批新概念重新 “刷屏”。 LLM Planner、VLA、Diffusion Policy、Flow Matching、Latent Action、World Mode
长期以来,机器人系统大多依赖专有模型。
4 秒就能卖出一只,最近 Hugging Face 推出的一款售价 399 美元的「机器鸭」真是卖爆了。
最近,人形机器人运动会可太火了。
机器人正在变得越来越「通用」。
还记得上周具身圈流传的那个神秘10分钟一镜到底视频吗?
今年5月,英伟达机器人负责人Jim Fan在一场公开演讲中宣告:VLA、遥操已死。
Yukai Engineering CEO 青木俊介在 AGI Playground 2026 上复盘 mirumi 包挂件机器人的成功经验,这款不接大模型的产品在 CES 2025 意外走红,他认为消费机器人的关键在于提出正确的问题而非比拼技术参数。
视觉 - 语言 - 动作模型(Vision-Language-Action Model,VLA)正在成为机器人操作的重要基础模型。经过少量示范微调后,VLA 已经能够完成抓取、放置、堆叠等多种任务。然而,一旦任务涉及精密接触、狭小容差或分布外位置,模型的成功率仍会明显下降。
影眸Hyper3D发布世界生成模型WorldGen,用户上传一张场景图片即可在两三分钟内生成由多个独立可交互物体组成的3D场景,物体具备质量、摩擦系数等物理属性,可直接接入Blender、Unity、Unreal Engine等主流工具及机器人仿真环境,标志着3D生成进入场景级时代。