跳到正文
10月3日周六
10月2日周五
  1. 机器之心38

    比李飞飞World Labs早两年押注原生4D,影身智能这次是真走在前面了?

    影身智能比李飞飞World Labs早两年押注原生4D世界模型路线,已用4到6台消费级摄像头加单块消费级GPU实时生成4D数据,并在福建晋江制鞋工厂落地机器人、拿到2亿元订单。其4D数据集已达万小时量级,产品形态为「影身360」,同时布局4D直播与4D游戏两条业务线。

9月30日周三
  1. 智东西40

    临界点 OmniHand 3 Ultra 灵巧手拜师苏绣,实拍完成穿针合绣

    临界点(AGILINK)旗舰灵巧手 OmniHand 3 Ultra 开始向苏绣传承人学习上绷、劈丝、穿针、捻线、挑线、合绣等工艺,相关画面均为实拍。该灵巧手拥有 21 个主动自由度、全直驱传动,并配备指尖视触觉传感器和覆盖指尖、指腹到掌面的全手触觉,需在 0.15 毫米针孔中完成穿线。临界点称苏绣用于验证柔性材料、微小尺度、多指协同与动态力控能力,可迁移至家庭和工业精细操作场景。

9月29日周二
  1. 爱范儿80

    AMD 以约 82 亿美元全股票收购李飞飞创立的 World Labs

    AMD 正式宣布以全股票方式收购李飞飞创立两年的 AI 独角兽 World Labs,作价约 82 亿美元,双方已签署最终协议,预计 2026 年底前完成交易,仍须获得监管批准。

    推荐理由:AMD 以全股票方式收购 World Labs,读者可据此观察芯片厂商向空间智能与机器人仿真工作负载的布局。

  2. 爱范儿38

    对话一目科技:机器人缺失的「手感」,用「光」来搞定

    一目科技推出视光学超薄仿生触觉传感器 SENTRA T0,厚度迭代至 3 毫米以下,称是全球最薄可量产的仿生视触觉传感器。其「光触觉」方案在指尖大小面积布置 24 万个感知点、力感知精度约 5mN,远高于压阻或电容方案的 10-100 个点。创始人李智强认为触觉是具身智能最大数据瓶颈的关键入口,智驾范式不适用于需要接触物理世界的机器人。

  3. Latent Space67

    AMD 以 82 亿美元收购 World Labs,Atlas 解决稀疏重建问题

    AMD 以 82 亿美元收购 World Labs。World Labs 创始人李飞飞在博客中回顾,公司自 2024 年成立以来构建了图像、视频与空间重建的模型训练团队,并在收购 SceniX 后推进机器人仿真能力。其近期发布的 Atlas 是一种 omni 模型架构,从 2D 图像输入预测新视角,在稀疏重建这一计算机视觉长期难题上超过专用模型,可用于机器人 RL 环境、场景生成与真实世界重建。

9月24日周四
  1. Microsoft Research62

    微软研究院:把物理 AI 推理从机器人卸载到边缘或云端

    微软研究院对移动操作机器人工作负载做了系统性测量,发现把物理 AI 推理从机载 GPU 卸载到边缘或云端 GPU 可提升任务表现并延长续航。

    推荐理由:微软研究院对机器人推理负载的系统性测量,给出了把推理从机载 GPU 卸载到边缘或云端的性能与续航数据。

7月30日周四
  1. Google DeepMind71

    Google DeepMind 发布 Gemini Robotics ER 2 具身推理模型

    Google DeepMind 发布 Gemini Robotics ER 2,这是其面向机器人的具身推理模型,可理解视频、编排多步任务并把动作执行交给底层 VLA 模型,还能原生调用 Google Search 等工具。

    推荐理由:官方给出 ER 2 在进度分类、时刻定位与多机协作上的具体指标和开放入口,可据此判断机器人大脑的能力边界。

7月28日周二
7月27日周一
  1. Hugging Face Blog66

    NVIDIA 发布 Cosmos-H-Dreams 实时手术机器人生成式仿真器

    NVIDIA 发布 Cosmos-H-Dreams,一个面向手术机器人的实时、动作条件生成式仿真器,将 Cosmos-H-Surgical-Simulator 蒸馏为因果少步学生模型,并通过 FlashDreams 流式推理库提供服务。

    推荐理由:原文给出实时生成式手术仿真器的蒸馏与推理优化路径,读者可据此判断世界模型进入交互闭环的工程门槛。

7月21日周二
  1. Hugging Face Blog62

    Hugging Face 发布 Grabette 开源机器人操作数据采集系统

    Hugging Face 发布 Grabette,一套开源低成本的手持夹爪数据采集系统,用户无需机器人即可用手持设备录制操作演示,并自动转换为 LeRobot 格式数据集。

    推荐理由:原文给出了一套无需机器人即可采集操作数据的开源方案,读者可据此判断数据采集门槛与开源生态的衔接方式。

7月8日周三
  1. Mistral AI71

    Mistral 发布 Robostral Navigate 具身导航模型

    Mistral 发布首个具身导航模型 Robostral Navigate,这是一个 8B 模型,仅用单个普通 RGB 相机、无需 LiDAR 或深度传感器,在 R2R-CE 验证未见集上达到 76.6% 成功率,比最佳单相机方案高 9.7 个百分点、比最佳多传感器方案高 4.5 个百分点。

    推荐理由:原文给出单目 RGB 相机下的导航成功率与训练方法,读者可据此判断紧凑模型做具身导航的可行边界。

7月7日周二
  1. Hugging Face Blog76

    LeRobot v0.6.0 发布:世界模型策略、奖励模型与部署 CLI

    Hugging Face 发布 LeRobot v0.6.0,围绕机器人学习闭环引入世界模型策略(VLA-JEPA、FastWAM、LingBot-VA)、新一批 VLA(GR00T N1.7、MolmoAct2、EO-1、EVO1、Multitask DiT)以及统一奖励模型 API(Robometer、TOPReward)。

    推荐理由:LeRobot v0.6.0 把世界模型策略、奖励模型与部署 CLI 串成闭环,读者可据此了解开源机器人学习栈的当前形态。

7月1日周三
  1. Berkeley AI Research17

    2026 届 BAIR 博士毕业生展示:从机器人到 LLM 推理的研究全景

    伯克利人工智能研究实验室(BAIR)公布 2026 届博士毕业生名单,其研究覆盖机器人、具身智能、大语言模型与推理、计算机视觉、生成建模、AI 安全、人机交互及 AI for Science 等方向。毕业生去向包括 OpenAI、Mistral AI、Physical Intelligence、Amazon 等机构,以及 UCLA、普林斯顿 CITP 和芝加哥大学等学术岗位,部分人仍在探索下一步。

6月9日周二
5月23日周六
  1. Mistral AI60

    Mistral 收购 Physics AI 公司 Emmi AI

    Mistral AI 宣布已达成收购 Physics AI 公司 Emmi AI 的最终协议,以强化其面向工业企业的 AI 转型服务能力。Emmi AI 总部位于奥地利,专注物理 AI 与大型工程模型,可把多日计算替换为实时仿真并构建数字孪生;其联合创始人及 30 多名研究人员和工程师将于 5 月加入 Mistral 的 Science 与 Applied AI 团队。

    推荐理由:Mistral 通过收购补齐 Physics AI 能力,读者可了解其面向工业工程与科学计算的布局方向。

4月13日周一
  1. Google DeepMind66

    Google DeepMind 发布 Gemini Robotics-ER 1.6,新增仪表读数能力

    Google DeepMind 发布 Gemini Robotics-ER 1.6,这是其面向机器人的推理优先模型升级版,重点增强空间推理与多视角理解,并新增仪表读数能力,可读取压力表、液位计和数字读数。

    推荐理由:官方给出与上一代及 Gemini 3.0 Flash 的对比,并首次加入仪表读数能力,可据此判断机器人在设施巡检场景的可用性。

3月9日周一
3月5日周四
  1. Hugging Face Blog34

    Hugging Face 博客:在嵌入式平台部署机器人 AI——数据集录制、VLA 微调与端侧优化

    NXP 发布在嵌入式平台部署机器人 AI 的实践指南,涵盖机器人数据集录制、VLA 策略(ACT 和 SmolVLA)微调,以及 NXP i.MX 95 SoC 优化后的实时性能表现。指南以"把茶包放进杯子"任务为例,记录了 120 个 episode,并建议采用 3 摄像头配置(顶部、夹爪、左侧)以平衡精度与延迟。

10月29日周三
  1. Hugging Face Blog62

    NVIDIA Isaac for Healthcare 如何从仿真到部署构建医疗机器人

    NVIDIA 发布 Isaac for Healthcare v0.4,提供基于 SO-ARM 的端到端手术辅助机器人工作流,覆盖数据采集、训练与真机部署。该工作流用 LeRobot 采集仿真与真机数据,后训练 GR00T N1.5,并在 Isaac Lab 评估后部署到硬件,其中超过 93% 的训练数据由仿真合成生成。

    推荐理由:原文给出从仿真采集、GR00T N1.5 后训练到真机部署的完整命令与硬件要求,可据此复现医疗机器人工作流。

10月24日周五
9月16日周二
6月3日周二
  1. Hugging Face Blog62

    Hugging Face 发布 SmolVLA:450M 开源视觉-语言-动作模型

    Hugging Face 发布 SmolVLA,一个 450M 参数的开源视觉-语言-动作(VLA)模型,可在 CPU、单张消费级 GPU 甚至 MacBook 上运行,仅用 lerobot 标签下社区共享数据集预训练。

    推荐理由:450M 参数、消费级硬件可跑的开源 VLA,用不到 3 万条社区数据在仿真与真机上追平更大模型,并给出异步推理带来的速度差异。

5月11日周日
  1. Hugging Face Blog34

    LeRobot 社区数据集:机器人领域的“ImageNet”何时到来、如何实现?

    Hugging Face 的 LeRobot 项目正推动社区共建机器人数据集,目标是打造机器人领域的“ImageNet”。目前 Hub 上的 lerobot 数据集数量快速增长,贡献主要集中在 So100 和 Koch 机械臂,聚焦操作任务。文章将泛化视为数据问题,呼吁通过简化录制流程、降低硬件成本来扩大数据多样性。

4月14日周一
3月18日周二
  1. Hugging Face Blog66

    NVIDIA 在 GTC 2025 发布 Cosmos Transfer、Physical AI Dataset 与 Isaac GR00T N1

    NVIDIA 在 GTC 2025 上发布三款面向物理 AI 的开源成果:世界基础模型 Cosmos Transfer、Physical AI Dataset 以及人形机器人基础模型 NVIDIA Isaac GR00T N1。

    推荐理由:NVIDIA 在 GTC 2025 一次性开源世界模型、数据集与人形机器人基础模型,读者可据此了解物理 AI 开发可用的工具链。

2月4日周二
3月25日周一