Generalist AI
用可穿戴设备采集人类物理交互数据训练具身基础模型的美国公司
- Skild AI以14亿美元居2025至2026年人形机器人与具身智能融资榜首,资金正从机器人本体转向机器人大脑
据ROBOTNESS核实数据,2025年1月以来人形机器人与具身智能领域最大一笔融资是软银领投的Skild AI 14亿美元C轮,其次是Parkway Venture Capital领投的Figure AI 10亿美元C轮,两笔合计占22笔披露金额融资总额58.59亿美元的41%。2025年人形机器人整机企业拿走披露资金的70%,2026年以来机器人基础模型开发商拿走71%。中国企业同期8笔已核实融资中仅众擎机器人一笔披露美元金额。
提及 - 什么是VLA(视觉-语言-动作)模型,谁在研发
VLA(视觉-语言-动作)模型是一种把摄像头画面和自然语言指令一并读入、直接输出机器人下一步电机指令的单一神经网络,做法是在能看懂图像的视觉语言模型上再用机器人示范数据训练。谷歌DeepMind、Physical Intelligence、英伟达、Figure AI与Skild AI处于前列,智元机器人代表中国阵营,竞争焦点正从模型结构转向动作数据的获取成本。
提及 - 地瓜机器人完成4亿美元C轮融资,旭日芯片累计出货超800万颗,投资方名单未披露
地平线今年3月起不再并表的地瓜机器人于2026年9月17日宣布完成4亿美元C轮融资,未披露任何投资方名称和估值。公司称旭日系列芯片累计出货超过800万颗,新一代S600发布半年内获得20余家客户采用,包括优必选、傅利叶和加速进化。
提及 - Generalist发布GEN-1,预训练不用机器人数据,每项任务约1小时真机数据即达99%成功率
Generalist AI于2026年4月2日发布具身基础模型GEN-1,预训练数据为50万小时以上、由人佩戴可穿戴设备采集的物理交互数据,不含机器人数据。公司称,在前代模型平均成功率64%的任务上,GEN-1平均达到99%,每项任务约需1小时机器人数据,作业速度约为此前最佳水平的3倍。上述结果均为公司自测,尚无独立复现。
主体 - 英伟达预览GR00T N2:押注先预测视频再行动的世界动作模型
英伟达于2026年3月16日GTC主题演讲中预览基于DreamZero研究的新一代机器人基础模型GR00T N2,称其在新环境新任务中的成功率是领先VLA模型的两倍以上。30亿参数的GR00T N1.7进入商业许可抢先体验,DreamZero的主要实验平台为智元G1。N2计划于2026年底前推出。
提及