ROBOTNESS
产品阅读约 1 分钟ROBOTNESS 编辑部美国

Runway发布开放权重世界动作模型Praxis-1,把视频模型延伸到机器人控制

生成式视频公司Runway于2026年9月30日发布Praxis-1,这是一款把大规模视频预训练转化为真实机器人控制的开放权重世界动作模型。Noble Machines、Standard Bots和Ultra正在双臂、六轴机械臂和移动底盘上进行早期测试,权重将在未来几个月公开。

摘要

以生成式视频模型闻名的美国纽约AI公司Runway于2026年9月30日发布Praxis-1,称其为一款开放权重的世界动作模型,可把公司的视频预训练能力转化为对真实机器人的控制。该模型正与三家硬件伙伴进行早期测试,Runway表示将在未来几个月公开模型权重。

这一主张的核心依据是两组数据。据Runway研究文章,仅用网络视频预训练的策略最终放置误差为16.1厘米,用遥操作机器人视频预训练的策略为16.0厘米,二者几乎相当,比较基于93组评估样本。Runway还称,在其世界模型中模拟机器人策略,对真实结果的预测相关系数达到0.95。扩展实验中的预训练视频量约从10小时到1000小时,Runway表示第三人称视频越多,策略表现越好。

三家伙伴覆盖不同形态的机器人:Noble Machines测试双臂操作,Standard Bots测试其RO1六轴机械臂,Ultra测试移动底盘,各自在自有硬件上运行模型。Runway称测试旨在公开发布前,在多种本体和环境中同时验证有效性和安全性。公司表示,同一策略可从灯光受控、固定机架的摄影棚环境迁移到混合光线下的家用厨房台面,无需重新训练。Runway未披露参数规模、架构细节、许可条款和发布日期。

Praxis-1延续了Runway在2025年12月提出的路线。当时公司推出基于Gen-4.5视频模型的通用世界模型GWM-1,其三个版本之一GWM Robotics通过Python SDK提供,用于生成合成数据以及在无实体硬件的情况下评估机器人策略。Praxis-1则从模拟机器人迈向直接驱动机器人。

这意味着一家视频生成公司闯入了资金更雄厚的机器人专业赛道。Physical Intelligence此前开放了π0模型权重,英伟达公开发布GR00T人形机器人模型,谷歌DeepMind向部分合作伙伴提供Gemini Robotics模型。据公司公告,Skild AI于2026年1月以140亿美元估值融资14亿美元打造通用机器人大脑,Figure AI在C轮以390亿美元估值融资10亿美元后自研Helix模型。

技术上的赌注在于,机器人所需的物理常识能否主要从普通视频而非昂贵的遥操作中习得。遥操作即由人操控机器人录制示范数据,目前仍是机器人基础模型的主要训练来源,但采集慢、成本高。如果网络视频的效果接近遥操作,正如Runway在测试任务中16.1厘米对16.0厘米的结果所示,困扰行业的数据瓶颈将明显缓解。世界动作模型把预测场景演变的模型与选择动作的策略结合在一起,使同一系统既能推演结果又能执行动作。

对中国产业而言,这一路线既是机会也是挑战。国内厂商在遥操作数据采集上投入巨大,多地建设了数据采集训练场,智元、宇树等企业也已开源各自的机器人模型。若网络视频可以大量替代遥操作数据,重资产的数据工厂模式将面临重估,而拥有海量短视频资源的平台企业可能获得新的筹码。同时,中国在整机和零部件上的成本优势,与开放模型结合后可能进一步扩大出货规模。

目前披露的证据仍然有限。视频与遥操作的比较只基于一个放置指标,误差在10至20厘米之间,距离工业任务所需的毫米级精度相去甚远。Runway自己列出了四类待改进的失败场景:刚性或重复物体、杂乱场景、透明材料和可变形物体。由于缺少参数规模、许可条款和第三方基准,暂时无法将Praxis-1与π0或GR00T直接比较。

下一个节点是未来几个月的权重发布,以及Noble Machines、Standard Bots和Ultra的首批测试结果。许可条款将决定制造商能否将其用于商业用途。

Praxis-1:Runway披露数据
  • 网络视频预训练最终放置误差
    数值
    16.1
    单位
    厘米
  • 遥操作机器人视频预训练最终放置误差
    数值
    16
    单位
    厘米
  • 比较所用评估样本
    数值
    93
    单位
    组
  • 世界模型策略评估与真实结果相关系数
    数值
    0.95
    单位
    r
  • 扩展实验最少预训练量
    数值
    10
    单位
    小时
  • 扩展实验最多预训练量
    数值
    1000
    单位
    小时
  • 早期测试硬件伙伴
    数值
    3
    单位
    家

数据来自Runway于2026年9月30日发布的Praxis-1研究文章;误差带为93组评估的±1标准误。参数规模未披露。

截至 2026年10月1日

ROBOTNESS 分析

Praxis-1是把互联网视频变成机器人控制主要训练来源的可信尝试,但Runway目前展示的是有前景的扩展信号,而非量产级性能。

支持这一判断的证据是,在Runway的放置任务中网络视频与遥操作机器人视频效果几乎持平,同时模拟与真实策略结果的相关系数达0.95。两者都指向降低数据和评估成本的路径,而这正是机器人学习中最昂贵的两个环节。

最有力的反驳是,约16厘米误差的放置任务较为粗糙,精细操作依赖视频无法记录的接触力和触觉反馈。拥有大规模遥操作数据的机器人专业公司可能在灵巧作业上保持长期优势。

乐观情景:权重以允许商用的许可发布,伙伴在三种本体上报告实用技能,Praxis-1成为缺少模型团队的机械臂和移动机器人厂商的默认起点,Runway借助视频数据和算力开辟物理AI第二业务线。

悲观情景:发布推迟或许可受限,性能停留在粗放的抓放层面,拥有真实机器人数据、资金更充足的对手在客户付费的任务上胜出,Praxis-1只是一次研究展示。

值得关注的信号:

  • 2026年第四季度至2027年第一季度:Praxis-1权重及许可条款发布。
  • 2027年第一季度:Noble Machines、Standard Bots或Ultra披露首批任务结果或部署情况。
  • 2027年:在共同任务上与π0和GR00T对比的第三方基准测试。
要点
公司
Runway(美国纽约)
发布日期
2026年9月30日
模型
Praxis-1,开放权重世界动作模型
早期伙伴
Noble Machines(双臂)、Standard Bots(RO1六轴机械臂)、Ultra(移动底盘)
网络视频对遥操作视频
最终放置误差16.1厘米对16.0厘米,93组评估
模拟预测能力
世界模型与真实结果相关系数0.95
开放权重
未来几个月发布,许可未披露
前代产品
2025年12月发布GWM-1,含GWM Robotics
来源
ROBOTNESS 情报版
  1. 01

    为何重要

    Praxis-1是生成式视频公司直接提供机器人控制而非机器人仿真的最明确尝试。如果网络视频接近遥操作数据效果的结论能在更多任务上成立,机器人策略训练成本将大幅下降,因为遥操作是当前机器人学习链条中最慢、最贵的投入。

    开放权重的承诺同样重要。除少数资金充裕的实验室外,大多数机器人厂商没有模型团队。一款在三种本体上测试过的开放模型,可以成为它们在自有硬件上微调的起点。

  2. 02

    竞争对手分析

    Runway的对手包括已开放π0权重的Physical Intelligence、公开发布GR00T模型的英伟达,以及拥有Gemini Robotics系列的谷歌DeepMind。Skild AI和Figure AI分别在最近一轮融资14亿美元和10亿美元,以远超Runway机器人投入的预算自研模型。

    Runway的优势在于视频数据和大规模视频模型训练经验,短板在于真实机器人数据和落地经验。三家伙伴均为中小硬件企业,说明Runway瞄准的是需要模型的公司,而非已在自研模型的公司。

  3. 03

    估值背景

    由于无法在Runway官方页面核实其估值,本文未予引用。作为参照,据公司公告,机器人模型开发商在2025至2026年的融资估值分别为Skild AI 140亿美元、Figure AI 390亿美元,Walden Robotics以11亿美元估值起步。

    若Praxis-1获得采用,Runway将无需造硬件即可进入物理AI市场,投资者也可能部分依据机器人业务来评估其世界模型价值。但这取决于尚未公布的商业条款。

  4. 04

    供应链影响

    以视频为主训练的模型会削弱正在扩张的遥操作数据采集业务的价值,转而抬高算力和视频数据的价值。硬件门槛也随之下降,机械臂和移动底盘企业可借助开放模型获得智能,在成本和可靠性上竞争,这对中国整机厂商尤为有利。

    对零部件企业而言影响是间接的。软件成本下降会让更多部署具备经济性,从而带动执行器、摄像头和边缘算力需求,在对价格最敏感、开放模型最具吸引力的细分市场效果最明显。

  5. 05

    后续看点

    第一个信号是未来几个月的权重发布及许可条款。若允许商用,Praxis-1将成为制造商的现实选项;若仅限研究,则只能停留在实验阶段。

    第二个信号是伙伴的成果。Noble Machines、Standard Bots或Ultra在2027年初披露的任务结果、成功率或部署情况,将显示模型在付费作业中的表现。与π0和GR00T在共同任务上的第三方对比也必不可少。

  6. 06

    分析师观点

    核心判断:Praxis-1是一项具备可信数据优势的扎实技术成果,但尚未证明商用操作所需的精度和可靠性。置信度:中等。

    0.95的仿真与真实相关系数以及网络视频与遥操作的接近结果具有意义,Runway也有持续发布世界模型的记录。置信度定为中等,是因为证据只来自约16厘米误差的单一放置指标,参数规模和许可未披露,且尚无第三方结果。

  7. 07

    值得追问的问题

    开放权重将采用何种许可?是否无需另签协议即可商用?模型规模多大,在机器人端推理需要多少算力?

    在插装、布料处理等依赖力反馈的接触密集型任务中,网络视频的优势是否依然成立?Runway是否会在免费模型之上,把GWM Robotics仿真与评估工具作为付费层出售?