Hugging Face
オープンソースのAIプラットフォーム。ロボット学習ライブラリLeRobotの開発元。
- VLA(視覚言語行動)モデルとは何か、誰が開発しているのか
VLA(視覚言語行動)モデルは、カメラ映像と自然言語の指示を同時に読み込み、ロボットが次に実行するモーター指令を出力する単一のニューラルネットワークで、画像と言葉を理解する視覚言語モデルをロボットの実演データで追加学習して作る。グーグル ディープマインド、フィジカル インテリジェンス、エヌビディア、フィギュアAI、スキルドAIが先行し、ファナックや安川電機は外部モデルを自社ロボットに取り込む道を選んだ。
言及 - Hugging Face、「LeRobot 0.6」を公開 世界モデルとエヌビディアのGR00T N1.7を取り込み、オープンなロボット連合を強化
Hugging Faceは7月7日、オープンソースのロボット学習ライブラリ「LeRobot」の0.6.0版を公開した。世界モデル型の方策3種、エヌビディアのGR00T N1.7を含む視覚言語行動モデル5種、報酬モデル2種、シミュレーションのベンチマーク6種を加えた。エヌビディアは前日、GR00T、Isaac Teleop、Isaac Lab-Arena、Jetson Thor対応をLeRobotに組み込み、Cosmos 3も近く統合すると発表した。
当事者 - エヌビディア、研究用の標準人型ロボットを提示 ユニツリーH2プラスにシャーパの触覚ハンドとジェットソントール
エヌビディアは2026年6月1日、GTC台北で学術研究向けの「Isaac GR00T リファレンス人型ロボット」を発表した。ユニツリーのH2プラスを機体に、自由度22のシャーパ製触覚ハンド2基とジェットソンAGXトールT5000を組み合わせる。2026年後半にユニツリーが販売を始める予定で、価格は公表していない。
言及 - エヌビディア、GR00T N2を披露 映像を予測してから動くワールドアクションモデルに賭ける
エヌビディアは2026年3月16日のGTC基調講演で、DreamZero研究を基にした次世代ロボット基盤モデルGR00T N2を披露し、新環境の新作業で主要VLAの2倍超の成功率を示すと説明した。30億パラメータのGR00T N1.7は商用ライセンス付きで先行提供を始め、ファナックや安川電機はシミュレーション基盤の統合を進める。N2は2026年末までに提供する。
提携先