産業
VLA(視覚言語行動)モデルとは何か、誰が開発しているのか
VLA(視覚言語行動)モデルは、カメラ映像と自然言語の指示を同時に読み込み、ロボットが次に実行するモーター指令を出力する単一のニューラルネットワークで、画像と言葉を理解する視覚言語モデルをロボットの実演データで追加学習して作る。グーグル ディープマインド、フィジカル インテリジェンス、エヌビディア、フィギュアAI、スキルドAIが先行し、ファナックや安川電機は外部モデルを自社ロボットに取り込む道を選んだ。
資金調達、製品発表、論文のすべてを、報道と同時に。
VLA(視覚言語行動)モデルは、カメラ映像と自然言語の指示を同時に読み込み、ロボットが次に実行するモーター指令を出力する単一のニューラルネットワークで、画像と言葉を理解する視覚言語モデルをロボットの実演データで追加学習して作る。グーグル ディープマインド、フィジカル インテリジェンス、エヌビディア、フィギュアAI、スキルドAIが先行し、ファナックや安川電機は外部モデルを自社ロボットに取り込む道を選んだ。
韓国産業通商部は5月29日、M.AX連合AIロボット分科の発足1年の成果を公表した。参加は約280機関に達し、HD現代重工業、SKエナジー、BGFと業種特化型ヒューマノイドの実証が進む。国産ロボット基盤モデル、時速13キロのヒューマノイド下半身、ヒューマノイドへの投資義務を課す5000億ウォンのファンド計画も示した。
4月19日の2026北京亦荘人型ロボットハーフマラソンには13省から100超のロボットチームが参加し、前年の5省から大きく広がった。約4割のロボットが自律ナビゲーションで走った。北京市政府によると、斉天大聖チームの「閃電」が21.0975キロを50分26秒で走り切り、人間の男子優勝記録は1時間7分47秒だった。