Runway
생성형 영상 모델로 알려진 미국 뉴욕의 AI 기업으로 월드 모델을 로봇 제어로 확장하고 있다
- VLA(비전-언어-행동) 모델이란 무엇이고 누가 만드나
VLA(비전-언어-행동) 모델은 카메라 영상과 자연어 지시를 함께 읽어 로봇의 다음 동작 명령을 내놓는 단일 신경망으로, 이미지와 글을 이해하는 비전-언어 모델에 로봇 시연 데이터를 추가 학습시켜 만든다. 구글 딥마인드와 피지컬 인텔리전스, 엔비디아, 피규어 AI, 스킬드 AI가 앞서 있고 한국은 LG와 KIST를 중심으로 추격에 나섰으며, 승부는 모델 구조보다 행동 데이터를 얼마나 싸게 모으느냐로 옮겨가고 있다.
언급 - 런웨이, 영상 AI를 로봇 제어로 확장한 오픈 웨이트 월드 액션 모델 ‘Praxis-1’ 공개
생성형 영상 기업 런웨이가 2026년 9월 30일 대규모 영상 사전학습을 실제 로봇 제어로 연결하는 오픈 웨이트 월드 액션 모델 Praxis-1을 발표했다. 노블머신즈, 스탠다드봇, 울트라가 양팔, 6축 로봇팔, 이동형 플랫폼에서 초기 시험을 진행하며 가중치는 수개월 안에 공개될 예정이다.
당사자 - 게임 영상으로 로봇 가르친다는 제너럴 인튜이션, 석 달 만에 기업가치 62억달러로 2.7배
게이밍 클립 플랫폼 메달(Medal)의 조작 기록이 붙은 영상으로 AI 모델을 학습시키는 미국 제너럴 인튜이션이 2026년 9월 29일 기업가치 62억달러에 2억2000만달러를 유치했다고 밝혔다. 96일 전 시리즈A 때 밝힌 23억달러의 2.7배다. 회사는 로봇, 시뮬레이션, 게임 분야 파트너를 위한 사전 신청도 열었다.
언급