Runway, AI 영상 생성을 실시간 라이브스트림으로 전환하는 기술 연구 공개
Runway가 GWM-1 기반으로 프롬프트에 즉각 반응하는 실시간 AI 영상 스트리밍 기술 연구를 공개했어요.
Runway가 AI 영상 생성의 패러다임을 바꿀 수 있는 새로운 기술 연구를 공개했어요. 기존 방식은 프롬프트를 입력하고 수초에서 수분을 기다려야 완성된 영상을 받을 수 있었지만, 새 접근법은 사용자가 설명하는 즉시 영상이 실시간으로 스트리밍되는 형태로 전환하는 것을 목표로 해요. 핵심은 2025년 12월에 공개된 자체 GWM-1(General World Model)로, 프레임을 순차적으로 생성하면서 카메라 움직임이나 음성 입력 등 다양한 컨트롤에 즉각 반응해요.
기술적으로는 '자기회귀적 인과 확산(autoregressive causal diffusion)' 방식을 채택해 이전 프레임 전체를 다음 프레임 생성의 맥락으로 활용해요. 영상 생성에서 가장 까다로운 문제인 오류 누적도 독창적으로 해결했는데, 모델을 에러 없는 정답 데이터만으로 훈련하는 대신 자체 출력물로도 재학습시켜 스스로 편차를 교정하도록 했어요. Runway는 이 기술이 교육·게임·로보틱스 시뮬레이션처럼 실시간 인터랙티브 영상이 필요한 분야에 적용될 수 있다고 설명해요. 이미 GWM Robotics를 통해 로봇 훈련용 합성 데이터를 생성하고 있으며, Waymo도 자율주행 시나리오 시뮬레이션에 유사한 월드 모델을 활용하고 있어요. AI 영상이 '기다리는 미디어'에서 '반응하는 미디어'로 전환된다면, 크리에이터들의 작업 방식도 크게 달라질 것으로 기대돼요.
원문: The Decoder