Reka Rho-1, 글·그림·영상·로봇 동작을 모델 하나로… 5.3초 영상을 약 1초에
190억 파라미터 모델 하나가 그림을 그리고, 영상으로 움직이고, 고치고, 설명까지 해요. 아직 연구 미리보기예요.
핵심 3줄
- Reka가 190억(19B) 파라미터 '옴니' 모델 Rho-1을 연구 미리보기로 공개했어요. 글·이미지·영상·로봇 동작을 신경망 하나 안에서 이해하고 만들어요.
- 여러 AI를 이어 붙이지 않고 한 대화 안에서 그림 생성 → 영상으로 움직이기 → 영상 수정 → 차이 설명까지 해요.
- 빠른 버전은 5.3초 영상을 약 1초 만에 냈대요. 다만 영상 해상도는 672×384가 최대이고, 일반 공개 전이에요.
🧪 CONTENTSLAB 평지켜보세요★★★★★실전 활용도 2/5
AI 크리에이터·마케터
지금 쓸 수는 없어요. 다만 '그림 만들고 → 같은 대화에서 영상으로 → 날씨만 바꿔 다시'처럼 한 창에서 이어 고치는 흐름이 다음 영상 도구의 모습이 될 수 있어 눈여겨볼 만해요.
CONTENTSLAB 생각 · 이렇게 써 볼 수 있을 것 같아요
지금 바로 쓸 곳은 많지 않아 보여요. 다만 같은 장면을 유지한 채 눈·밤 같은 분위기만 바꾸는 영상 수정이 정식 서비스로 나오면, 캐릭터 영상의 계절 버전 컷을 만드는 데 써 볼 수 있을 것 같아요.
Reka가 Rho-1을 연구 미리보기로 공개했어요. 보통 AI 서비스는 중심 모델이 이미지 모델·영상 모델에 일을 넘기는 구조인데, Rho-1은 글·이미지·영상·로봇 동작을 모두 한 모델의 토큰(모델이 읽고 쓰는 단위)으로 다뤄요.
- 대화형 제작 등대 그림 생성 → 등대에 상자 표시 → 드론이 다가가는 영상 → 눈보라 버전으로 수정 → 두 영상 차이 설명을 한 대화에서 보여 줬어요.
- 속도 기본 모델은 영상을 실제 길이의 0.79배 속도(중간값)로 만들고, 약 6초 뒤부터 스트림이 나와요. 99단계를 8단계로 줄인 빠른 버전은 5.3초 영상을 약 1초에 냈대요 (Reka 자체 측정).
- 실시간 조종 영상이 흘러가는 중에 "왼쪽으로 꺾어" 같은 지시로 장면을 바꾸고, 로봇 팔 동작까지 출력해요.
- 한계 영상은 672×384가 최대이고, 30초쯤 길어지면 방 구조가 어긋나는 문제가 있대요.
지금은 연구 미리보기라 일반 사용자는 써 볼 수 없고, 로봇·시뮬레이션 쪽 협업 문의만 받고 있어요.
X 게시물 보기 · https://x.com/RekaAILabs/status/2107118937490006363

출처 (원문)