TikTok 소유주인 ByteDance가 실시간 공간 영상 생성을 위한 인공지능 모델을 준비 중이며, 이르면 다음 달 출시될 수 있다고 Bloomberg가보도했다고 사안에 정통한 관계자들을 인용해 월요일 전했다.
보고서에 따르면 창업자 Zhang Yiming은 프로젝트를 직접 총괄하며, 여러 사업 부문을 조율하고 AI 자원과 컴퓨팅 역량을 개발에 집중시키고 있다. 출시 시점은 아직 확정되지 않았으며 변경될 수 있다.
이 모델은 ByteDance의 기존 AI 영상 생성 기술인 Seedance를 기반으로 한다. 라이브스트리밍, 숏폼 드라마, 게임을 위한 인터랙티브 가상 세계를 생성하도록 설계된 것으로 알려졌다.
월드 모델이라고도 불리는 공간 영상 모델은 사용자나 AI 에이전트의 행동에 따라 변화할 수 있는 가상 환경을 만든다. 향후 로봇공학, 게임, 자율주행차 등에 활용될 수 있다.
ByteDance의 모델은 회사의 Pico 헤드셋을 사용하는 사람들의 음성과 움직임에 반응하는 가상 환경을 생성하는 것을 목표로 한다. Bloomberg 보도에 따르면 초당 20프레임에서 약 0.05초의 지연 시간으로 주문형 영상을 생성할 수 있다.
월드 모델 분야에 뛰어드는 ByteDance
ByteDance는 이미 Google, Meta, AI 스타트업들이 진출한 성장 분야에 뛰어들게 된다.
Google은 올해 초 미국의 AI Ultra 가입자에게 Project Genie를 공개했다. 이 실험적 도구를 사용하면 텍스트 프롬프트와 이미지로 가상 세계를 만들고 탐험할 수 있다. 실시간으로 인터랙티브 환경을 생성할 수 있는 Google DeepMind의 Genie 3를 기반으로 한다.
Meta의 Video Joint Embedding Predictive Architecture 2 (V-JEPA 2)는 다른 접근 방식을 취한다. 이 모델은 물리적 세계를 이해하고, 다음에 일어날 수 있는 일을 예측하며, 로봇이 무엇을 할지 결정하도록 돕도록 설계됐다.
ByteDance가 성공할 경우 Meta의 Quest 헤드셋 및 Apple의 Vision Pro와도 보다 직접적으로 경쟁할 수 있다. 두 회사 모두 가상현실과 혼합현실에 대규모로 투자해 왔지만, 이 기기들은 아직 널리 사용되지는 않고 있다.
Seedance는 ByteDance의 주요 AI 제품 중 하나로 자리 잡았다. ByteDance의 영상 편집 플랫폼 CapCut과 중국에서 가장 인기 있는 AI 챗봇 Doubao를 비롯한 회사 제품을 지원하며, 크리에이터와 영화 스튜디오, AI 스타트업도 사용하고 있다.
ByteDance는 중국에서 Alibaba, DeepSeek, Moonshot AI와 치열한 AI 경쟁도 계속 벌이고 있다.
이 회사는 AI 모델과 칩, 데이터센터에도 막대한 비용을 투입하고 있다. Bloomberg는 지난주 ByteDance가 AI 프로젝트를 확대하는 가운데 300억 달러 규모의 대출을 확보했다고 보도했다.
