최신 뉴스
오늘의 주요 소식을 한눈에 정리합니다
#news#이란#AI#미국

원본 기사

HiDream Unveils HiDream-O1-Video-1.0, a Native Omnimodal Video Model Built for Physical Consistency #HiDreamAI
HiDream Unveils HiDream-O1-Video-1.0, a Native Omnimodal Video Model Built for Physical Consistency #HiDreamAI
Media OutReach Newswire media-outreach.com
🕐 2026년 9월 17일 PM 03:15
기사

HiDream.ai, 물리 법칙 반영한 옴니모달 영상 생성모델 'HiDream V1' 공개

HiDream.ai가 텍스트·이미지·영상을 입력받아 오디오까지 동기화 생성하는 1080p 옴니모달 영상모델을 출시했다.
Thu Sep 17 2026

중국 AI 스타트업 HiDream.ai가 텍스트, 이미지, 영상을 함께 입력받아 오디오까지 자동 동기화해 생성하는 옴니모달 영상 생성 모델 'HiDream-O1-Video-1.0'(HiDream V1)을 공개했다. 창작 의도에 대한 깊은 이해와 실제 물리 법칙 구현을 목표로 설계된 이 모델은 5~20초 분량의 1080p 고화질 영상을 만들어낸다.

창작 의도와 물리적 일관성을 함께 구현

HiDream V1은 단순히 텍스트를 영상으로 바꾸는 수준을 넘어, 사용자의 창작 의도를 깊이 파악하고 실제 물리 법칙에 부합하는 영상을 생성하는 데 초점을 맞췄다. 회사 측은 이를 '물리적 일관성'을 갖춘 모델이라고 설명했으며, 이는 최근 생성형 AI 업계에서 두드러지는 화두인 월드 모델 접근과 맞닿아 있다.

텍스트·이미지·영상 통합 입력에 오디오 자동 생성

이 모델은 텍스트, 이미지, 영상을 모두 입력값으로 받는 멀티모달 구조를 갖췄으며, 5초에서 20초 길이의 1080p 고해상도 영상을 만들어낸다. 특히 영상 생성과 동시에 오디오가 자연스럽게 동기화 생성되는 점이 특징으로, 별도의 음성·효과음 합성 단계 없이도 완결된 콘텐츠를 만들 수 있다.

물리 AI 전략의 일환

HiDream.ai는 비슷한 시기에 로봇의 물리적 상호작용을 위한 체화 AI 모델 'HiDream-O1-Embodied'와, 텍스트·이미지 한 장으로 탐험 가능한 3D 공간을 만드는 'HiDream-O1-World'도 함께 공개했다. 세 모델 모두 자체 개발한 UiT(Unified Transformer) 아키텍처를 기반으로 하며, 영상·로봇·3D 공간이라는 각기 다른 영역에서 물리 세계를 정확히 모사하려는 회사의 일관된 기술 전략을 보여준다.

*출처: Media OutReach Newswire (2026-09-17)*

공유 Facebook X 이메일

관련 기사

📧 뉴스레터 구독

매일 아침 글로벌 뉴스 브리핑을 이메일로 받아보세요.

아직 무료입니다.