중국 미니맥스 H3, 오픈 모델 최초 영상 생성 순위 1위 달성
중국 인공지능 기업 미니맥스가 공개한 H3 모델이 영상 생성 분야에서 오픈 모델 최초로 1위를 기록했습니다. 이번 모델 공개로 폐쇄형 모델 위주였던 시장 판도 변화가 예상됩니다.
주장중국 인공지능 기업 미니맥스가 공개한 H3 모델이 영상 생성 분야에서 오픈 모델 최초로 순위 1위를 기록했습니다. 이는 폐쇄형 모델이 주도하던 영상 생성 인공지능 시장의 흐름을 바꾸는 사건입니다.
팩트아티피셜 애널리시스 순위에 따르면 미니맥스 H3는 영상 편집 부문에서 1위, 텍스트 투 비디오 부문에서 2위, 이미지 투 비디오 부문에서 3위를 차지했습니다. 이 모델은 330억 개의 매개변수를 사용하여 텍스트와 이미지, 영상, 오디오를 동시에 처리합니다.
팩트H3 모델은 4초에서 15초 분량의 영상을 생성하며 스테레오 사운드를 함께 제공합니다. 사용자는 하나의 프롬프트에 최대 9개의 참조 이미지와 3개의 영상 클립, 3개의 오디오 클립을 포함할 수 있습니다.
교차검증모델의 모든 기능이 공개된 것은 아닙니다. 2K 해상도 모듈과 프롬프트를 구조화된 형식으로 변환하는 H3-컨텍스트-IR 기술은 비공개 상태입니다.
팩트사용자가 컴피유아이를 통해 H3를 로컬 환경에서 실행할 경우 최대 해상도는 768p로 제한됩니다. 사용자는 미니맥스가 제공하는 프롬프트 가이드를 참고하여 직접 컨텍스트를 준비해야 합니다.
주장이번 오픈 웨이트 공개는 개발자가 특정 영상 스타일이나 캐릭터를 학습시키기 위한 파인튜닝을 가능하게 합니다. 이는 오픈 소스 생태계의 확장을 의미하며 다양한 창작 활동을 지원합니다.
교차검증상업적 이용에는 제한이 존재합니다. 연간 매출이 2천만 달러 미만인 기업만 상업적 목적으로 모델을 사용할 수 있다는 라이선스 규정이 있습니다.
팩트미니맥스가 H3를 공개한 같은 날, 바이트댄스 역시 폐쇄형 모델인 시댄스 2.5를 발표했습니다. 시댄스 2.5는 오디오가 포함된 30초 분량의 영상을 생성할 수 있는 기능을 갖췄습니다.
주장중국 기업들은 영상 생성 인공지능 분야에서 기술적 우위를 점하기 위해 치열하게 경쟁합니다. 미니맥스의 오픈 모델 전략은 기술 표준을 선점하려는 의도로 풀이됩니다.
주장미니맥스의 이번 행보는 오픈 소스 모델의 성능이 폐쇄형 모델을 위협하는 수준에 도달했음을 보여줍니다. 개발자 생태계의 영향력이 커질수록 시장의 기술 경쟁은 더욱 가속화됩니다.
주장향후 오픈 모델의 접근성이 높아지면 영상 제작의 진입 장벽이 낮아집니다. 이는 창작자들에게 새로운 도구를 제공하며 영상 콘텐츠 산업의 지형을 변화시킵니다.
출처더 디코더 기사와 허깅페이스 자료를 교차 검증했습니다.
관련 콘텐츠
본 기사는 전문가의 분석과 공개 자료를 기반으로 AI가 작성 후 다른 AI의 검증을 거쳐 작성됐으며 정보의 정확성과 완전성을 보장하지 않습니다. 기사 내용은 특정 투자·의사결정의 권유가 아니며, Wittgenhaus는 이를 근거로 한 행위의 결과에 책임을 지지 않습니다.

