블랙 포레스트 랩스, 멀티모달 비디오 생성 모델 플럭스 3 공개
블랙 포레스트 랩스가 이미지와 비디오, 오디오를 통합한 멀티모달 모델 플럭스 3를 선보였습니다. 해당 모델은 최대 20초 분량의 영상을 생성하며 물리적 환경을 이해하는 행동 예측 기능을 갖췄습니다.
주장블랙 포레스트 랩스는 플럭스 3를 통해 현실 세계의 시각 지능을 구현합니다. 이 모델은 물리적 환경과 디지털 환경을 동시에 인식하고 예측하며 행동하는 것을 목표로 합니다.
팩트플럭스 3는 이미지와 비디오, 오디오를 통합 학습하는 멀티모달 파운데이션 모델입니다. 이 모델은 최대 20초 길이의 영상을 생성하며, 영상에 맞는 네이티브 오디오를 동시에 생성합니다.
팩트초기 평가 결과에서 플럭스 3는 경쟁 모델 대비 높은 선호도를 기록했습니다. 루마 레이 3.2와 비교해 93퍼센트, 런웨이 젠-4.5와는 77퍼센트의 선호도를 보였습니다.
팩트클링 v3 프로와의 비교에서는 60퍼센트, 제미나이 옴니 플래시와는 52퍼센트의 선호도를 기록했습니다.
교차검증현재 공개된 성능 지표는 블랙 포레스트 랩스의 자체 평가 결과입니다. 독립적인 제3자 기관의 검증은 아직 이루어지지 않았으므로 결과 해석에 주의가 필요합니다.
팩트블랙 포레스트 랩스는 미믹 로보틱스와 협력하여 플럭스-미믹 모델을 개발했습니다. 이 모델은 영상 기반의 행동 예측 모델로, 현재 아우디의 생산 공정에서 테스트를 진행하고 있습니다.
주장회사는 단일 모달리티만으로는 현실을 완벽하게 포착할 수 없다고 판단합니다. 이미지와 비디오, 오디오를 함께 학습함으로써 모델은 데이터 간의 공백을 메우고 더 높은 수준의 정보를 습득합니다.
팩트플럭스 3는 셀프-플로우 방식을 기반으로 작동합니다. 멀티모달 트랜스포머를 통해 데이터를 공유 내부 표현으로 변환하며, 기존 플로우 매칭 방식보다 생성 품질과 물리 세계에 대한 이해도가 높습니다.
팩트블랙 포레스트 랩스는 플럭스 3의 기능을 단계적으로 공개합니다. 플럭스 3 비디오는 이미 사용 가능하며, 플럭스 3 이미지는 수주 내에 얼리 액세스로 출시할 계획입니다.
교차검증향후 오픈 웨이트 모델인 플럭스 3 데브가 공개될 예정입니다. 다만 행동 예측 기능은 초기 단계에서 선별된 파트너에게만 제한적으로 제공하며, 이는 안전성과 피드백 수집을 위한 전략적 결정입니다.
주장이번 모델 공개는 인공지능이 단순한 콘텐츠 생성을 넘어 물리적 환경을 이해하는 단계로 진입했음을 시사합니다. 향후 로보틱스와 산업 현장에서의 활용도가 높아질 전망입니다.
출처더 디코더 및 블랙 포레스트 랩스 공식 블로그를 교차 검증했습니다.
본 기사는 전문가의 분석과 공개 자료를 기반으로 AI가 작성 후 다른 AI의 검증을 거쳐 작성됐으며 정보의 정확성과 완전성을 보장하지 않습니다. 기사 내용은 특정 투자·의사결정의 권유가 아니며, Wittgenhaus는 이를 근거로 한 행위의 결과에 책임을 지지 않습니다.

