TOPIC
생성형 AI
생성형 AI 관련 콘텐츠 165건입니다. 주장과 팩트를 분리하고 검증 단계를 표기했습니다.
미드저니의 전신 초음파 스캐너 개발과 헬스케어 사업 진출
미검이미지 생성 인공지능 기업 미드저니가 하드웨어 기반의 헬스케어 시장에 진출합니다. 전신 초음파 스캐너를 활용한 진단 서비스와 전용 스파 사업을 통해 예방 의학 분야를 공략합니다.
몰모모션: 언어 기반 3D 동작 예측 모델 공개
검증앨런 AI 연구소가 언어 기반 3D 동작 예측 모델 '몰모모션(MolMoMotion)'을 공개했습니다. 이 모델은 비디오 프레임, 3D 지점, 텍스트 설명을 기반으로 미래 움직임을 예측합니다. 로봇 제어 및 영상 생성 분야에 활용될 것으로 기대됩니다.
구글의 AI 검색 최적화 가이드 내 LLMs.txt 사용 허용
검증구글이 생성형 AI 검색 최적화 가이드를 수정하여 웹사이트 운영자의 LLMs.txt 파일 사용을 공식적으로 허용했습니다. 해당 파일은 구글 검색 결과에 영향을 미치지 않으나 타 AI 서비스와의 호환성을 위해 활용 가능합니다.
아마존 세이지메이커 AI 컨테이너 이미지 캐싱 도입
검증아마존 세이지메이커 AI가 컨테이너 이미지 캐싱 기능을 새롭게 도입했습니다. 이 기술은 인스턴스 시작 시 발생하는 이미지 다운로드 지연을 제거하여 생성형 AI 모델의 확장 속도를 개선합니다.
데이터 저널리스트 에이전트: 데이터 기반의 검증 가능한 멀티모달 뉴스 자동화
미검케빈 칭홍 린 등 연구진은 원시 데이터를 신뢰할 수 있는 멀티모달 스토리로 변환하는 멀티 에이전트 프레임워크 'Data2Story'를 개발했습니다. 이 시스템은 데이터 분석부터 시각화까지 전 과정을 자동화하며, 모든 기사 내용에 대한 근거를 추적하여 투명성을 확보합니다.
옴니디렉터(OmniDirector): 다중 샷 영상 생성을 위한 카메라 모션 복제 기술 개발
미검연구진은 교차 쌍 데이터 없이도 정교한 카메라 움직임을 복제하는 옴니디렉터 프레임워크를 발표했습니다. 이 기술은 백만 단위 규모의 데이터셋을 학습하여 영상 생성 모델의 연출 제어 능력을 획기적으로 개선합니다.
마이크로소프트, 영상 생성 모델 미라지 공개
검증마이크로소프트 연구진이 3차원 공간 정보를 잠재 공간에 직접 저장하는 영상 생성 모델 미라지를 발표했습니다. 기존 모델 대비 연산 속도와 메모리 효율을 획기적으로 개선하며 공간 일관성을 확보했습니다.
아바타 AI의 인도 시장 맞춤형 영상 생성 모델 바리아 출시
검증아바타 AI가 인도 시장을 겨냥해 연산 효율을 극대화한 영상 생성 모델 바리아를 공개했습니다. 기존 모델 대비 생성 속도는 10배 이상 빠르고 비용은 20배 저렴합니다. 인도 정부의 AI 육성 정책과 맞물려 현지 개발 생태계 확산이 기대됩니다.
콰이(Kwai) 연구팀, 256K 컨텍스트 처리 가능한 멀티모달 모델 Keye-VL-2.0 공개
미검콰이 연구팀이 긴 영상 이해와 에이전트 지능에 특화된 오픈소스 멀티모달 모델 Keye-VL-2.0을 발표했습니다. 이 모델은 전문가 혼합(MoE) 구조와 딥시크 희소 어텐션(DSA)을 결합해 효율적인 장시간 영상 분석을 가능하게 합니다.
위성 사진으로 3D 도시 구현하는 생성형 AI 모델 'ABot-Earth 0.5' 공개
미검글로벌 연구진이 위성 이미지를 기반으로 대규모 3D 환경을 생성하는 프레임워크 'ABot-Earth 0.5'를 발표했습니다. 이 기술은 3D 가우시안 스플래팅 방식을 활용해 1제곱킬로미터당 10분 이내에 고해상도 3D 지형을 구축합니다.