MARKETS
KOSPI
KOSDAQ
S&P 500
NASDAQ
USD/KRW
BTC
NIKKEI
WTI
KOSPI
KOSDAQ
S&P 500
NASDAQ
USD/KRW
BTC
NIKKEI
WTI
Wittgenhaus

2026년 7월 27일 월요일

AI 시대, 당신을 더욱 스마트하게

TOPIC

생성형 AI

생성형 AI 관련 콘텐츠 165건입니다. 주장과 팩트를 분리하고 검증 단계를 표기했습니다.

블랙 포레스트 랩스, 멀티모달 비디오 생성 모델 플럭스 3 공개

미검

블랙 포레스트 랩스가 이미지와 비디오, 오디오를 통합한 멀티모달 모델 플럭스 3를 선보였습니다. 해당 모델은 최대 20초 분량의 영상을 생성하며 물리적 환경을 이해하는 행동 예측 기능을 갖췄습니다.

AI·3일 전

허깅페이스, 디퓨저스 라이브러리에 넌차쿠 라이트 도입

검증

허깅페이스가 대규모 확산 모델의 접근성을 높이기 위해 넌차쿠 라이트를 디퓨저스 라이브러리에 통합했습니다. 이번 업데이트로 일반 소비자용 그래픽 처리 장치에서도 고성능 모델을 효율적으로 구동할 수 있게 되었습니다.

AI·3일 전

신테시아, 실시간 AI 코칭 플랫폼 시장 진출

검증

신테시아가 대화형 교육 서비스인 롤플레이 세션을 출시하며 영상 생성 기술을 넘어 실시간 코칭 시장으로 영역을 확장합니다. 기업은 AI 아바타와 연습하며 직원들의 성과를 정량적으로 분석할 수 있습니다.

AI·4일 전

TimeLens2: 영상 내 사건 발생 시점 정밀 추적하는 멀티모달 거대언어모델 개발

미검

TimeLens2는 영상 내 특정 사건이 발생하는 시간 구간을 정확히 찾아내는 범용 멀티모달 거대언어모델입니다. 기존 모델 대비 파라미터 규모는 획기적으로 줄이면서도 성능은 최상위 수준을 달성했습니다.

AI·5일 전

RESOURCE2SKILL: 인간의 멀티모달 자원을 소프트웨어 에이전트 기술로 변환하는 프레임워크

미검

RESOURCE2SKILL은 튜토리얼 영상, 코드 저장소 등 인간이 만든 멀티모달 자원을 소프트웨어 에이전트가 실행 가능한 기술로 추출하는 새로운 프레임워크입니다. 이 기술은 에이전트의 작업 수행 능력을 기존 대비 11.9%포인트 향상하며 소프트웨어 자동화의 효율성을 높입니다.

AI·5일 전

알리바바 Qwen-Audio-3.0-TTS-Plus 음성 합성 리더보드 1위 달성

검증

알리바바의 신규 음성 합성 모델 Qwen-Audio-3.0-TTS-Plus가 아티피셜 애널리시스 스피치 아레나에서 1위를 차지했습니다. 다국어 지원과 자연스러운 감정 표현 기능을 앞세워 글로벌 시장 공략에 나섭니다.

AI·5일 전

알리바바, 오픈 웨이트 모델 Qwen 3.8 공개와 성능 전략

미검

알리바바가 최신 오픈 웨이트 모델인 Qwen 3.8을 공개했습니다. 이 모델은 2.4조 개의 파라미터를 갖춘 멀티모달 모델로 생산성 도구 시장 공략을 목표로 합니다.

AI·7일 전

엔비디아-허깅페이스, 확산 모델 미세조정 협력 강화

검증

엔비디아와 허깅페이스가 대규모 확산 모델의 효율적인 학습을 위해 기술 협력을 진행합니다. 양사는 NeMo Automodel 라이브러리를 통합하여 개발자에게 최적화된 미세조정 환경을 제공합니다.

AI·9일 전

비디오 이해의 새로운 표준, 완전 공개형 MLLM 'VideoChat3' 등장

미검

VideoChat3는 효율성과 범용성을 동시에 갖춘 완전 공개형 비디오 멀티모달 대규모 언어 모델입니다. 40억 개의 파라미터만으로 기존 대형 모델을 능가하는 성능을 입증하며 비디오 이해 기술의 새로운 지평을 열었습니다.

AI·9일 전

Boogu-Image-0.1, 저비용 고성능 멀티모달 모델 공개

미검

Boogu-Image-0.1 연구진은 오픈소스 통합 멀티모달(multimodal) 이해 및 생성 모델을 공개했습니다. 이 모델은 제한된 컴퓨팅 자원 아래에서도 고품질 텍스트-이미지 생성, 빠른 추론, 지시 기반 편집, 그리고 이중 언어 텍스트 렌더링에서 경쟁력 있는 성능을 보입니다. 특히 선두적인 비공개 모델에 근접하는 결과를 저비용으로 달성했습니다.

AI·10일 전

다른 주제