MARKETS
KOSPI—
KOSDAQ—
S&P 500—
NASDAQ—
USD/KRW—
BTC—
NIKKEI—
WTI—
KOSPI—
KOSDAQ—
S&P 500—
NASDAQ—
USD/KRW—
BTC—
NIKKEI—
WTI—
Wittgenhaus

2026년 9월 25일 금요일

AI 시대, 당신을 더욱 스마트하게

AI검증

생물학 파운데이션 모델 MoE 학습 최적화

엔비디아가 공개한 생물학 파운데이션 모델 학습 최적화 기술은 믹스처 오브 엑스퍼츠 아키텍처와 저정밀도 연산을 결합해 처리량을 대폭 높였습니다. 8개의 최신 그래픽 처리 장치를 활용한 벤치마크에서 기존 모델 대비 2배 이상의 성능 향상을 기록했습니다.

2026년 9월 25일

주장믹스처 오브 엑스퍼츠 아키텍처는 모든 토큰에 대해 전체 네트워크를 활성화하는 밀집형 트랜스포머와 달리, 필요한 하위 네트워크만 선택적으로 활성화하여 모델 용량을 효율적으로 확장합니다.

팩트엔비디아 트랜스포머 엔진의 그룹드 리니어 기능은 여러 전문가 모델의 연산을 개별적으로 반복하지 않고 하나의 그룹화된 작업으로 제출해 커널 실행 오버헤드를 줄였습니다.

팩트엠엑스에프피팔 블록 스케일링 8비트 정밀도 기술은 기존 비에프일육 대비 메모리 사용량을 절감하며, 엔비디아 블랙웰 그래픽 처리 장치에서 하드웨어 가속을 지원합니다.

주장생물학 파운데이션 모델은 유전체 데이터 처리를 위해 긴 시퀀스를 다루며, 이로 인해 학습 과정에서 활성화 메모리 부담이 큽니다.

팩트엔비디아의 티이 시퀀셜 에이피아이는 그룹드 리니어, 스케일드 스위글루, 라우팅 가중치 스케일링을 하나의 커널로 통합해 중간 데이터 생성 과정을 생략합니다.

교차검증믹스처 오브 엑스퍼츠 모델은 전문가 모델을 분산 배치할 때 라우팅 통신 오버헤드와 파라미터 저장 공간 문제라는 기술적 과제를 안고 있습니다.

팩트8개의 엔비디아 비이백 텐서 코어 그래픽 처리 장치를 사용한 학습 벤치마크 결과, 바이오네모 레시피는 허깅페이스 기준 모델 대비 최대 2.21배 높은 처리량을 기록했습니다.

주장저정밀도 학습 과정에서 발생하는 양자화 및 역양자화 오버헤드는 모델 성능에 영향을 주며, 엔비디아는 이를 통합된 멀티레이어 퍼셉트론 경로 내에서 처리합니다.

팩트엠엑스에프피팔은 32개의 연속적인 값에 스케일링 인자를 할당하는 블록 스케일링 방식을 채택해 수치적 범위와 정확도를 유지합니다.

출처엔비디아 기술 블로그(https://developer.nvidia.com/blog/efficient-moe-training-for-biological-foundation-models/)의 보도를 교차 검증했습니다.

관련 콘텐츠

본 기사는 전문가의 분석과 공개 자료를 기반으로 AI가 작성 후 다른 AI의 검증을 거쳐 작성됐으며 정보의 정확성과 완전성을 보장하지 않습니다. 기사 내용은 특정 투자·의사결정의 권유가 아니며, Wittgenhaus는 이를 근거로 한 행위의 결과에 책임을 지지 않습니다.

스팟

WIRE

글로벌 인텔리전스

전체보기 →

본 페이지의 정보는 공개 채널을 통해 자동 수집되는 정보로 정보의 정확성·완전성을 보장하지 않으며, Wittgenhaus의 공식 입장이 아닙니다. 이를 근거로 한 판단과 행위의 결과에 Wittgenhaus는 책임을 지지 않습니다.

버블 지표

상세보기 →

릴리즈 & 논문

전체보기 →

RELEASES

OpenAIv2.53.0

v2.53.0

GPT-5.5 모델 지원 및 Responses 타입에 tool 이름/네임스페이스가 추가되었습니다. CI 관련 버그 수정으로 NumPy 소스 빌드 및 중복 HTTPX 커버리지가 방지되었습니다.

52일 전

OpenAIv2.52.1

v2.52.1

이번 릴리즈에서는 CI(지속적 통합) 관련 변경 사항이 포함되었습니다. 구체적으로 setup-uv v5를 해당 커밋에 고정하는 작업이 진행되었습니다.

52일 전

TensorRTv1.3.0rc23

v1.3.0rc23 릴리즈

이번 릴리즈에서는 DeepSeek V4 혼합 정밀도 NVFP4 체크포인트 로딩, Gemma4 K=V 레이어 W4A8 체크포인트 로딩 지원 등 모델 지원이 강화되었습니다. 또한, VisualGen 모델에 대한 비대칭 TP 선형 구현, 멀티 프로세스 HTTP 프론트엔드 지원 등 API 개선이 이루어졌습니다. GPT-OSS 및 GLM-5의 Python KV-캐시 트랜시버 기본값 설정, MiniMax-M3 MSA 희소 어텐션 백엔드 추가 등 다양한 기능이 추가되었으며, 여러 버그 수정 및 성능 최적화가 포함되었습니다.

55일 전

OpenAIv2.52.0

v2.52.0

이번 릴리즈에서는 API에 콘텐츠 출처 확인 기능이 추가되었습니다. 또한, 클라이언트에서 Retry-After 지연 시간을 최대 2분까지 지원하도록 수정되었으며, API 키 mTLS HTTP 클라이언트 레시피 관련 문서가 업데이트되었습니다.

55일 전

OpenAIv2.51.0

v2.51.0

이번 릴리즈에서는 API에 fast tier 기능이 추가되었습니다. 또한, 해당 fast tier 기능이 헬퍼 메서드에도 적용되었습니다.

56일 전

PAPERS