TOPIC
LLM
LLM 관련 콘텐츠 116건입니다. 주장과 팩트를 분리하고 검증 단계를 표기했습니다.
오픈에이아이와 브로드컴의 자체 인공지능 칩 잘라페뇨 공개
검증오픈에이아이와 브로드컴이 거대언어모델 추론에 특화된 맞춤형 가속기 잘라페뇨를 공동 발표했습니다. 이번 협력으로 오픈에이아이는 하드웨어 설계 역량을 확보하며 인공지능 모델의 실행 비용 절감과 성능 최적화를 도모합니다.
NVIDIA NeMo AutoModel 기반 MoE 모델 미세 조정 가속화
검증NVIDIA NeMo AutoModel이 허깅페이스 트랜스포머 v5와 결합하여 대규모 언어 모델의 학습 효율을 높입니다. 기존 API 환경을 유지하면서도 학습 처리량을 최대 3.7배 향상하고 메모리 사용량을 32% 절감합니다.
오픈에이아이·브로드컴, 추론용 인공지능 칩 할라피뇨 개발
검증오픈에이아이와 브로드컴이 거대언어모델 추론에 최적화된 맞춤형 인공지능 칩 할라피뇨를 공동 개발했습니다. 이번 협력으로 인공지능 인프라의 연산 효율을 높이고 하드웨어 독립성을 강화할 계획입니다.
대규모 도구 생태계 속 LLM 에이전트의 장기 계획 능력 평가, 'PlanBench-XL' 공개
미검일리노이 대학교 어바나-샴페인(UIUC) 연구진이 대규모 도구 생태계에서 거대언어모델(LLM) 에이전트의 장기 계획 능력을 측정하는 벤치마크 'PlanBench-XL'을 발표했습니다. 이번 연구는 복잡한 도구 환경에서 에이전트의 적응형 계획 수립 한계를 진단하고 개선 방향을 제시합니다.
다국어 프로그래밍 평가 벤치마크 'Multi-LCB' 공개
미검기존 파이썬 중심의 코드 생성 평가 체계를 12개 언어로 확장한 새로운 벤치마크 'Multi-LCB'가 등장했습니다. 연구진은 이를 통해 거대언어모델의 언어별 성능 격차와 파이썬 편향성을 명확히 확인했습니다.
샘 올트먼의 AI 확장성 회의론 비판과 기술적 성취
검증샘 올트먼 오픈에이아이 최고경영자가 대규모 언어 모델의 확장성을 부정하는 회의론자들을 비판했습니다. 그는 데이터가 증명하는 확장 가능성이 인공지능 발전의 핵심 동력이라고 강조합니다.
AI 기술 혁신과 뇌-컴퓨터 인터페이스의 발전
미검인공지능 스타트업 서브쿼드라틱이 대규모 언어 모델의 연산 효율을 개선하는 기술을 발표했습니다. 이와 함께 뇌-컴퓨터 인터페이스의 임상 적용이 확대되는 등 기술 분야의 변화가 이어지고 있습니다. 기술 발전이 가져오는 사회적 영향과 정책적 대응 방안을 정리합니다.
서브쿼드라틱, LLM 연산 병목 해결 기술 공개
미검스타트업 서브쿼드라틱이 대규모 언어 모델의 연산 효율을 개선하는 새로운 아키텍처를 발표했습니다. 기존 트랜스포머 구조의 한계를 극복하고 비용과 속도 면에서 유의미한 성과를 거뒀습니다.
인공지능의 의식 논란과 에이지 오브 엠파이어 2의 비판적 시각
미검거대언어모델의 의식 보유 논란이 지속되는 가운데, 이를 지나친 의인화로 보는 시각이 제기됩니다. 게임 내 신경망 구현 실험을 통해 인공지능의 작동 원리와 의식 논란의 허점을 분석합니다.
의료용 거대언어모델의 데이터 암기 현상과 환자 정보 유출 위험
검증의료용 거대언어모델이 학습 데이터를 단순 학습하는 단계를 넘어 그대로 암기하는 현상이 확인되었습니다. 이러한 암기 데이터는 미세 조정 이후에도 잔존하여 환자 개인정보 유출 등 심각한 보안 문제를 야기할 수 있습니다. 연구진은 의료 데이터의 특수성이 이러한 현상을 심화시킨다고 분석했습니다.