MARKETS
KOSPI
KOSDAQ
S&P 500
NASDAQ
USD/KRW
BTC
NIKKEI
WTI
KOSPI
KOSDAQ
S&P 500
NASDAQ
USD/KRW
BTC
NIKKEI
WTI
Wittgenhaus

2026년 7월 27일 월요일

AI 시대, 당신을 더욱 스마트하게

TOPIC

AI 연구

AI 연구 관련 콘텐츠 152건입니다. 주장과 팩트를 분리하고 검증 단계를 표기했습니다.

에이전트 강화학습 효율 높이는 APPO 알고리즘 공개

미검

왕쉬총 등 연구진이 대규모 언어 모델 에이전트의 의사결정 효율을 극대화하는 APPO 알고리즘을 발표했습니다. 이 기술은 기존의 거친 단위 학습 방식을 개선해 13개 벤치마크에서 성능을 4포인트 향상했습니다.

AI·41일 전

구글 제미나이-SQL2의 텍스트-SQL 벤치마크 1위 달성

미검

구글 리서치가 개발한 제미나이-SQL2가 텍스트-SQL 변환 벤치마크인 BIRD에서 1위를 차지했습니다. 해당 모델은 복잡한 비즈니스 로직을 정확한 데이터베이스 쿼리로 변환하는 능력을 입증했습니다.

AI·43일 전

거대언어모델 에이전트의 기억 진화 추적 기술 '에보아레나' 개발

미검

연구진은 변화하는 환경에 적응하는 거대언어모델(LLM) 에이전트의 성능을 평가하는 벤치마크 '에보아레나'를 공개했습니다. 또한 기억의 변화를 구조적으로 기록하는 '에보멤' 기법을 통해 에이전트의 추론 능력을 향상했습니다.

AI·44일 전

AI 에이전트 실무 능력 평가 벤치마크 'ALE' 등장

미검

최근 AI 시스템이 다양한 벤치마크에서 높은 점수를 기록함에도 실제 경제적 성과로 이어지지 않는 문제를 해결하기 위해 새로운 평가 체계가 개발되었습니다. 250명 이상의 산업 전문가가 참여한 'ALE'는 실무 현장의 복잡한 과업을 수행하는 AI 에이전트의 능력을 검증합니다.

AI·46일 전

아마존 세이지메이커와 엔비디아 아이작 랩을 활용한 로봇 강화학습 가속화

검증

물리 인공지능이 연구 단계를 넘어 실제 생산 현장에 도입되고 있습니다. 아마존 세이지메이커와 엔비디아 아이작 랩은 로봇 학습 시간을 획기적으로 단축하며 효율적인 인프라 환경을 제공합니다.

AI·47일 전

이중언어 음성 인식 모델의 코드 스위칭 성능 분석

검증

서비스나우 AI 팀이 이중언어 사용자의 발화를 처리하는 음성 인식 모델 벤치마크 결과를 공개했습니다. 코드 스위칭 환경에서 모델별 정확도와 의미 보존 능력을 평가했습니다. 기업용 AI 도입을 위한 핵심 지표와 모델별 성능 차이를 분석합니다.

AI·47일 전

거대언어모델 온폴리시 증류의 기하학적 구조와 학습 역학 규명

미검

연구진은 온폴리시 증류(OPD)가 거대언어모델의 추론 능력을 향상하는 과정에서 나타나는 파라미터 공간의 변화를 분석했습니다. 연구 결과 OPD는 지도 미세 조정(SFT)이나 강화 학습(RLVR)과는 차별화된 고유의 학습 기하학적 구조를 형성함을 확인했습니다.

AI·47일 전

소프트웨어 개발 에이전트의 코드 탐색 능력 평가 벤치마크 'SWE-Explore' 공개

미검

최근 연구진은 코딩 에이전트의 저장소 탐색 능력을 정밀하게 측정하는 새로운 벤치마크인 'SWE-Explore'를 발표했습니다. 이 도구는 기존의 이분법적 평가 방식을 넘어 에이전트의 코드 위치 파악과 맥락 이해 능력을 다각도로 분석합니다.

AI·47일 전

거대언어모델 중재 능력 평가 프레임워크 'SoCRATES' 공개

미검

국내 연구진이 거대언어모델(LLM)의 갈등 중재 능력을 정밀하게 평가하는 새로운 벤치마크 'SoCRATES'를 개발했습니다. 실제 갈등 상황을 반영한 8개 도메인에서 모델의 사회적 적응력을 측정하며 기존 평가 방식의 한계를 극복했습니다.

AI·48일 전

오픈소스 에이전트 학습을 위한 OpenEnv 표준화 추진

검증

오픈소스 커뮤니티가 에이전트 강화학습 환경을 통합하는 OpenEnv 표준화를 시작합니다. 주요 AI 기업과 연구소들이 참여하여 파편화된 학습 환경을 개선하고 범용 인터페이스를 구축합니다.

AI·48일 전

다른 주제