MARKETS
KOSPI
KOSDAQ
S&P 500
NASDAQ
USD/KRW
BTC
NIKKEI
WTI
KOSPI
KOSDAQ
S&P 500
NASDAQ
USD/KRW
BTC
NIKKEI
WTI
Wittgenhaus

2026년 7월 27일 월요일

AI 시대, 당신을 더욱 스마트하게

TOPIC

AI 연구

AI 연구 관련 콘텐츠 152건입니다. 주장과 팩트를 분리하고 검증 단계를 표기했습니다.

연합 학습 기반 간 병변 탐지 기술 페드오지 개발

검증

연구진이 다기관 데이터를 활용해 간 병변을 정확히 탐지하는 연합 학습 모델 페드오지를 개발했습니다. 이 기술은 데이터 이질성을 극복하고 의료 정보 보호와 모델 성능 향상을 동시에 달성합니다.

AI·48일 전

소설 속 인물처럼 행동하는 AI, ArcANE 벤치마크로 캐릭터 일관성 검증

미검

연구진은 소설 속 인물의 심리적 변화를 추적하여 역할 수행 언어 모델의 연기 능력을 평가하는 ArcANE 벤치마크를 공개했습니다. 이 평가 도구는 기존 모델들이 소설 외부 상황에서도 캐릭터의 성격 변화를 유지하도록 유도합니다.

AI·50일 전

강화학습 모델 성능 향상을 위한 학습 하니스 품질 개선 전략

미검

강화학습 모델의 성능 저하는 모델 자체의 결함보다 학습 환경인 학습 하니스의 불안정성에서 기인합니다. 모델의 실전 적용을 위해서는 소프트웨어 공학적 관점에서 환경 오류를 제어하고 데이터 품질을 확보하는 노력이 필요합니다.

AI·51일 전

벤처캐피털 벤치마크의 20억 달러 규모 펀드 조성과 전략 변화

검증

벤처캐피털 벤치마크가 20년 만에 기존 펀드 규모 제한 전략을 폐기하고 20억 달러 규모의 자금을 조성했습니다. 이번 변화는 인공지능 분야의 대규모 투자 수요에 대응하기 위한 결정입니다.

경제·52일 전

이데오그램 4.0 오픈 웨이트 모델 공개와 텍스트 렌더링 성능 강화

검증

이데오그램이 텍스트 렌더링과 정밀한 레이아웃 제어 기능을 갖춘 오픈 웨이트 모델 4.0을 공개했습니다. 사용자는 파트너 플랫폼을 통해 모델을 활용할 수 있으며 상업적 이용 시 별도의 라이선스가 필요합니다.

AI·53일 전

한국형 웹 브라우징 AI 성능 평가 벤치마크 K-BrowseComp 공개

미검

한국어 맥락을 반영한 웹 브라우징 에이전트 성능 평가 도구인 K-BrowseComp가 새롭게 발표되었습니다. 최신 거대언어모델(LLM)들이 한국어 기반의 복잡한 웹 탐색 작업에서 낮은 정확도를 보이며 기술적 한계를 드러냈습니다.

AI·54일 전

AI 에이전트 성능 평가의 한계 돌파, 자동화 벤치마크 생성 기술 TASTE 공개

미검

IBM 연구진이 기존 AI 에이전트 평가 체계의 포화 문제를 해결하기 위해 자동화된 벤치마크 생성 프레임워크 TASTE를 발표했습니다. 이 기술은 도구 사용 조합을 대폭 확장하고 난이도를 진화시켜, 기존 모델들의 성능 거품을 효과적으로 식별합니다.

AI·54일 전

인공지능의 인간 인지 및 사회적 영향력 측정 체계 도입

검증

인공지능 기술이 인간의 인지 능력과 대인 관계에 미치는 영향력을 체계적으로 측정해야 한다는 목소리가 높습니다. 현재의 기술 중심적 성능 평가를 넘어 인간의 복지를 고려한 새로운 평가 지표 마련이 시급합니다.

AI·54일 전

매사추세츠 대학교 등 연구진, 데이터 직접 탐색하는 AI 에이전트 'GrepSeek' 개발

미검

매사추세츠 대학교 애머스트 캠퍼스 등 공동 연구진이 거대언어모델이 외부 검색 엔진 없이 직접 말뭉치를 탐색하는 기술을 선보였습니다. 기존 방식보다 검색 속도를 최대 7.6배 높였으며, 7개 오픈 도메인 질의응답 벤치마크에서 최고 성능을 기록했습니다.

AI·55일 전

엔비디아 네모트론 3 울트라의 미국 오픈 모델 성능 1위 달성

미검

엔비디아의 인공지능 모델 네모트론 3 울트라가 미국 오픈 모델 중 최고 성능을 기록했습니다. 빠른 처리 속도를 바탕으로 인공지능 인프라 시장에서의 영향력을 확대하고 있습니다. 다만 중국 모델과의 성능 격차는 여전히 존재합니다.

AI·55일 전

다른 주제