TOPIC
AI 에이전트
AI 에이전트 관련 콘텐츠 212건입니다. 주장과 팩트를 분리하고 검증 단계를 표기했습니다.
깃허브의 AI 에이전트 전략과 인프라 확장 대응
미검깃허브가 AI 에이전트의 급격한 코드 생성량 증가에 대응하여 인프라를 확장하고 있습니다. 코파일럿 생태계를 운영체제 수준으로 고도화하는 동시에 오픈소스 생태계의 신뢰성 확보라는 과제를 안고 있습니다.
AI 에이전트 성능 평가의 한계 돌파, 자동화 벤치마크 생성 기술 TASTE 공개
미검IBM 연구진이 기존 AI 에이전트 평가 체계의 포화 문제를 해결하기 위해 자동화된 벤치마크 생성 프레임워크 TASTE를 발표했습니다. 이 기술은 도구 사용 조합을 대폭 확장하고 난이도를 진화시켜, 기존 모델들의 성능 거품을 효과적으로 식별합니다.
웹사이트 에이전트 준비도 점검을 위한 라이트하우스 활용
미검구글이 라이트하우스 도구에 에이전트 브라우징 카테고리를 추가했습니다. 웹사이트 운영자는 AI 에이전트가 정보를 원활하게 처리하도록 웹 환경을 개선해야 합니다. 새로운 평가 기준인 에이전트 준비도 확인 방법을 상세히 설명합니다.
구글, LLMs.txt의 실효성 부인 및 WebMCP 도입 권장
검증구글은 웹사이트가 AI 검색 노출을 위해 LLMs.txt 파일을 생성할 필요가 없다는 입장을 밝혔습니다. 대신 AI 에이전트의 구체적인 작업을 지원하는 WebMCP 표준을 활용할 것을 권장합니다. 웹사이트 운영자는 기술적 파일 도입보다 AI 접근성 확보에 집중해야 합니다.
엔비디아의 코스모스 3 및 네모트론 3 울트라 공개와 AI 생태계 전략
미검엔비디아가 물리 AI와 대규모 언어 모델을 결합한 새로운 모델들을 발표했습니다. 이번 공개는 단순한 모델 제공을 넘어 풀스택 전략을 통해 AI 에이전트 시장을 선점하려는 의도로 풀이됩니다.
COLLEAGUE.SKILL: 전문가 지식 증류를 통한 AI 기술 자동 생성 프레임워크
미검인간의 전문성과 행동 양식을 AI 에이전트에 이식하는 COLLEAGUE.SKILL 시스템이 공개되었습니다. 이 기술은 파편화된 데이터를 검증 가능한 기술 패키지로 변환하여 에이전트의 실무 능력을 비약적으로 향상합니다.
매사추세츠 대학교 등 연구진, 데이터 직접 탐색하는 AI 에이전트 'GrepSeek' 개발
미검매사추세츠 대학교 애머스트 캠퍼스 등 공동 연구진이 거대언어모델이 외부 검색 엔진 없이 직접 말뭉치를 탐색하는 기술을 선보였습니다. 기존 방식보다 검색 속도를 최대 7.6배 높였으며, 7개 오픈 도메인 질의응답 벤치마크에서 최고 성능을 기록했습니다.
엔비디아, 자율형 공장 운영을 위한 FOX 설계도 공개
검증엔비디아가 공장 전체의 지능화를 지원하는 팩토리 오퍼레이션 블루프린트(FOX)를 발표했습니다. 이 시스템은 AI 에이전트를 활용해 제조 현장의 생산성과 에너지 효율을 높입니다. 주요 제조 기업들이 이를 도입해 공정 개선 성과를 거두고 있습니다.
AI 에이전트 안전성 확보 위한 경량화 프레임워크 'AgentDoG 1.5' 공개
미검글로벌 연구진이 오픈월드 AI 에이전트의 보안 위험을 방어하는 경량화 프레임워크 'AgentDoG 1.5'를 발표했습니다. 단 1천 개의 샘플만으로 최상위 모델 수준의 안전성을 확보하며 배포 비용을 100배 절감했습니다.
AI 에이전트의 핵심 기술인 코드와 하니스 구조
검증인공지능 에이전트가 추론하고 행동하는 본질은 코드와 이를 뒷받침하는 하니스 환경에 있습니다. 연구진은 모델 성능을 넘어 소프트웨어 인프라가 에이전트의 경쟁력을 결정한다고 분석합니다.