인사이트
vLLM, v0.18.1 릴리즈: 성능 및 안정성 개선
검증vLLM 프로젝트가 v0.18.1 패치 릴리즈를 통해 성능 최적화와 버그 수정을 완료했습니다. 이번 업데이트는 특히 SM100 MLA 프리필 백엔드 변경 및 딥젬(DeepGemm) 정확도 문제 해결에 중점을 두었습니다.
LangChain 1.2.14, 초기화 속도 15% 개선
검증LangChain이 최신 버전 1.2.14를 출시하며 주요 성능 개선과 보안 업데이트를 적용했습니다. 이번 업데이트는 특히 에이전트 생성 시 재귀 한계 관련 버그를 수정하고 초기화 속도를 15% 단축하는 데 중점을 두었습니다.
DeepSpeed v0.18.9, AutoTP 기능 강화
검증Microsoft DeepSpeed가 v0.18.9 버전을 출시하며 AutoTP 기능과 최적화 지원을 강화했습니다. 이번 업데이트는 대규모 언어 모델 학습 효율성을 높이는 데 기여할 것으로 기대됩니다.
LangChain 코어 1.2.23 릴리즈
검증LangChain 코어 라이브러리가 1.2.23 버전으로 업데이트되었습니다. 이번 릴리즈는 이전 버전의 특정 수정 사항을 롤백하고, 의존성 라이브러리인 requests를 최신 버전으로 업데이트하는 데 중점을 두었습니다.
LangChain, 텍스트 파일 오류 수정 및 문서 개선
검증LangChain이 최신 버전인 langchain-core 1.2.25를 출시했습니다. 이번 업데이트는 텍스트 파일 관련 오류 수정과 문서 개선에 초점을 맞추고 있습니다.
Meta Llama Stack v0.6.1 릴리즈: 안정성 강화 및 새 튜토리얼 추가
검증Meta Llama Stack이 v0.6.1 버전으로 업데이트되어 CI 환경의 안정성이 향상되고, Agentic flows 튜토리얼이 추가되었습니다. 이번 업데이트는 사용자 경험 개선과 개발 편의성 증대에 초점을 맞추고 있습니다.
Anthropic SDK, Vertex AI 멀티 리전 지원 추가
검증Anthropic SDK가 최신 버전 v0.89.0을 출시하며 Vertex AI의 미국 멀티 리전 엔드포인트 지원을 추가했습니다. 이번 업데이트는 클라이언트 측 컴팩션 헬퍼의 지원 중단과 함께 클라이언트의 쿼리 파라미터 처리 방식 개선도 포함합니다.
Anthropic SDK, v0.88.0 출시
검증Anthropic SDK가 v0.88.0 버전으로 업데이트되었습니다. 이번 업데이트는 메시지 응답에 구조화된 중단 세부 정보 추가, Bedrock API 키 인증 지원, AWS 패키지 준비 등 주요 기능 개선을 포함합니다.
LangChain, OpenAI 파일 입력 지원 강화
검증LangChain이 최신 버전인 langchain-core 1.2.24를 출시하며 OpenAI 파일 입력 기능에 대한 지원을 개선했습니다. 이번 업데이트는 사용자 편의성 증대와 보안 강화에 초점을 맞추고 있습니다.
LangChain, Bedrock 모델 지원 강화
검증LangChain이 최신 버전 `langchain-core==1.2.26`을 출시하며 Amazon Bedrock 모델에 대한 초기화 검증 및 직렬화 기능을 추가했습니다. 이번 업데이트는 개발자들이 다양한 LLM 모델을 더욱 안정적으로 통합하고 활용할 수 있도록 지원합니다.
스팟
WIRE- TG덴마크 러시아 대응 군대 동원 확대2시간 전
- TG러시아 주요 정유소에 우크라이나 무인기 공격 후 가솔린 배급 제한 재도입9시간 전
- TG러시아군, 우크라이나 최대 온라인 마켓 웨어하우스 공격1일 전
- TG젤렌스키, 러시아 대규모 공격서 1발만 요격 이유 설명2일 전
- TG젤렌스키, 우크라이나 전사자 5만명 넘어3일 전
- TG러시아 도즈데이 라디오, 우크라이나 공격 후 암호 메시지 전송3일 전
- TG네팔 호랑이 개체수 2010년 이후 4배 증가5일 전
- TG루마니아, 3일 만에 3번째 러시아 무인기 격추7일 전
- TG우크라이나, 카스피해 이란 선박 공격, 테헤란 "선원 1명 사망8일 전
- TG젤렌스키, 러시아 방공망 공격 확인9일 전
글로벌 인텔리전스
전체보기 →본 페이지의 정보는 공개 채널을 통해 자동 수집되는 정보로 정보의 정확성·완전성을 보장하지 않으며, Wittgenhaus의 공식 입장이 아닙니다. 이를 근거로 한 판단과 행위의 결과에 Wittgenhaus는 책임을 지지 않습니다.
버블 지표
상세보기 →많이 본 콘텐츠
마이크로소프트, 오픈소스 에이전트 AI 프레임워크 Orchard 공개
AI의 수학 난제 해결과 에르되시 문제의 새로운 국면
빌 하처의 고급 링크 빌딩 무료 교육 과정 공개
메타, 광고 추천 모델 GEM 학습 효율 2배 향상
IBM 보고서: AI 보안 침해 기업 92%의 기본 접근 제어 부재
릴리즈 & 논문
전체보기 →RELEASES
v2.53.0
GPT-5.5 모델 지원 및 Responses 타입에 tool 이름/네임스페이스가 추가되었습니다. CI 관련 버그 수정으로 NumPy 소스 빌드 및 중복 HTTPX 커버리지가 방지되었습니다.
17시간 전
v2.52.1
이번 릴리즈에서는 CI(지속적 통합) 관련 변경 사항이 포함되었습니다. 구체적으로 setup-uv v5를 해당 커밋에 고정하는 작업이 진행되었습니다.
22시간 전
v1.3.0rc23 릴리즈
이번 릴리즈에서는 DeepSeek V4 혼합 정밀도 NVFP4 체크포인트 로딩, Gemma4 K=V 레이어 W4A8 체크포인트 로딩 지원 등 모델 지원이 강화되었습니다. 또한, VisualGen 모델에 대한 비대칭 TP 선형 구현, 멀티 프로세스 HTTP 프론트엔드 지원 등 API 개선이 이루어졌습니다. GPT-OSS 및 GLM-5의 Python KV-캐시 트랜시버 기본값 설정, MiniMax-M3 MSA 희소 어텐션 백엔드 추가 등 다양한 기능이 추가되었으며, 여러 버그 수정 및 성능 최적화가 포함되었습니다.
3일 전
v2.52.0
이번 릴리즈에서는 API에 콘텐츠 출처 확인 기능이 추가되었습니다. 또한, 클라이언트에서 Retry-After 지연 시간을 최대 2분까지 지원하도록 수정되었으며, API 키 mTLS HTTP 클라이언트 레시피 관련 문서가 업데이트되었습니다.
4일 전
v2.51.0
이번 릴리즈에서는 API에 fast tier 기능이 추가되었습니다. 또한, 해당 fast tier 기능이 헬퍼 메서드에도 적용되었습니다.
4일 전
PAPERS
기계 번역의 효율적인 추론 배포를 위한 양자화 트레이드오프 연구
4일 전
DungeonBench: 던전앤드래곤 전투에서의 규칙 기반 전술 추론 벤치마크
4일 전
Few-shot, Zero-shot, Continual, In-context Learning을 통합한 엣지에서의 다목적 온디바이스 적응
4일 전
생각하는 번역: 강화학습을 통한 다중 도메인 기계 번역의 난이도 적응형 추론
4일 전
MirrorCraft: 마인크래프트 내 숨겨진 규칙 변화 하에서의 쌍대 평가
4일 전
LLM 에이전트에서의 메모리 출처 세탁: 지속적 메모리를 위한 비증폭 방화벽
4일 전
Zero-Mem: LLM 에이전트를 위한 제로 토큰 메모리 연산
4일 전
Zero-Shot LLM으로 아동 영양실조를 예측할 수 있는가? 공정성 및 시간적 견고성 연구
4일 전
AgentHPOBench: 순차적 하이퍼파라미터 최적화 도구로서의 LLM 에이전트 평가 벤치마크
4일 전
MOT-SR: LLM을 활용한 다목적 도구 증강 과학 방정식 발견
4일 전