CUDA 13.4 업데이트와 옴니모달 에이전트 모델 출시 #133
오늘의 레터
NVIDIA CUDA Toolkit 13.4, Windows on Arm·GPU 공유 제어 강화

- CUDA Toolkit 13.4가 Windows on Arm 지원을 추가하고 NVIDIA Rubin 아키텍처에 대한 프리뷰 기능을 제공
- Rubin은 컴퓨트 기능 107과 SM_107 컴파일 대상 지원으로 정식 지원 전 애플리케이션 포팅 가능
- Multi-Process Service V3에 스크립트 CLI, 명명 서버 인스턴스, 네임스페이스, TOML 설정 추가
- MPS V3는 SM 파티션 제어와 cgroup 연동 GPU 메모리 제한으로 컨테이너 환경의 GPU 자원 경계 설정 지원
- CUDA Compute Fabric Transport는 NVLink 패브릭에서 엔드포인트 ID와 오프셋 기반 비동기 데이터 전송 제공
- CUDA Python의 cuda.core 1.1.0은 텍스처·서피스 프로그래밍, NUMA 인식 관리 메모리, 타입 스텁 지원
- CUDA SDK 설치 프로그램에서 NVIDIA 드라이버가 분리되어 nvidia-open 또는 cuda-toolkit 패키지를 별도 설치해야 함
Qwen3.8-Omni-Flash, 오디오·비디오 에이전트 모델 출시
- 공식 발표에 따르면 Qwen3.8-Omni-Flash가 텍스트·이미지·오디오·비디오를 처리하는 차세대 네이티브 옴니모달 모델로 출시됨
- 1M 토큰 컨텍스트 윈도우를 지원하며 Qwen3.5-Omni-Plus보다 29개 평가에서 평균 25% 넘게 향상됨
- 오디오 입력 시간당 API 가격은 98% 이상, 오디오·비디오 입력 가격은 93% 이상 인하됨
- WildClawBench-MM은 36.5포인트, AgenticVBench는 22.3포인트 향상되고 UniClawBench에서 69.6점을 기록함
- OmniVideoBench 점수는 9.6포인트 향상됐으며 장시간 오디오·영상 이해와 다화자 인식 성능도 개선됨
- Qwen-MM-Plugins에 지각·도구 호출·워크플로 실행 기능을 더하고 실시간 상호작용용 Qwen-Live Harness를 공개함
원문: qwen.ai
참고: byteshape.com · techgenyz.com · gigazine.net
조코레터는 개발자와 만드는 사람을 위해 AI, 소프트웨어, 제품 흐름을 한국어로 정리합니다.
#NVIDIA #Qwen