CUDA 13.4 업데이트와 옴니모달 에이전트 모델 출시 #133

오늘의 레터

  1. NVIDIA CUDA Toolkit 13.4, Windows on Arm·GPU 공유 제어 강화
  2. Qwen3.8-Omni-Flash, 오디오·비디오 에이전트 모델 출시

NVIDIA CUDA Toolkit 13.4, Windows on Arm·GPU 공유 제어 강화

NVIDIA CUDA Toolkit 13.4, Windows on Arm·GPU 공유 제어 강화
  • CUDA Toolkit 13.4가 Windows on Arm 지원을 추가하고 NVIDIA Rubin 아키텍처에 대한 프리뷰 기능을 제공
  • Rubin은 컴퓨트 기능 107과 SM_107 컴파일 대상 지원으로 정식 지원 전 애플리케이션 포팅 가능
  • Multi-Process Service V3에 스크립트 CLI, 명명 서버 인스턴스, 네임스페이스, TOML 설정 추가
  • MPS V3는 SM 파티션 제어와 cgroup 연동 GPU 메모리 제한으로 컨테이너 환경의 GPU 자원 경계 설정 지원
  • CUDA Compute Fabric Transport는 NVLink 패브릭에서 엔드포인트 ID와 오프셋 기반 비동기 데이터 전송 제공
  • CUDA Python의 cuda.core 1.1.0은 텍스처·서피스 프로그래밍, NUMA 인식 관리 메모리, 타입 스텁 지원
  • CUDA SDK 설치 프로그램에서 NVIDIA 드라이버가 분리되어 nvidia-open 또는 cuda-toolkit 패키지를 별도 설치해야 함

원문: developer.nvidia.com


Qwen3.8-Omni-Flash, 오디오·비디오 에이전트 모델 출시

  • 공식 발표에 따르면 Qwen3.8-Omni-Flash가 텍스트·이미지·오디오·비디오를 처리하는 차세대 네이티브 옴니모달 모델로 출시됨
  • 1M 토큰 컨텍스트 윈도우를 지원하며 Qwen3.5-Omni-Plus보다 29개 평가에서 평균 25% 넘게 향상됨
  • 오디오 입력 시간당 API 가격은 98% 이상, 오디오·비디오 입력 가격은 93% 이상 인하됨
  • WildClawBench-MM은 36.5포인트, AgenticVBench는 22.3포인트 향상되고 UniClawBench에서 69.6점을 기록함
  • OmniVideoBench 점수는 9.6포인트 향상됐으며 장시간 오디오·영상 이해와 다화자 인식 성능도 개선됨
  • Qwen-MM-Plugins에 지각·도구 호출·워크플로 실행 기능을 더하고 실시간 상호작용용 Qwen-Live Harness를 공개함

원문: qwen.ai
참고: byteshape.com · techgenyz.com · gigazine.net


조코레터는 개발자와 만드는 사람을 위해 AI, 소프트웨어, 제품 흐름을 한국어로 정리합니다.

#NVIDIA #Qwen

조코레터 구독하기

Read more

AI 모델 비용 절감과 에이전트 연결 표준 변화 #134

오늘의 레터 1. OpenAI, 우크라이나 민간 인프라 사이버 방어 지원 2. Anthropic, Claude Opus 5.5 공개 3. Databricks, Genie One MCP 정식 출시 OpenAI, 우크라이나 민간 인프라 사이버 방어 지원 * OpenAI가 우크라이나 정부에 Daybreak 프로그램을 제공해 민간 인프라 사이버 방어를 지원 * 우크라이나 디지털전환부와 협력해 소프트웨어 취약점 식별과 수정안 개발·

By TaeyoungPark