Archive

AI 추론 성능과 개발 도구 지표 업데이트 #61

Jocoletter

AI 추론 성능과 개발 도구 지표 업데이트 #61

오늘의 레터 1. NVIDIA, Blackwell용 DFlash 추론 가속 공개 2. GitHub, Copilot 도입 단계별 PR 병합 총계 추가 NVIDIA, Blackwell용 DFlash 추론 가속 공개 * NVIDIA가 Blackwell GPU용 speculative decoding 모델 DFlash를 공개하고, LLM 추론 처리량을 최대 15배 높일 수 있다고 소개함 * DFlash는 경량 drafter가 토큰을 순차 생성하는 대신 후보 토큰

By TaeyoungPark
AI 에이전트 실험과 저정밀 학습 업데이트 #55

Jocoletter

AI 에이전트 실험과 저정밀 학습 업데이트 #55

오늘의 레터 1. Anthropic, Project Fetch 2단계 결과 공개 2. NVIDIA, 트랜스포머 저정밀 학습 최적화 가이드 공개 Anthropic, Project Fetch 2단계 결과 공개 * Anthropic이 6월 18일 공개한 Project Fetch 2단계에서 Claude Opus 4.7이 로보독 과제 일부를 인간 도움 없이 수행함 * 2025년 8월 1차 실험에서는 비전문가 직원 팀이 Claude Opus

By TaeyoungPark