Archive

AI 추론 성능과 개발 도구 지표 업데이트 #61

Jocoletter

AI 추론 성능과 개발 도구 지표 업데이트 #61

오늘의 레터 1. NVIDIA, Blackwell용 DFlash 추론 가속 공개 2. GitHub, Copilot 도입 단계별 PR 병합 총계 추가 NVIDIA, Blackwell용 DFlash 추론 가속 공개 * NVIDIA가 Blackwell GPU용 speculative decoding 모델 DFlash를 공개하고, LLM 추론 처리량을 최대 15배 높일 수 있다고 소개함 * DFlash는 경량 drafter가 토큰을 순차 생성하는 대신 후보 토큰

By TaeyoungPark
AI 에이전트 실험과 저정밀 학습 업데이트 #55

Jocoletter

AI 에이전트 실험과 저정밀 학습 업데이트 #55

오늘의 레터 1. Anthropic, Project Fetch 2단계 결과 공개 2. NVIDIA, 트랜스포머 저정밀 학습 최적화 가이드 공개 Anthropic, Project Fetch 2단계 결과 공개 * Anthropic이 6월 18일 공개한 Project Fetch 2단계에서 Claude Opus 4.7이 로보독 과제 일부를 인간 도움 없이 수행함 * 2025년 8월 1차 실험에서는 비전문가 직원 팀이 Claude Opus

By TaeyoungPark
에이전트 스택과 개발 도구 운영 업데이트 #52

Jocoletter

에이전트 스택과 개발 도구 운영 업데이트 #52

오늘의 레터 1. GitHub Copilot, 컨텍스트 처리·모델 라우팅 개선 2. Amazon SageMaker, 비동기 추론 인라인 페이로드 지원 3. Vercel, 에이전트 스택과 Connect 공개 4. Hugging Face, 에이전트용 툴링 벤치마크 공개 GitHub Copilot, 컨텍스트 처리·모델 라우팅 개선 * GitHub이 6월 17일 GitHub Copilot의 컨텍스트 처리 효율화와 Auto 기반 모델 라우팅

By TaeyoungPark