Jocoletter

NVIDIA GB300 Qwen 모델 지원과 GitHub Copilot 업데이트 #123

오늘의 레터 1. NVIDIA, GB300용 Qwen3.8-Flash-Next 실험 지원 2. GitHub Copilot, Visual Studio 2026년 8월 업데이트 NVIDIA, GB300용 Qwen3.8-Flash-Next 실험 지원 * Alibaba의 Qwen3.8-Flash-Next를 NVIDIA GB300 NVL72에서 에이전틱 코딩용으로 실행하는 방법 공개 * 125B 파라미터 MoE 모델이며 토큰당 6B 파라미터를 활성화하고, 51B 규모의 N-gram 임베딩을 추가로 지원 * 기본 262,

By TaeyoungPark

Jocoletter

AI 인프라와 개발 도구의 운영 업데이트 #121

오늘의 레터 1. NVIDIA, Qwen3.8-Flash-Next GB300 구동 지원 2. GitHub, 엔터프라이즈 플러그인 마켓플레이스 자동 업데이트 지원 NVIDIA, Qwen3.8-Flash-Next GB300 구동 지원 * Alibaba의 Qwen3.8-Flash-Next 가중치를 NVIDIA GB300 NVL72에서 실행하는 기술 지원 공개 * 125B 파라미터 MoE 모델로 토큰당 6B 파라미터를 활성화하며 51B N-gram 임베딩을 추가 * 기본 262,144토큰 컨텍스트를

By TaeyoungPark

Jocoletter

MultiVectorEncoder와 Codex로 달라지는 개발 방식 #120

오늘의 레터 1. Hugging Face, MultiVectorEncoder 학습 지원 공개 2. loveholidays, Codex로 전사 개발 참여 확대 Hugging Face, MultiVectorEncoder 학습 지원 공개 * Sentence Transformers v6.0에 ColBERT 방식의 지연 상호작용 검색을 위한 네 번째 모델 유형 MultiVectorEncoder 추가 * `sentence-transformers[train]` 패키지로 모델·데이터셋·손실 함수·평가기·Trainer를 포함한 학습 과정

By TaeyoungPark