정형 검증 모델 공개와 1M 컨텍스트 API 업데이트 #68

정형 검증 모델 공개와 1M 컨텍스트 API 업데이트 #68

오늘의 레터

  1. Mistral AI, Leanstral 1.5 공개
  2. DeepSeek, V4 Preview 공개 및 API 지원

Mistral AI, Leanstral 1.5 공개

Mistral AI, Leanstral 1.5 공개
  • Mistral AI가 7월 2일 Lean 4용 정형 검증 모델 Leanstral 1.5를 공개함
  • Apache-2.0 라이선스의 무료 공개 모델이며, 총 119B 파라미터 중 6B만 활성화되는 구조라고 밝힘
  • miniF2F 포화, PutnamBench 672문제 중 587문제 해결, FATE-H 87%, FATE-X 34%를 기록했다고 발표함
  • 학습은 mid-training, 지도 미세조정, CISPO 기반 강화학습의 3단계로 진행됐다고 설명함
  • 멀티턴 증명 환경에서는 정리의 증명·반증 시도 후 Lean 컴파일러 피드백을 받아 반복 수정하는 방식임
  • 코드 에이전트 환경에서는 파일 수정, bash 명령 실행, Lean 언어 서버 점검을 통해 장기 증명 작업과 코드 검증을 수행함
  • 57개 오픈소스 저장소 검증 과정에서 기존에 알려지지 않았던 버그 5건을 찾아냈다고 덧붙임
  • Hugging Face와 무료 API로 제공되며, 실사용 가능한 증명 엔지니어링 접근성을 높이는 모델로 제시됨

원문: mistral.ai


DeepSeek, V4 Preview 공개 및 API 지원

DeepSeek, V4 Preview 공개 및 API 지원
  • DeepSeek가 4월 24일 DeepSeek-V4 Preview를 공개하고 오픈 웨이트와 기술 보고서를 함께 배포함
  • 상위 모델 DeepSeek-V4-Pro는 총 1.6T 파라미터·활성 49B 구조, 보급형 DeepSeek-V4-Flash는 총 284B·활성 13B 구조로 안내됨
  • 두 모델 모두 1M 컨텍스트를 기본 지원하며 Thinking 모드와 Non-Thinking 모드를 함께 제공함
  • API는 기존 base_url을 유지한 채 모델명만 deepseek-v4-pro 또는 deepseek-v4-flash로 바꾸면 사용 가능함
  • OpenAI ChatCompletions API와 Anthropic API 호환을 명시했고, chat.deepseek.com에서는 Expert Mode와 Instant Mode로 체험 가능함
  • DeepSeek는 V4-Pro가 에이전트 코딩 벤치마크에서 오픈소스 최고 수준 성능을 보였다고 설명했고, V4-Flash는 단순 에이전트 작업에서 V4-Pro와 비슷한 수준이라고 밝힘
  • 긴 컨텍스트 처리에는 토큰 단위 압축과 DSA(DeepSeek Sparse Attention)를 적용했다고 설명함
  • 기존 deepseek-chat과 deepseek-reasoner는 2026년 7월 24일 15:59 UTC 이후 완전 종료 예정이며, 현재는 deepseek-v4-flash의 비사고형·사고형 모드로 라우팅됨

원문: api-docs.deepseek.com
참고: github.com · theregister.com


조코레터는 개발자와 만드는 사람을 위해 AI, 소프트웨어, 제품 흐름을 한국어로 정리합니다.

#DeepSeek #Mistral

조코레터 구독하기

Read more

AI 모델 비용 절감과 에이전트 연결 표준 변화 #134

오늘의 레터 1. OpenAI, 우크라이나 민간 인프라 사이버 방어 지원 2. Anthropic, Claude Opus 5.5 공개 3. Databricks, Genie One MCP 정식 출시 OpenAI, 우크라이나 민간 인프라 사이버 방어 지원 * OpenAI가 우크라이나 정부에 Daybreak 프로그램을 제공해 민간 인프라 사이버 방어를 지원 * 우크라이나 디지털전환부와 협력해 소프트웨어 취약점 식별과 수정안 개발·

By TaeyoungPark