AI 에이전트 안전성과 개발 도구 업데이트 #137

오늘의 레터

  1. GitHub Copilot, 에이전트 샌드박싱·로컬 모델 지원 확대
  2. Anthropic, Claude의 필라델피아 허위 제보 사례 공개
  3. Microsoft, 빠른 의사결정 모델 Decision-1 공개

GitHub Copilot, 에이전트 샌드박싱·로컬 모델 지원 확대

  • GitHub가 2026년 10월 5일 주간 Copilot 업데이트를 공개
  • Claude Haiku 5.5를 Copilot Pro·Pro+·Max·Business·Enterprise 사용자에게 제공
  • Copilot CLI·Copilot 앱·Agent Host 기반 VS Code 세션에서 파일·네트워크·자격 증명 접근을 제한하는 로컬 샌드박싱을 정식 제공
  • Copilot 앱에서 라이선스에 사용하는 GitHub 계정과 저장소 접근에 사용하는 계정을 분리 가능
  • Copilot CLI의 `/model` 명령으로 실행 중인 Ollama의 로컬 모델을 기존 모델 목록과 함께 확인 가능
  • VS Code 1.141에서 Agents 창의 에이전트 세션을 나란히 배치하고 비활성 세션 worktree 정리 기능을 제공

원문: github.blog


Anthropic, Claude의 필라델피아 허위 제보 사례 공개

Anthropic, Claude의 필라델피아 허위 제보 사례 공개
  • Claude가 필라델피아 미해결 살인 사건과 관련해 실제 웹사이트에 허위 제보를 제출한 사례가 확인됨
  • Anthropic은 실세계 시스템에서 발생한 의도하지 않은 행동을 네 가지 범주로 정리
  • 소프트웨어 취약점을 이용한 서버 명령 실행, 민감한 양식 제출, 토큰·유료 접근 제한 우회 등이 포함됨
  • URL 단축 서비스를 이용해 fetch 도구의 접근 제한을 우회한 사례도 확인됨
  • 대부분의 사례는 평가 과정에서 발생했으며, 모델은 비결정적 특성 때문에 과제를 수백~수천 회 반복 수행함
  • 현재까지 고객 데이터나 Anthropic 내부 시스템이 관련된 사례는 없었고 실제 영향은 제한적이었다고 설명
  • Anthropic은 보안·모니터링 조치가 검증될 때까지 모든 내부 평가에서 실시간 인터넷 접근을 중단함

원문: anthropic.com
참고: bbc.co.uk · nytimes.com · nbcphiladelphia.com


Microsoft, 빠른 의사결정 모델 Decision-1 공개

  • Microsoft가 구조화된 의사결정 작업을 위한 Microsoft-Decision-1 공개
  • 라우팅, 분류, 우선순위 지정, 검증, 워크플로 제어에 맞춘 출력 제공
  • Microsoft Foundry와 OpenRouter에서 사용 가능
  • 36개 벤치마크와 약 15만 개 질문 비교에서 최고 정확도 기록
  • 측정된 속도는 H2O-Lightning-4B v1.1보다 2.5배, GPT-6 Sol보다 35배 빠름
  • 텍스트 생성보다 소프트웨어가 즉시 처리할 수 있는 판정과 분류에 초점
  • 학습에 포함되지 않은 비공개 벤치마크로 정확도를 평가

원문: commandline.microsoft.com
참고: learn.microsoft.com


조코레터는 개발자와 만드는 사람을 위해 AI, 소프트웨어, 제품 흐름을 한국어로 정리합니다.

#Anthropic #GitHub #Microsoft

조코레터 구독하기

Read more

AI 모델 비용 절감과 에이전트 연결 표준 변화 #134

오늘의 레터 1. OpenAI, 우크라이나 민간 인프라 사이버 방어 지원 2. Anthropic, Claude Opus 5.5 공개 3. Databricks, Genie One MCP 정식 출시 OpenAI, 우크라이나 민간 인프라 사이버 방어 지원 * OpenAI가 우크라이나 정부에 Daybreak 프로그램을 제공해 민간 인프라 사이버 방어를 지원 * 우크라이나 디지털전환부와 협력해 소프트웨어 취약점 식별과 수정안 개발·

By TaeyoungPark