GPT-5.6 출시와 개발 도구 운영 업데이트 #74
오늘의 레터
- OpenAI, GPT-5.6 모델군 정식 출시
- GitHub Mobile, Copilot 세션 필터·정렬 개선
- AWS, MCP 도구 설계 실무 가이드 공개
- Cloudflare, 퍼블릭 클라우드용 Smart Tiered Cache 개선
OpenAI, GPT-5.6 모델군 정식 출시

- OpenAI가 7월 9일 GPT-5.6 모델군을 일반 공개하고 플래그십 Sol, 균형형 Terra, 저비용형 Luna를 함께 발표함
- GPT-5.6 Sol은 코딩·지식 업무·사이버보안·과학 평가에서 이전 및 경쟁 프론티어 모델 대비 더 적은 토큰과 더 낮은 추정 비용으로 높은 성능을 제시함
- Agents’ Last Exam에서 Sol은 53.6점을 기록했고, Claude Fable 5 adaptive reasoning 대비 13.1포인트 높았다고 밝힘
- 중간 추론 설정에서도 Sol은 Fable 5보다 11.4포인트 높고 추정 비용은 약 4분의 1 수준이라고 설명함
- OpenAI는 초고난도 작업용 설정으로 ultra를 도입했고, 기본 4개 에이전트를 병렬로 조정해 더 빠른 완료 시간을 제공한다고 밝힘
- Responses API의 Programmatic Tool Calling을 통해 중간 데이터를 걸러내고 필요한 결과만 남기는 방식으로 도구 중심 작업의 왕복 횟수와 토큰 사용을 줄이도록 설계됨
- 코딩 평가에서는 Artificial Analysis Coding Agent Index에서 Sol이 80점을 기록했고, Fable 5보다 2.8포인트 높으면서 출력 토큰은 절반 미만, 비용은 약 3분의 2 수준이라고 제시함
- 출시와 함께 역대 가장 강한 보호 체계를 적용했다고 밝혔고, 일반 공개 전 인간 레드팀과 대규모 자동 테스트, 신뢰 파트너 검증을 거쳤다고 설명함
원문: openai.com
참고: siliconangle.com
GitHub Mobile, Copilot 세션 필터·정렬 개선
- GitHub가 7월 10일 GitHub Mobile용 Copilot 세션 목록에 필터와 정렬 기능 개선 사항을 배포함
- 모바일에 맞춘 경량 필터로 Active, Status, Repository, Type, Agent, Sort 기준을 제공함
- 진행 중, 완료됨, 확인 필요 세션을 빠르게 좁혀 볼 수 있고 특정 저장소나 세션 유형 기준 탐색도 지원함
- 정렬 옵션은 최신순, 오래된순, 활성 세션 우선, 확인 필요 우선 순서를 포함함
- 정렬 순서를 바꿔도 현재 적용한 필터 조건이 유지돼 목록을 다시 설정할 필요가 없음
- 최신 프로덕션 빌드 기준 iOS와 Android용 GitHub Mobile에서 사용 가능함
- 관련 의견 수렴 채널로 GitHub Community 토론 링크도 함께 제공됨
원문: github.blog
AWS, MCP 도구 설계 실무 가이드 공개
- AWS가 7월 9일 MCP 도구 설계 실패 원인을 정리한 실무 가이드를 공개함
- 기존 API를 그대로 MCP 도구로 노출하면 컨텍스트 팽창과 도구 선택 혼선으로 오동작·재시도 증가가 발생할 수 있다고 설명함
- 설명문 보강만으로는 한계가 있으며, 기본 응답 필드를 줄이고 상세 조회를 분리하면 응답 토큰을 약 3분의 2까지 줄일 수 있다고 제시함
- 스키마 측면에서는 enum·기본값·도메인 친화적 파라미터명 사용, 드물게 쓰는 필드 제거, 파라미터 수 8개 이하 권장을 제안함
- 복합 도구를 세분화하거나 discovery 도구로 필요한 정의만 지연 로드하는 방식도 소개했으며, Anthropic은 관련 방식으로 최대 85% 토큰 절감을 보고했다고 인용함
- 예시 구현은 K-12 콘텐츠 검색 API를 MCP로 노출한 시뮬레이션 기반이며, Kiro CLI로 로컬 비교 실험이 가능하도록 구성함
원문: aws.amazon.com
Cloudflare, 퍼블릭 클라우드용 Smart Tiered Cache 개선
- Cloudflare가 퍼블릭 클라우드 리전 힌트를 받는 Smart Tiered Cache 개선을 7월 10일 공개함
- AWS·GCP·Azure·Oracle Cloud 원본 서버가 애니캐스트 또는 리저널 유니캐스트 뒤에 있을 때도 더 적절한 primary·fallback 상위 티어를 선택하도록 설계됨
- 기존에는 원본 IP가 여러 Cloudflare 데이터센터와 동시에 가깝게 보여 단일 상위 티어를 고르지 못했고, 이 경우 여러 상위 티어로 폴백해 캐시 효율이 낮아질 수 있었음
- Cloudflare는 여러 체크포인트 데이터센터의 지연 시간을 비교해 단일 위치로 설명되지 않는 응답 패턴을 감지하고 애니캐스트 여부를 판별함
- 대시보드의 Caching > Tiered Cache > Origin Configuration에서 origin IP별 리전 힌트를 설정할 수 있고, 대시보드에서는 애니캐스트로 감지된 IP에 한해 노출됨
- 설정은 IP별 편집과 일괄 편집을 모두 지원하며, API와 Terraform으로도 동일하게 구성 가능함
- 지원 클라우드의 최신 IP 대역 파일은 몇 시간마다 가져오고, 상위 티어 데이터베이스는 15분마다 갱신되는 지연 시간 측정값을 반영함
- Smart Tiered Cache는 2021년 출시됐고 현재 모든 요금제에서 무료로 제공됨
조코레터는 개발자와 만드는 사람을 위해 AI, 소프트웨어, 제품 흐름을 한국어로 정리합니다.
#AWS #Cloudflare #GitHub #OpenAI