업무 에이전트와 분산 LLM, 로봇 평가 #76
오늘의 레터
- NVIDIA Research, 로봇 정책 평가 플랫폼 RoboLab 소개
- OpenAI, ChatGPT Work 업무 에이전트 출시
- Mesh LLM, iroh 기반 분산 LLM 실행 플랫폼 공개
NVIDIA Research, 로봇 정책 평가 플랫폼 RoboLab 소개

- NVIDIA Research가 범용 로봇 정책의 실환경 배치 전 평가 문제를 다룬 시뮬레이션 벤치마킹 플랫폼 RoboLab을 7월 11일 소개함
- 기존 벤치마크의 한계로 학습·평가 환경의 시각적 중복, 고정 과제에 따른 포화, 성공·실패 이진 점수의 진단 부족, 낮은 통계 신뢰도를 지적함
- RoboLab은 로봇 기종에 구애받지 않는 평가, 새 과제의 빠른 생성, 실패 원인까지 보는 분석 도구 묶음을 핵심 원칙으로 설계됨
- 사용자는 객체 라이브러리에서 물체를 배치하고 자연어 지시를 넣어 장면·과제를 구성할 수 있으며, 전체 설정은 수분 단위로 진행 가능하다고 설명함
- 부분 점수를 주는 graded task score, 동작 부드러움을 보는 SPARC, 실패 이벤트 로깅을 통해 성능·강건성·실패 원인을 세밀하게 분석하도록 구성됨
- 통계 예시로 성공률 90%를 70회 롤아웃으로 측정하면 95% Clopper-Pearson 신뢰구간이 80.5%~95.9%까지 벌어지고, 1,030회에서는 88.0%~91.8%로 좁아진다고 제시함
- 새 과제를 코딩 에이전트 워크플로 안에서 만들 수 있는 agent skills도 포함해, 벤치마크 포화에 대응하는 확장성을 강조함
- RoboLab 기능은 2026년 8월부터 NVIDIA Isaac Lab-Arena에 통합될 예정이라고 밝힘
OpenAI, ChatGPT Work 업무 에이전트 출시
- OpenAI가 ChatGPT 안에서 장시간 업무를 수행하는 AI 에이전트 'ChatGPT Work'를 발표함
- 최신 모델 GPT-5.6 기반으로 여러 단계 작업을 추론하고 템플릿·참고 파일에 맞춘 문서, 슬라이드, 시트, 웹 앱 생성 지원
- Slack, Microsoft Teams, Google Drive, SharePoint 등 외부 앱·시스템 연결 플러그인으로 자료 수집부터 결과물 작성까지 한 흐름으로 처리 가능
- Scheduled Tasks로 사용자가 자리를 비운 동안에도 워크플로를 계속 진행하고, 새 메시지를 문서·슬라이드 업데이트로 반영 가능
- Codex 기술이 내장됐으며 주간 이용자 500만 명, 비개발 업무 이용자 100만 명을 넘겼다고 공개
- 데스크톱 앱에서는 로컬 파일과 앱 접근, 내장 브라우저 기반 웹 작업을 지원하고 Codex 앱도 새 ChatGPT 데스크톱 앱으로 통합됨
- 웹·모바일은 Pro·Enterprise·Edu에 이날부터 순차 배포되며, Plus·Business는 수일 내 확대 예정. 데스크톱은 Free 포함 전 플랜 제공
Sponsored · 조코헌트 · The Loupe (자동)
🏆 조코헌트 TOP1 · AI 코드 결과물을 검증하는 실전 훈련 서비스

AI가 짜준 코드를 그대로 믿기 불안한 개발자를 위한 검증 훈련 서비스입니다. 자연어로 구현된 코드에서 조용히 틀린 부분을 찾아 고치며 AI 결과물을 읽는 눈을 익히게 합니다.
실무에서 벌어질 법한 동시성·SQL·네트워크 문제를 그럴듯하게 심어두고, 모바일에서는 가입 없이 1분짜리 데일리 검증도 바로 체험할 수 있습니다. 배포 전 의심해야 할 지점을 훈련하는 데 초점이 맞춰져 있습니다.
“AI가 코드를 짜주는 시대일수록, 그걸 알아보는 눈은 더 중요해집니다”
Mesh LLM, iroh 기반 분산 LLM 실행 플랫폼 공개
- 여러 머신의 GPU와 메모리를 묶어 하나의 OpenAI 호환 API로 노출하는 Mesh LLM 프로젝트 공개
- 로컬 API 엔드포인트를 http://localhost:9337/v1 로 제공하며, 단일 노드로 시작한 뒤 후속 노드를 추가하는 구조
- 실행 시 모델을 로컬에서 돌리거나 피어 노드로 라우팅하고, 단일 장비에 맞지 않는 모델은 stage split 방식으로 분산 실행 가능
- `mesh-llm serve --auto` 명령으로 백엔드 선택, 필요 모델 다운로드, 공개 메시에 합류, 로컬 API 기동을 한 번에 처리
- README 기준 설치 스크립트와 Windows용 PowerShell 설치 경로를 함께 제공하며, 초기 설정은 `mesh-llm setup`으로 진행
- 제거 시 `mesh-llm uninstall --dry-run`과 `--yes` 옵션을 제공하고, 기본적으로 `~/.mesh-llm` 설정과 identity 데이터는 유지
- 저장소에는 Rust 기반 코드 구조와 SDK, docs, docker, llama.cpp 서드파티 디렉터리 등이 포함되어 로컬·분산 추론 확장 방향을 드러냄
원문: github.com
참고: news.hada.io
조코레터는 개발자와 만드는 사람을 위해 AI, 소프트웨어, 제품 흐름을 한국어로 정리합니다.
#MeshLLM #NVIDIA #OpenAI