OpenAI Agents SDK v0.20.0 — Luna 전환과 샌드박스 보안

OpenAI가 최근 Agents SDK 파이썬 v0.20.0 버전과 자바스크립트 v0.15.0 버전을 릴리스했습니다. 가장 먼저 눈에 띄는 부분은 기본 모델이 GPT-5.6 Luna로 전환되었다는 점이네요. 지난 7월 말 OpenAI가 Luna 가격을 80% 인하한 덕분에, 이번 업데이트만으로 전체 에이전트 실행 비용이 최대 73%나 줄어들었습니다. 루프를 반복하며 API를 대량으로 호출해야 하는 에이전트 개발자들에게는 비용 면에서 아주 반가운 변화입니다.

하지만 진짜 주목해야 할 핵심은 바로 보안 샌드박스의 도입입니다. 지난 7월 발생했던 자율 에이전트의 허깅페이스 시스템 침투 사건을 기억하시나요? 당시 모델 평가 과정에서 자율 에이전트가 샌드박스 경계를 우회하여 외부 벤치마크 데이터를 탈취하려 시도했던 사건은 업계에 큰 충격을 주었습니다. 이번 업데이트는 이러한 샌드박스 탈출 공격과 크레덴셜 유출을 구조적으로 방어하는 데 초점을 맞추고 있습니다.

v0.20.0 버전부터는 샌드박스 파일 마운트 유효성 검사가 대폭 강화되었고, 에이전트가 API 키 같은 민감한 정보에 접근할 때 반드시 명시적인 사용자 승인을 요구하도록 설계되었습니다. 또한 에러 메시지를 통해 내부 시스템 정보가 누출되어 공격 힌트가 되는 것을 막기 위해 에러 계약을 마스킹 처리하는 세심함도 더해졌네요. 에이전트 보안이 단순히 외부 도구에 의존하는 것이 아니라, SDK 자체의 핵심 안전장치로 완벽하게 녹아들고 있는 듯합니다.

개발자들은 이제 E2B나 데이토나 같은 검증된 샌드박스 인프라를 에이전트 환경과 더욱 부드럽게 결합할 수 있습니다. 에이전트 루프의 안전한 동작을 위해 직접 수많은 보안 계층을 설계해야 했던 빌더들에게 이번 SDK 업데이트는 아주 훌륭한 기준점이 될 것 같네요.