OpenAI는 2026년 9월 10일 Agents API가 퍼블릭 베타에 들어갔다고 발표했다. 개발자가 모델 호출과 도구, 백그라운드 실행, 파일 처리, 장시간 상태 관리를 직접 이어 붙이지 않아도 여러 단계를 수행하는 에이전트를 만들 수 있게 하려는 목적이다. OpenAI는 Codex에 사용되는 하니스와 도구·서브에이전트 협업, OpenAI 관리 샌드박스와 개발자 자체 인프라, 파트너 환경이라는 실행 경로를 제시했다. 퍼블릭 베타는 통합과 테스트를 시작할 수 있다는 뜻이지 모든 인터페이스가 핵심 업무에 충분히 안정적이라는 뜻은 아니다.
Agents API는 개발의 어느 부분을 해결하나
기존 채팅 API는 앱이 프롬프트를 보내고 답을 받은 뒤 다음 단계를 외부 코드로 결정하는 요청·응답 방식에 가깝다. Agents API는 통제된 실행 안에서 모델이 파일을 읽고 도구를 사용하며 다른 에이전트를 호출하고 진행 상황을 보고하면서 장시간 작업을 이어가게 하는 방향이다. 권한과 도구 경계, 오류 처리, 최종 승인은 개발자가 정의해야 한다.
이 추상화의 가치는 ‘모델의 답변’을 ‘관찰 가능한 실행’으로 바꾸는 데 있다. 예를 들어 조사 에이전트가 검색과 파일 정리, 요약을 순서대로 수행하고 중간 상태를 앱에서 표시하거나 검토할 수 있다. 모델에 무제한 컴퓨터 권한을 주는 것이 아니라 기록하고 제한할 수 있는 도구 작업 시퀀스를 하나의 워크플로로 묶는 방식이다.
런타임과 Codex의 연결
OpenAI는 에이전트가 격리된 환경에서 코드를 실행하고 작업을 처리할 수 있는 관리형 샌드박스를 설명한다. 데이터와 네트워크를 더 통제해야 하는 팀은 자체 인프라나 파트너 환경을 선택할 수 있다. 따라서 API는 텍스트 엔드포인트 모음이 아니라 실행 수명주기와 파일, 도구 권한까지 제품 영역으로 포함한다.
OpenAI가 Codex의 하니스를 참고 사례로 제시한 이유는 도구와 파일, 격리 작업 공간을 이용해 장시간 에이전트가 일을 끝내는 모습을 보여주기 때문이다. 하지만 개발자가 데모를 그대로 복사해서는 안 된다. 파일을 읽고 쓰거나 요청을 보내고 외부 서비스를 호출하는 각 도구에 명확한 스키마와 권한 모델, 복구 전략이 필요하다.
퍼블릭 베타의 의미
이번 공개는 소수 초대자만 보는 데모가 아니라 퍼블릭 베타다. 개발자는 공식 문서로 프로토타입을 만들고 긴 작업과 도구 오류, 중간 결과 처리를 관찰할 수 있다. 다만 베타에서는 API와 가격, 이용 모델, 샌드박스 제한, 안전 동작이 바뀔 수 있으므로 실제 도입 전부터 실행 로그와 비용 모니터링을 함께 마련해야 한다.
중요 업무에서 퍼블릭 베타가 거버넌스 필요성을 없애지는 않는다. 어떤 작업에 사람 승인을 요구할지, 어떤 데이터가 경계를 넘어가면 안 되는지, 실패한 실행을 어떻게 중지할지, 에이전트가 만든 파일·코드·외부 작업을 어떻게 검증할지는 팀이 결정해야 한다. 관리형 런타임은 인프라 부담을 줄일 뿐 제품 책임을 없애지 않는다.
개발자는 이번 출시를 어떻게 봐야 하나
Agents API의 실질적 의미는 일회성 프롬프트 기술에서 실행을 재현하고 관찰하며 제한·평가할 수 있는 시스템 엔지니어링으로 옮겨가는 데 있다. 먼저 조사 요약과 데이터 정리, 테스트 보조, 내부 워크플로처럼 위험이 낮고 되돌릴 수 있는 작업부터 시작한 뒤 쓰기와 외부 동작을 단계적으로 추가하는 편이 좋다.
모델 비교의 기준도 늘어난다. 어떤 모델이 답을 가장 잘하는지만이 아니라 어떤 실행 환경이 허용 가능한 비용으로 작업을 끝내고 실패할 때 사람에게 제어를 돌려주며 감사할 증거를 남기는지 물어야 한다. 에이전트를 데모에서 제품으로 옮길 때 자주 놓치지만 중요한 부분이다.
