
OpenAI Agents API 출시: 기능·요금·도입 판단
출시를 둘러싼 실무 질문은 “관리형 에이전트란 무엇인가?”보다 구체적입니다. 클라이언트 연결이 끊겨도 작업이 이어지는가? 컨텍스트 압축 뒤에도 중요한 제약이 유지되는가? 병렬 서브 에이전트의 시간 절약이 추가 비용을 정당화하는가? 하네스를 맡긴 뒤에도 애플리케이션이 해야 할 일은 무엇인가?
OpenAI Agents API 출시로 무엇이 제공되나요?
| 질문 | 현재 답변 | 도입 시 의미 |
|---|---|---|
| 발표만 됐나요, 제공사에서 쓸 수 있나요? | 9월 10일 공개 베타 발표 | 정식 출시 계약을 가정하지 말고 베타 문서로 평가 |
| Agents SDK의 새 이름인가요? | 아니요. API는 호스팅 런타임, SDK는 앱에서 실행 | 전환하면 운영 책임이 달라짐 |
| Codex 하네스가 모델인가요? | 아니요. 모델 호출, 도구, 진행 작업을 조율 | 모델 품질뿐 아니라 전체 흐름 평가 |
| EvoLink에서 호출할 수 있나요? | 연동 중이며 호출은 아직 미개방 | 검증된 경로를 유지하며 시험 작업 준비 |
| API 공개가 모델 가중치 공개인가요? | 이 런타임 발표는 가중치나 모델 라이선스를 보장하지 않음 | 런타임 소스 공개 여부, 호스팅 서비스 약관, 모델 라이선스 구분 |
이름 혼동은 구현에 영향을 줍니다. Agents SDK 설치 튜토리얼은 유용할 수 있지만 새 관리형 API의 동작을 보여주는 것은 아닙니다. OpenAI 호환 모델 엔드포인트도 지속형 에이전트 세션 지원을 입증하지 않습니다. 예제를 재사용하기 전에 실제 호출하는 제품을 확인하세요.
Codex 하네스 공개가 중요한 이유
코딩·분석 제품에서 모델 호출은 일부에 불과합니다. 다음 도구 작업을 선택하고, 결과를 이어받고, 필요한 문맥을 유지하고, 중단 후 계속하는 장치가 필요합니다. 관리형 서비스는 이를 런타임으로 묶습니다. 이 기반을 유지하는 데 많은 인력이 들어가는 팀에서 가치가 큽니다.
이번 출시를 계기로 개발 업무를 목록화하고, 업무 자체를 개선하는 공수와 실행 기반을 유지하는 공수를 분리해 보세요. 후자가 충분히 크고 서비스 경계가 제품에 맞아야 관리형 런타임이 유의미한 운영 절감을 가져옵니다.

장시간 세션과 컨텍스트 압축: 연속성을 검증하세요
저장소 유지보수 시험으로 페이지네이션 수정, 공개 응답 형식 유지, 인증 변경 금지, 관련 테스트 출력 첨부를 지시해 보세요. 여러 조사·수정 단계 뒤 경계 사례를 추가하고 최종 패치가 원래 제약도 지키는지 확인합니다. 대화 기록이 길다는 사실만으로는 알 수 없습니다.
검수 기준을 앱의 작업 기록에 저장하세요. 리뷰 때 변경 파일, 응답 테스트 데이터, 테스트 증거를 대조하면 문맥 처리 실패와 처음부터 불명확했던 요구를 구분할 수 있습니다. 나중에 다른 런타임을 평가할 독립 기록도 됩니다.
데이터 분석도 같습니다. 대화는 자연스럽지만 회계 기간이 바뀌거나 제외 조건이 빠질 수 있습니다. 불변 조건을 직접 평가하세요. 지속형 세션을 모든 업무 제약이 모든 재개를 통과한다는 검증되지 않은 보장으로 바꾸면 안 됩니다.
도구 검색과 프로그래밍 방식 호출은 다른 문제를 해결합니다
계정 분석 도우미에 CRM 작업이 많아도 질문에 필요한 것은 일부일 수 있습니다. 동시에 여러 계정 레코드를 가져와 요약 통계를 계산해야 할 수도 있습니다. 올바른 작업을 찾는다고 데이터 수집·처리 비용이 사라지지는 않습니다.
따라서 도구 선택의 정확성과 독립 계산 대비 결과 정확도를 각각 기록하세요. 최종 답변이 짧다고 집계가 정확한 것은 아닙니다. 누락 레코드, 빈 결과, 단위 불일치를 시험 데이터에 포함합니다.
고객에게 영향을 주는 쓰기 작업은 불투명한 집계 단계 밖에 두는 것을 권합니다. 분석은 변경안을 만들고, 앱 코드가 대상과 권한을 확인한 뒤 적용합니다. 이는 설계 권고이며 EvoLink가 현재 두 도구 기능을 제공한다는 주장은 아닙니다.
병렬 서브 에이전트: 나눌 수 있는 작업부터
평가용 장애 조사 시나리오에서는 배포 변경, 오류 표본, 의존 서비스 상태를 독립적인 읽기 전용 작업으로 나눕니다. 각각 증거, 가설, 판단의 불확실성을 반환하도록 요구하고 조율 에이전트가 설명의 일치 여부를 확인한 뒤 대응을 제안합니다.
반대로 세 에이전트가 같은 설정 파일을 고치면 충돌과 조정 작업이 늘 수 있습니다. 증거 수집을 나누고 최종 수정은 한 주체가 담당하게 하세요. 가장 빠른 부분 작업이 아니라 통합·충돌 해결을 포함한 검수 통과까지의 시간을 측정합니다.
같은 장애 사례로 단일 에이전트와 서브 에이전트 수를 제한한 구성을 비교하고 총비용, 수동 수정도 함께 기록합니다. 더 빨라도 검증하기 어려운 답변이라면 제품 요구를 놓친 것입니다.
호스팅 샌드박스, 자체 환경, 샌드박스 없음
| 제안 작업 | 먼저 평가할 구성 | 이유 | 앱 책임 |
|---|---|---|---|
| 업무 함수로 계정 조회 | 샌드박스 없음 | 로컬 계산이 아니라 서비스 조회 결과가 필요 | 사용자 인증과 레코드 접근 제어 |
| CSV 분석과 통합 문서 생성 | 호스팅 샌드박스 | 파일, 패키지, 산출물이 핵심 | 합계 검증과 검수 통과 산출물 저장 |
| 특수 의존성이 있는 저장소 작업 | 자체 호스팅 | 기존 연산 기반이나 도구가 중요 | 자원 준비, 격리, 복구, 종료 |
/workspace/outputs에 쓴 파일이 턴 완료 시 불변 아티팩트로 게시됩니다. 완료 턴과 파일 경로를 함께 맞춰, 수정된 분석에서 이전 보고서를 제공하지 않도록 합니다. 게시된 아티팩트는 환경 만료 뒤에도 유지되지만 세션 삭제 전 필요한 사본을 보관하세요./workspace/outputs에 쓴다고 OpenAI Artifacts API에 게시되지 않습니다. 같은 CSV 작업이라도 고객에게 보이는 하나의 “보고서 다운로드” 동작 뒤에 환경별로 두 종류의 다운로드 어댑터가 필요합니다. 조회와 수명.
실행에서 다운로드 가능한 보고서까지
CSV 작업의 제품 흐름을 다음처럼 설계할 수 있습니다. API 이벤트 이름이 아니라 앱 상태입니다.
| 고객 표시 | 앱 동작 | 다음 단계 조건 |
|---|---|---|
| 처리 중 | 업무 작업과 관리형 세션을 연결하고 진행 상황 추적 | 검사할 결과가 준비됨 |
| 결과 확인 중 | 올바른 버전을 조회해 합계·예외 확인 | 통합 문서가 저장된 검수 기준을 통과 |
| 다운로드 가능 | 검수 통과 결과 저장과 사용자의 다운로드 권한 적용 | 실제 파일을 가져올 수 있음 |
| 다시 연결 중 | 스트림 중단 뒤 기존 세션과 저장 작업 읽기 | 원래 작업이 진행 중인지 결과가 있는지 판단 |
| 확인 필요 | 유용한 출력 보존과 미해결 문제 설명 | 입력 수정, 리뷰 결정 또는 통제된 재시도 |
추가 API 요금 없음이 무료를 뜻하지는 않습니다
모델·도구·환경 비용, 실패 시도, 검수 통과 출력을 작업 장부에 기록합니다. 자체 운영과 리뷰 시간은 별도 열에 둡니다. 토큰만의 추정치와 모든 비용을 포함한 운영비를 비교하지 않기 위해서입니다.
도입 판단을 바꿀 수 있는 베타 제약
결정에 도움이 되는 첫 평가
CSV 두 개를 대조하고 불일치 행을 설명해 통합 문서와 요약을 만드는 제한된 작업을 사용하세요. 아래는 이 글에서 제안하는 테스트 설계이며 실측 결과는 없습니다.
| 사례 | 데이터 또는 중단 | 검수 증거 |
|---|---|---|
| 일반 입력 | 대조 시 일치해야 할 합계를 알고 있는 두 내보내기 파일 | 통합 문서의 합계가 독립 계산과 일치 |
| 모호한 데이터 | 중복 ID와 통화 누락 | 모호한 부분을 명시하고 일치 관계를 임의로 만들어 내지 않음 |
| 클라이언트 단절 | 시작 후 스트림 닫기 | 기존 작업을 찾고 무조건 재제출하지 않음 |
| 지시 변경 | 작업 중 제외 조건 추가 | 최종 합계와 설명에 새 범위 반영 |
| 결과 조회 | 결과 보존 후 연산 종료 | 앱에서 검수 통과 산출물을 가져와 열 수 있음 |
| 예산 확인 | 모든 시도를 배치에 포함 | 지출과 검수 통과 결과 수를 대조할 수 있음 |
자주 묻는 질문
OpenAI Agents API는 언제 출시됐나요?
공개 베타 발표일은 2026년 9월 10일입니다. 정식 출시나 EvoLink 시작일을 의미하지 않습니다.
Codex 모델이나 Agents SDK와 같은가요?
Codex 하네스를 중심으로 하는 관리형 서비스입니다. 모델 선택과 앱 안에서 SDK로 실행하는 오케스트레이션은 다른 개념입니다.
자동 압축이면 기억이 무제한인가요?
아닙니다. 긴 작업에서 제약과 증거가 계속 유효한지 평가하고 업무 검수 기록은 대화 밖에 보관하세요.
서브 에이전트는 항상 싸고 빠른가요?
병렬 실행만으로 모든 작업에 적용되는 결론은 없습니다. 조율, 중복 작업, 최종 검증을 포함합니다.
Agents API는 무료인가요?
별도 API 요금이 없어도 모델·도구·환경 비용은 남습니다. 계산은 예시이며 EvoLink 가격은 발표되지 않았습니다.
전부 내 VPC 안에 둘 수 있나요?
자체 샌드박스에서 그렇게 추론하면 안 됩니다. 실행 환경과 관리형 서비스는 다른 경계이며 현재 데이터 저장 위치·보존 제한은 여전히 중요합니다.
EvoLink에서 이용 가능한가요?
어떤 변화가 글의 업데이트를 요구하나요?
새 베타/정식 계약, 환경·데이터 제어 변경, 검증된 게이트웨이 지원, 재현 가능한 작업 결과입니다. 날짜만 바꾸지 말고 해당 사실과 권고를 갱신해야 합니다.


