GPT Image 2.5 Flare & Sunburst가 EvoLink에 출시되었습니다GPT Image 2.5 체험하기
관리형 에이전트가 작업을 조율하고 최종 보고서를 완성하는 개념도
제품 출시

OpenAI Agents API 출시: 기능·요금·도입 판단

Jessie
Jessie
COO
2026년 10월 2일
25분 소요
OpenAI Agents API는 Codex 하네스를 애플리케이션 개발자에게 관리형 서비스로 제공합니다. 2026년 9월 10일 발표된 공개 베타에서는 OpenAI가 에이전트 루프를 운영하고, 제품은 작업과 업무 도구, 필요한 실행 환경을 제공합니다. 장시간 에이전트의 기반을 직접 구축할지 서비스에 맡길지 판단하는 방식이 달라집니다. 새로운 기반 모델이 출시된 것은 아닙니다. 공식 발표.

출시를 둘러싼 실무 질문은 “관리형 에이전트란 무엇인가?”보다 구체적입니다. 클라이언트 연결이 끊겨도 작업이 이어지는가? 컨텍스트 압축 뒤에도 중요한 제약이 유지되는가? 병렬 서브 에이전트의 시간 절약이 추가 비용을 정당화하는가? 하네스를 맡긴 뒤에도 애플리케이션이 해야 할 일은 무엇인가?

이 글은 문서화된 기능을 구체적인 평가 작업과 연결합니다. 2026년 10월 2일 확인 기준, EvoLink는 연동을 준비 중이며 아직 호출할 수 없습니다. 접근 및 알림은 제품 페이지에서 안내합니다. 아래 예시는 평가 제안이며 EvoLink의 실측 결과가 아닙니다.

OpenAI Agents API 출시로 무엇이 제공되나요?

질문현재 답변도입 시 의미
발표만 됐나요, 제공사에서 쓸 수 있나요?9월 10일 공개 베타 발표정식 출시 계약을 가정하지 말고 베타 문서로 평가
Agents SDK의 새 이름인가요?아니요. API는 호스팅 런타임, SDK는 앱에서 실행전환하면 운영 책임이 달라짐
Codex 하네스가 모델인가요?아니요. 모델 호출, 도구, 진행 작업을 조율모델 품질뿐 아니라 전체 흐름 평가
EvoLink에서 호출할 수 있나요?연동 중이며 호출은 아직 미개방검증된 경로를 유지하며 시험 작업 준비
API 공개가 모델 가중치 공개인가요?이 런타임 발표는 가중치나 모델 라이선스를 보장하지 않음런타임 소스 공개 여부, 호스팅 서비스 약관, 모델 라이선스 구분

이름 혼동은 구현에 영향을 줍니다. Agents SDK 설치 튜토리얼은 유용할 수 있지만 새 관리형 API의 동작을 보여주는 것은 아닙니다. OpenAI 호환 모델 엔드포인트도 지속형 에이전트 세션 지원을 입증하지 않습니다. 예제를 재사용하기 전에 실제 호출하는 제품을 확인하세요.

Codex 하네스 공개가 중요한 이유

코딩·분석 제품에서 모델 호출은 일부에 불과합니다. 다음 도구 작업을 선택하고, 결과를 이어받고, 필요한 문맥을 유지하고, 중단 후 계속하는 장치가 필요합니다. 관리형 서비스는 이를 런타임으로 묶습니다. 이 기반을 유지하는 데 많은 인력이 들어가는 팀에서 가치가 큽니다.

모든 앱이 전환해야 한다는 뜻은 아닙니다. 분류, 검증, 구조화 응답처럼 짧고 고정된 순서라면 기존 오케스트레이션이 이미 단순하고 안정적일 수 있습니다. 중간 발견에 따라 다음 행동이 바뀌고 도구 호출이 길게 이어질 때 더 관련성이 높습니다. API·SDK·Responses 비교에서 선택을 다룹니다.

이번 출시를 계기로 개발 업무를 목록화하고, 업무 자체를 개선하는 공수와 실행 기반을 유지하는 공수를 분리해 보세요. 후자가 충분히 크고 서비스 경계가 제품에 맞아야 관리형 런타임이 유의미한 운영 절감을 가져옵니다.

Agents API 작업 흐름: 입력 파일, 반복 실행, 결과 검수와 전달
Agents API 작업 흐름: 입력 파일, 반복 실행, 결과 검수와 전달
입력 → 에이전트 실행 → 앱 검수 → 전달. 실제 파일과 업무 규칙을 확인한 뒤 작업 완료로 처리합니다.

장시간 세션과 컨텍스트 압축: 연속성을 검증하세요

OpenAI는 컨텍스트 창을 넘어 작업을 계속하도록 하네스가 자동 압축한다고 설명합니다. 검증할 가치는 긴 작업의 연속성이지, 무한하고 완벽한 기억이 아닙니다. 출시 설명.

저장소 유지보수 시험으로 페이지네이션 수정, 공개 응답 형식 유지, 인증 변경 금지, 관련 테스트 출력 첨부를 지시해 보세요. 여러 조사·수정 단계 뒤 경계 사례를 추가하고 최종 패치가 원래 제약도 지키는지 확인합니다. 대화 기록이 길다는 사실만으로는 알 수 없습니다.

검수 기준을 앱의 작업 기록에 저장하세요. 리뷰 때 변경 파일, 응답 테스트 데이터, 테스트 증거를 대조하면 문맥 처리 실패와 처음부터 불명확했던 요구를 구분할 수 있습니다. 나중에 다른 런타임을 평가할 독립 기록도 됩니다.

데이터 분석도 같습니다. 대화는 자연스럽지만 회계 기간이 바뀌거나 제외 조건이 빠질 수 있습니다. 불변 조건을 직접 평가하세요. 지속형 세션을 모든 업무 제약이 모든 재개를 통과한다는 검증되지 않은 보장으로 바꾸면 안 됩니다.

도구 검색과 프로그래밍 방식 호출은 다른 문제를 해결합니다

Tool Search는 필요한 도구 정의를 그때 불러옵니다. Programmatic Tool Calling은 코드로 결과를 결합·필터링한 뒤 더 작은 결과를 모델에 돌려줍니다. 전자는 문맥에 넣을 기능, 후자는 그 기능을 활용하는 처리 방식입니다.

계정 분석 도우미에 CRM 작업이 많아도 질문에 필요한 것은 일부일 수 있습니다. 동시에 여러 계정 레코드를 가져와 요약 통계를 계산해야 할 수도 있습니다. 올바른 작업을 찾는다고 데이터 수집·처리 비용이 사라지지는 않습니다.

따라서 도구 선택의 정확성과 독립 계산 대비 결과 정확도를 각각 기록하세요. 최종 답변이 짧다고 집계가 정확한 것은 아닙니다. 누락 레코드, 빈 결과, 단위 불일치를 시험 데이터에 포함합니다.

고객에게 영향을 주는 쓰기 작업은 불투명한 집계 단계 밖에 두는 것을 권합니다. 분석은 변경안을 만들고, 앱 코드가 대상과 권한을 확인한 뒤 적용합니다. 이는 설계 권고이며 EvoLink가 현재 두 도구 기능을 제공한다는 주장은 아닙니다.

병렬 서브 에이전트: 나눌 수 있는 작업부터

멀티 에이전트 문서는 별도 문맥을 가진 서브 에이전트를 주 에이전트가 조율한다고 설명합니다. 문서별 검토나 독립 조사가 후보이지만, 특정 작업의 고정된 속도 향상을 증명하지는 않습니다.

평가용 장애 조사 시나리오에서는 배포 변경, 오류 표본, 의존 서비스 상태를 독립적인 읽기 전용 작업으로 나눕니다. 각각 증거, 가설, 판단의 불확실성을 반환하도록 요구하고 조율 에이전트가 설명의 일치 여부를 확인한 뒤 대응을 제안합니다.

반대로 세 에이전트가 같은 설정 파일을 고치면 충돌과 조정 작업이 늘 수 있습니다. 증거 수집을 나누고 최종 수정은 한 주체가 담당하게 하세요. 가장 빠른 부분 작업이 아니라 통합·충돌 해결을 포함한 검수 통과까지의 시간을 측정합니다.

같은 장애 사례로 단일 에이전트와 서브 에이전트 수를 제한한 구성을 비교하고 총비용, 수동 수정도 함께 기록합니다. 더 빨라도 검증하기 어려운 답변이라면 제품 요구를 놓친 것입니다.

호스팅 샌드박스, 자체 환경, 샌드박스 없음

OpenAI 문서는 실행 환경 없음, OpenAI 호스팅, 자체 호스팅의 세 방식을 설명합니다. 외부 도구만 쓰는 작업에 파일시스템과 셸을 자동으로 줄 필요는 없습니다. 아키텍처.
제안 작업먼저 평가할 구성이유앱 책임
업무 함수로 계정 조회샌드박스 없음로컬 계산이 아니라 서비스 조회 결과가 필요사용자 인증과 레코드 접근 제어
CSV 분석과 통합 문서 생성호스팅 샌드박스파일, 패키지, 산출물이 핵심합계 검증과 검수 통과 산출물 저장
특수 의존성이 있는 저장소 작업자체 호스팅기존 연산 기반이나 도구가 중요자원 준비, 격리, 복구, 종료
자체 샌드박스 연결 논의는 실행 위치에 관한 것입니다. 자체 호스팅 가이드의 실행기는 관리형 서비스로 외부 연결을 만듭니다. 실행기를 내부에 둔다고 호스팅 하네스까지 이동하지 않습니다.
작업 파일과 게시된 아티팩트도 구분하세요. 파일 가이드는 환경별 조회 경로가 다르다고 설명합니다. 보고서는 실제 파일을 가져와 검증해야 끝납니다. “파일 준비 완료”라는 메시지 자체는 산출물이 아닙니다.
파일 가이드에 따르면 OpenAI 호스팅 환경에서는 /workspace/outputs에 쓴 파일이 턴 완료 시 불변 아티팩트로 게시됩니다. 완료 턴과 파일 경로를 함께 맞춰, 수정된 분석에서 이전 보고서를 제공하지 않도록 합니다. 게시된 아티팩트는 환경 만료 뒤에도 유지되지만 세션 삭제 전 필요한 사본을 보관하세요.
자체 호스팅 환경에서는 내부 기반이나 샌드박스 제공사를 통해 가져와 만료 전에 앱 저장소에 복사합니다. /workspace/outputs에 쓴다고 OpenAI Artifacts API에 게시되지 않습니다. 같은 CSV 작업이라도 고객에게 보이는 하나의 “보고서 다운로드” 동작 뒤에 환경별로 두 종류의 다운로드 어댑터가 필요합니다. 조회와 수명.
호스팅 및 자체 환경의 보고서를 앱 저장소로 가져오는 두 경로
호스팅 및 자체 환경의 보고서를 앱 저장소로 가져오는 두 경로
위는 호스팅 아티팩트 조회, 아래는 자체 기반의 파일 조회입니다. 모두 앱에서 보관과 전달을 담당합니다.

실행에서 다운로드 가능한 보고서까지

CSV 작업의 제품 흐름을 다음처럼 설계할 수 있습니다. API 이벤트 이름이 아니라 앱 상태입니다.

고객 표시앱 동작다음 단계 조건
처리 중업무 작업과 관리형 세션을 연결하고 진행 상황 추적검사할 결과가 준비됨
결과 확인 중올바른 버전을 조회해 합계·예외 확인통합 문서가 저장된 검수 기준을 통과
다운로드 가능검수 통과 결과 저장과 사용자의 다운로드 권한 적용실제 파일을 가져올 수 있음
다시 연결 중스트림 중단 뒤 기존 세션과 저장 작업 읽기원래 작업이 진행 중인지 결과가 있는지 판단
확인 필요유용한 출력 보존과 미해결 문제 설명입력 수정, 리뷰 결정 또는 통제된 재시도
빠른 시작은 턴 완료 뒤 결과를 검사하고, 연결이 끊긴 실행을 재시도하기 전 저장된 세션 상태를 조회하도록 합니다. 그래서 보고서 완료 전에 “결과 확인 중”이 필요합니다. 일시적인 브라우저 단절이 기본 동작으로 두 번째 유료 작업을 만들지 않게 합니다.

추가 API 요금 없음이 무료를 뜻하지는 않습니다

발표는 Agents API 자체에 별도 요금이 없다고 설명합니다. 모델, 도구, 호스팅 컨테이너 비용은 남습니다. 무료 에이전트 제안도, EvoLink의 향후 가격도 아닙니다. 발표, 공식 비용 범주.

모델·도구·환경 비용, 실패 시도, 검수 통과 출력을 작업 장부에 기록합니다. 자체 운영과 리뷰 시간은 별도 열에 둡니다. 토큰만의 추정치와 모든 비용을 포함한 운영비를 비교하지 않기 위해서입니다.

설명용 계산이며 견적이나 벤치마크가 아닙니다. 한 배치의 모델 사용료가 $24, 도구 비용이 $6, 환경 사용료가 $10이고 80개 결과가 검수를 통과하면, 검수 통과 결과당 직접 비용은 $40 / 80 = $0.50입니다. 제출한 100개로 나눈 $0.40은 실패 20개를 숨깁니다. 추가 $8로 그중 10개를 복구하면 총비용은 $48, 검수 통과 결과는 90개가 되어 결과당 $48 / 90, 약 $0.53이 됩니다. 단가가 올라도 쓸 수 있는 결과가 늘어날 가치는 있습니다. 모든 금액은 USD이며 원화 환산이 아닙니다.
유휴 환경은 한 번의 활성 실행에서 추정하지 말고 실제 수명과 청구를 확인하세요. 세션 기간, 연산 환경 수명, 고객 대기 시간은 별개입니다. 수명주기 가이드도 구분하며, 예산표에도 반영해야 합니다.

도입 판단을 바꿀 수 있는 베타 제약

2026년 10월 2일 확인한 개요는 미국 내 데이터 레지던시만 지원하고 Zero Data Retention(ZDR)은 지원하지 않는다고 명시합니다. 자체 호스팅 샌드박스를 사용해도 동일합니다. 요구와 맞지 않으면 현재 서비스 도입을 막는 조건이지, 나중에 설정할 항목이 아닙니다.
함수 가이드에서는 앱이 호출을 처리해 결과를 반환합니다. 샌드박스를 붙여도 핸들러가 자동으로 이동하지 않습니다. 해당 워커와 오류 처리 비용을 반영하세요.
완료된 턴도 모든 의도된 동작의 성공을 증명하지 않습니다. 빠른 시작은 완료, 실패, 유휴 상태를 구분합니다. 업무 검수는 단일 수명주기 상태 표시가 아니라 산출물이나 대상 시스템의 실제 결과에 근거해야 합니다.

결정에 도움이 되는 첫 평가

CSV 두 개를 대조하고 불일치 행을 설명해 통합 문서와 요약을 만드는 제한된 작업을 사용하세요. 아래는 이 글에서 제안하는 테스트 설계이며 실측 결과는 없습니다.

사례데이터 또는 중단검수 증거
일반 입력대조 시 일치해야 할 합계를 알고 있는 두 내보내기 파일통합 문서의 합계가 독립 계산과 일치
모호한 데이터중복 ID와 통화 누락모호한 부분을 명시하고 일치 관계를 임의로 만들어 내지 않음
클라이언트 단절시작 후 스트림 닫기기존 작업을 찾고 무조건 재제출하지 않음
지시 변경작업 중 제외 조건 추가최종 합계와 설명에 새 범위 반영
결과 조회결과 보존 후 연산 종료앱에서 검수 통과 산출물을 가져와 열 수 있음
예산 확인모든 시도를 배치에 포함지출과 검수 통과 결과 수를 대조할 수 있음
작업 버전, 모델, 런타임 설정, 호출 경로, 타임스탬프, 검수 결과를 함께 저장합니다. 좋은 데모만 보여주지 말고 실패도 남기세요. 기존 품질을 만족하고 시간·운영·비용의 측정 가능한 이점이 있을 때 확대합니다. 지금 필요한 모델 호출은 검증 경로를 유지하거나 EvoLink 모델 목록을 확인하세요. 관리형 세션 지원은 별도 판단입니다.

자주 묻는 질문

OpenAI Agents API는 언제 출시됐나요?

공개 베타 발표일은 2026년 9월 10일입니다. 정식 출시나 EvoLink 시작일을 의미하지 않습니다.

Codex 모델이나 Agents SDK와 같은가요?

Codex 하네스를 중심으로 하는 관리형 서비스입니다. 모델 선택과 앱 안에서 SDK로 실행하는 오케스트레이션은 다른 개념입니다.

자동 압축이면 기억이 무제한인가요?

아닙니다. 긴 작업에서 제약과 증거가 계속 유효한지 평가하고 업무 검수 기록은 대화 밖에 보관하세요.

서브 에이전트는 항상 싸고 빠른가요?

병렬 실행만으로 모든 작업에 적용되는 결론은 없습니다. 조율, 중복 작업, 최종 검증을 포함합니다.

Agents API는 무료인가요?

별도 API 요금이 없어도 모델·도구·환경 비용은 남습니다. 계산은 예시이며 EvoLink 가격은 발표되지 않았습니다.

전부 내 VPC 안에 둘 수 있나요?

자체 샌드박스에서 그렇게 추론하면 안 됩니다. 실행 환경과 관리형 서비스는 다른 경계이며 현재 데이터 저장 위치·보존 제한은 여전히 중요합니다.

EvoLink에서 이용 가능한가요?

아직 아닙니다. 연동 알림을 신청할 수 있으나 API 자격 증명 발급은 아닙니다.

어떤 변화가 글의 업데이트를 요구하나요?

새 베타/정식 계약, 환경·데이터 제어 변경, 검증된 게이트웨이 지원, 재현 가능한 작업 결과입니다. 날짜만 바꾸지 말고 해당 사실과 권고를 갱신해야 합니다.

출처와 관련 글

기술 출처는 해당 설명에 연결했습니다. 시장 조사에서는 HN의 API/SDK 질문과 프레임워크 대체 논의도 확인했습니다. 다루는 질문을 보여주는 자료이지 기능이나 절감 실측의 근거는 아닙니다.
프레임워크 선택, 동일 조건의 비교 평가, 마이그레이션 롤백은 런타임 비교, 게이트웨이 이용 상태는 EvoLink 제품 페이지에서 확인하세요.