GPT-5-Codex를 포함한 OpenAI Codex는 2026년 기준 법무·재무·채용 부서에서도 주요 AI 업무 도구로 자리 잡았습니다. CLI 설치부터 예약 자동화(Automations)까지 설정 방법을 공식 자료 기준으로 정리하고, 요금 구조·보안 기본값·사람이 반드시 검토해야 할 지점을 함께 확인합니다.

Codex가 자동화할 수 있는 업무 유형
공식 자료에 따르면 Codex는 기능 추가, 버그 수정, 대규모 리팩터링, 테스트 작성, PR 초안 생성, 코드 리뷰를 처리합니다. PR 코드 리뷰 기능은 GitHub 저장소에 설정하면 PR이 draft에서 ready 상태로 전환될 때 자동으로 실행됩니다. "@codex review" 댓글로 수동 요청도 가능하며, "@codex review for security vulnerabilities"처럼 검토 방향을 지정할 수도 있습니다.
코딩 외 업무도 가능합니다. OpenAI가 2026년 6월 발표한 경제 연구에 따르면 OpenAI 내부에서 법무·재무·채용 부서가 2026년 4월 전후로 Codex를 주요 AI 도구로 전환했으며, 비즈니스 기능 직원이 Codex로 처리한 작업의 4분의 1 이상이 엔지니어링·코딩 유형이었습니다. 이는 비개발자도 Codex를 통해 기술 실행 작업에 접근할 수 있음을 보여줍니다.
- 코딩: 기능 개발, 리팩터링, 버그 수정, 테스트 생성, PR 초안
- 코드 리뷰: GitHub 연동 후 PR 상태 변경 시 자동 실행, 보안·의존성 취약점 지적
- 반복 업무 자동화: 이슈 트리아지, CI 실패 요약, 릴리스 브리핑
- 비개발 업무(OpenAI 내부 사례): 데이터 변환, 문서화, 구조화된 분석
근거: Introducing upgrades to Codex | OpenAI, How agents are transforming work | OpenAI
시작 방법 — CLI, IDE 확장, 클라우드 중 선택
Codex는 세 가지 환경에서 실행되며, 같은 ChatGPT 계정으로 연결되어 작업 컨텍스트가 유지됩니다.
**CLI**: 터미널에서 `npm i -g @openai/codex` 명령으로 설치하고 ChatGPT 계정으로 로그인합니다. 오픈소스이며 터미널에서 바로 사용합니다.
**IDE 확장**: VS Code, Cursor 등 VS Code 계열 에디터를 지원합니다. 에디터에서 열린 파일이나 선택한 코드를 컨텍스트로 자동 활용하므로 짧은 프롬프트로도 빠른 결과를 얻을 수 있습니다. 클라우드 작업을 IDE 안에서 생성·추적하고, 완료된 클라우드 작업을 IDE에서 이어서 수정할 수도 있습니다.
**클라우드**: 웹·iOS 앱·GitHub에서 장기 작업을 위임하고 병렬로 여러 작업을 실행합니다. 공식 발표에 따르면 컨테이너 캐싱으로 신규 작업 및 후속 작업 완료 시간 중간값이 90% 단축됐습니다.
- CLI: `npm i -g @openai/codex` 설치 후 ChatGPT 계정 로그인
- IDE 확장: VS Code·Cursor 지원, 열린 파일 컨텍스트 자동 반영
- 클라우드: 웹·iOS·GitHub에서 장기 작업 위임 및 병렬 실행
- 세 환경 모두 ChatGPT 계정으로 연동, 작업 전환 시 컨텍스트 보존
근거: Introducing upgrades to Codex | OpenAI, Codex | AI Coding Partner from OpenAI | OpenAI, Introducing the Codex app | OpenAI
요금 구조와 이용 한도
Codex는 ChatGPT Plus, Pro, Business, Edu, Enterprise 플랜에 포함됩니다. 공식 안내에 따르면 플랜별 이용 규모는 다음과 같습니다. Plus·Edu·Business는 주당 몇 회의 집중 코딩 세션을 커버하는 수준이며, Pro는 여러 프로젝트를 병행하는 전체 근무 주를 지원합니다. Business 플랜은 포함 한도를 초과하면 크레딧을 추가 구매할 수 있고, Enterprise 플랜은 공유 크레딧 풀로 개발자 실사용량만 청구합니다.
API 키로 Codex를 사용하는 개발자는 GPT-5-Codex를 GPT-5와 동일한 가격에 이용할 수 있으며, Responses API에서만 제공됩니다. 정확한 단위 가격(토큰당 요금)은 OpenAI 가격 페이지에서 별도 확인이 필요합니다.
- ChatGPT 구독에 포함: Plus, Pro, Business, Edu, Enterprise
- API 키 사용 시: GPT-5와 동일 가격, Responses API 전용
- Business: 포함 한도 초과 시 크레딧 추가 구매 가능
- Enterprise: 공유 크레딧 풀, 실사용량 기반 청구
근거: Introducing upgrades to Codex | OpenAI
보안 기본값 — 샌드박스·네트워크 차단·승인 모드
Codex는 기본적으로 네트워크 접근이 비활성화된 샌드박스 환경에서 실행됩니다. 공식 문서에 따르면 이 기본값은 컴퓨터에서 유해한 작업 실행을 차단하고 신뢰할 수 없는 소스의 프롬프트 인젝션 위험을 낮추기 위한 설계입니다.
CLI와 IDE 확장의 승인 모드는 세 단계로 구성됩니다. **읽기 전용 모드**: 모든 명령 실행 전 명시적 승인 필요. **자동 모드**: 워크스페이스 내 전체 접근 허용, 워크스페이스 외부 작업은 승인 필요. **전체 접근 모드**: 파일 읽기와 네트워크 접근까지 허용. 클라우드에서는 허용 도메인 목록을 지정해 네트워크 접근 범위를 제한할 수 있습니다. 웹 검색·MCP 서버 연결을 활성화하면 기능이 확장되지만 위험도도 함께 높아진다고 공식 문서에 명시되어 있습니다.
- 기본값: 로컬·클라우드 모두 네트워크 접근 비활성화 (샌드박스)
- 승인 모드 3단계: 읽기 전용 / 자동(워크스페이스 내) / 전체 접근
- 클라우드: 허용 도메인 목록으로 네트워크 범위 제한 가능
- 웹 검색·MCP 활성화 시 기능 확장, 위험도 동시 증가
근거: Introducing upgrades to Codex | OpenAI, Introducing the Codex app | OpenAI
배포 전 반드시 사람이 확인해야 할 지점
OpenAI 공식 안내는 Codex가 생성한 코드를 통합·실행하기 전 반드시 수동으로 검토·검증해야 한다고 명시합니다. Codex는 각 작업에 터미널 로그, 테스트 결과, 파일 인용을 제공해 검증 근거를 제시하므로 이를 확인 후 판단해야 합니다.
Codex가 불확실하거나 테스트가 실패하면 명시적으로 알립니다. 이 시점에 사람이 방향을 결정해야 합니다. 코드 리뷰 기능은 인간 리뷰어를 대체하는 것이 아니라 추가 검토자로 활용하는 것이 권장 방식입니다. GPT-5-Codex는 생물학·화학 도메인에서 High capability로 분류되어 관련 안전장치가 적용되어 있으며, 악성 소프트웨어 개발 요청은 거부하도록 훈련되어 있습니다.
- 배포 전: 터미널 로그·테스트 결과·파일 인용을 직접 확인 후 통합
- 불확실·실패: Codex가 명시적으로 알리므로 사람이 방향 결정 필요
- 코드 리뷰 기능: 인간 리뷰 대체 아님, 추가 검토자 역할
- 생물·화학 관련 요청: 안전장치 적용, 악성 SW 개발 거부 훈련됨
근거: Introducing upgrades to Codex | OpenAI, Introducing Codex | OpenAI
장기 작업과 예약 자동화(Automations) 설정
Codex는 복잡한 작업에 대해 수 시간 동안 독립 실행할 수 있습니다. 공식 발표에 따르면 GPT-5-Codex는 테스트 기준 7시간 이상 독립 실행하며 구현을 반복하고 테스트 실패를 수정했습니다. OpenAI 개발자 블로그에 게재된 사용자 실험(공식 제품 기능이 아닌 개발자 사례)에서는 25시간 연속 실행, 약 1,300만 토큰 사용, 약 3만 줄 코드 생성이 확인됐습니다.
**Automations** 기능으로 정해진 일정에 맞춰 반복 업무를 자동 실행할 수 있습니다. Automation이 완료되면 결과는 검토 대기열에 쌓이고, 사용자가 이어서 작업할 수 있습니다. OpenAI 내부에서는 이슈 트리아지, CI 실패 요약, 일일 릴리스 브리핑, 버그 점검 등에 활용하고 있습니다.
장기 작업에서 컨텍스트 이탈을 줄이는 방법(개발자 실험 사례): 목표·제약(Prompt.md), 마일스톤·검증 명령(Plan.md), 진행 기록(Documentation.md)을 저장소에 두고 Codex가 반복 참조하게 했을 때 효과적이었습니다. `/plan` 명령으로 큰 작업을 검토 가능한 마일스톤 단계로 분해할 수도 있습니다.
- 최대 독립 실행: 공식 테스트 기준 7시간 이상, 개발자 실험에서 25시간 확인
- Automations: 일정 기반 반복 실행, 결과는 검토 대기열에 저장
- 장기 작업 팁(개발자 실험 사례): Prompt.md·Plan.md로 컨텍스트 명시화
- /plan 명령: 큰 작업을 검토 가능한 마일스톤 단계로 분해
근거: Introducing upgrades to Codex | OpenAI, Run long horizon tasks with Codex | OpenAI Developers, Introducing the Codex app | OpenAI
누가 써야 하는가 — 개발자와 비개발자 구분
Codex는 처음에 개발자 대상으로 출시됐지만, OpenAI 경제 연구에 따르면 비개발자 채택이 가장 빠르게 성장하고 있습니다. 개인 사용자 기준 비개발자 수가 2025년 8월 이후 137배 증가했으며, OpenAI 내부에서는 2026년 4월 전후로 법무·재무·채용 부서가 Codex를 주요 AI 도구로 전환했습니다.
**엔지니어**에게는 반복적이고 범위가 명확한 작업(리팩터링, 테스트 작성, 이슈 트리아지, PR 코드 리뷰) 위임에 적합합니다. **비개발자**는 기술 실행이 필요했던 데이터 변환, 문서화, 구조화된 분석에 활용할 수 있습니다. **소규모 팀**은 여러 에이전트를 병렬 실행해 주 단위 작업을 더 빠르게 처리하는 데 씁니다. 처음 사용할 때는 작은 범위의 작업부터 시작해 결과를 직접 검증한 뒤 범위를 확장하는 것이 권장됩니다.
- 엔지니어: 리팩터링·테스트·코드 리뷰·이슈 트리아지 자동화
- 비개발자: 데이터 변환·문서화·구조화 분석에 활용
- 소규모 팀: 병렬 에이전트로 단기간에 많은 작업 처리
- 첫 시작: 작은 범위로 시작 → 결과 직접 검증 → 범위 확장
근거: How agents are transforming work | OpenAI, Codex | AI Coding Partner from OpenAI | OpenAI
자료 확인 기준
2026년 09월 23일에 공식 원문을 확인했습니다. 확인일과 정책·공연의 시행일은 다를 수 있으며 변경 공지는 원문을 우선합니다.

댓글 남기기