Codex 2026년 9월 최신 업데이트
2026년 9월 22일 공식 Codex 업데이트는 두 가지 선택 기준을 선명하게 만들었습니다. 복잡한 coding과 agentic workflow에는 GPT-6 Sol, 범위가 분명한 고빈도 작업에는 GPT-6 Luna를 배치하고, Codex CLI 0.156.0에서는 그 작업을 fullscreen TUI, voice, usage analytics, worktree session으로 오래 운영할 수 있게 했습니다.
이 글은 신모델의 성능 소개보다 작업 적합성, credit rate, plan과 Enterprise 가용성 조건을 먼저 비교합니다. CLI 변화는 새 명령 목록이 아니라 장시간 세션의 탐색, 사용량 판단, 병렬 작업, 재개 안정성, sandbox 경계라는 사용자 흐름으로 묶었습니다.
이번 업데이트의 중심 메시지
Codex는 하나의 강한 모델을 모든 일에 쓰는 도구에서, 작업 난이도와 처리량에 맞춰 모델을 나누고 여러 agent session을 운영하는 작업 시스템으로 이동하고 있습니다.
Sol과 Luna의 가격 차이는 모델 선택을 단순 취향이 아니라 운영 결정으로 만듭니다. `/usage`와 worktree가 그 결정을 관찰하고 분리하는 도구라면, 세션 복구와 sandbox 수정은 긴 실행이 끊기거나 경계를 벗어날 가능성을 줄이는 기반입니다.
1. 사용자 기능 단위별 가치
| 기능 단위 | 주요 사용자 | 사용자가 느끼는 문제 | 업데이트 가치 | 사용자에게 와닿는 메시지 |
|---|---|---|---|---|
| GPT-6 Sol | 복잡한 구현, 디버깅, 장시간 agentic workflow를 맡기는 개발자와 팀 | 난도가 높은 작업에서는 추론 품질과 긴 실행의 안정성을 함께 확보해야 함 | 복잡한 coding과 agentic workflow에 맞춘 상위 모델을 명시적으로 선택 | 어려운 문제에는 더 깊게 일하는 모델을 배치한다 |
| GPT-6 Luna | 요약, 추출, 반복 수정, 범위가 분명한 coding을 많이 처리하는 사용자 | 모든 작업에 최고 비용 모델을 쓰면 처리량과 credit 효율이 낮아짐 | 집중된 고빈도 작업을 훨씬 낮은 credit rate로 처리 | 작고 선명한 일은 빠르고 가볍게 반복한다 |
| fullscreen TUI | 터미널 안에서 긴 Codex 세션을 운영하는 CLI 사용자 | 출력 탐색, 선택, 복사가 불편하면 대화가 길어질수록 맥락 확인 비용이 커짐 | `/tui`로 fullscreen UI를 예약하고 transcript 검색, mouse selection, 우클릭 복사를 사용 | 터미널 대화를 일회성 출력이 아니라 탐색 가능한 작업 공간으로 쓴다 |
| 기본 voice 입력 | 키보드와 음성을 오가며 요구사항이나 수정 방향을 전달하는 사용자 | 음성 기능을 켜기 위한 사전 설정과 플랫폼별 runtime 차이가 진입을 방해함 | 기본 활성화된 voice를 F8로 전환하고 `/voice settings`에서 조정 | 말하기를 별도 실험 기능이 아니라 기본 입력 방식으로 쓴다 |
| `/usage` analytics | token, account usage, plugin과 skill 사용을 관리하는 개인과 팀 리드 | 무엇이 사용량을 만들었는지 보이지 않으면 모델·도구 선택을 개선하기 어려움 | 하나의 dashboard에서 account usage, token 합계, plugin·skill activity를 확인 | agent 사용량을 감이 아니라 실행 흔적으로 관리한다 |
| agent command center와 worktree session | 여러 작업을 병렬로 분리해 진행하는 개발자와 reviewer | 세션 상태와 checkout이 섞이면 어떤 작업이 끝났고 어디에 변경이 있는지 흐려짐 | 상태별 task filtering과 기본 활성화된 worktree session 생성 | 작업 상태와 Git 공간을 함께 분리해 병렬 작업을 운영한다 |
| 세션 연속성 보완 | Plan mode, streaming 응답, subagent, tmux·SSH를 쓰는 장시간 세션 사용자 | 중단이나 재개 뒤에 답변, plan, thread identity, 입력 형식이 유실될 수 있음 | 실패·중단 시 진행 내용을 보존하고 재개 시 mode와 thread 설정을 더 정확히 복원 | 작업이 끊겨도 이미 만든 판단과 세션 정체성을 잃지 않는다 |
| sandbox isolation 보완 | Windows, Linux, macOS에서 Codex 실행 경계를 검토하는 팀 | 네트워크와 socket, read-only handle의 예외가 sandbox 기대와 실제 격리를 어긋나게 함 | 알려진 inbound connection, privileged socket, read-only handle 쓰기 경로를 차단 | 알려진 격리 틈을 줄이되 sandbox를 절대 안전의 증명으로 오해하지 않는다 |
2. 가치 기준별 핵심 변화
A. 모델 선택: 어려운 일의 Sol, 반복량의 Luna
GPT-6 Sol은 복잡한 coding과 agentic workflow에, GPT-6 Luna는 요약·추출과 범위가 명확한 coding처럼 집중된 고빈도 작업에 맞춰졌습니다. 둘의 관계를 단순한 상·하위 모델로 보기보다 같은 작업 묶음에서 난도와 반복량을 나누는 실행 자원으로 보는 편이 정확합니다.
| 대상 | 적합한 일 | 제공 표면 | 선택 방법 | 조건 |
|---|---|---|---|---|
| GPT-6 Sol | 복잡한 coding과 장시간 agentic workflow | ChatGPT Work와 Codex | `/model` 또는 `codex --model gpt-6-sol` | Ultra 포함 지원 범위에서 선택 |
| GPT-6 Luna | 요약·추출·집중 coding 같은 고빈도 작업 | ChatGPT Work와 Codex | `/model` 또는 `codex --model gpt-6-luna` | 최대 Max, Ultra 미지원 |
| Plus·Pro·Business | Sol과 Luna rollout 대상 | 계정별 rollout 시점에 따라 표시 | 모델 선택기에 보이면 사용 | 가용성을 먼저 확인 |
| Free·Go | desktop app에서 Luna 제공 | Codex desktop 중심 | 표시되는 Luna 선택 | Sol rollout 대상과 구분 |
| Enterprise·Edu | Sol과 Luna rollout 대상 | workspace 정책 적용 | Enterprise는 admin이 모델별 활성화 | local 설정으로 조직 통제를 우회할 수 없음 |
| GPT-5.5 전환 | 2026년 10월 14일 ChatGPT 로그인 기반 제공 종료 | ChatGPT Work와 Codex | Sol 또는 Luna로 작업 역할 재배치 | API 제공 종료 일정은 아님 |
rollout은 계정과 workspace에 따라 순차 적용됩니다. Plus, Pro, Business, Enterprise, Edu는 Sol과 Luna 대상이며 Free와 Go는 desktop app에서 Luna를 사용합니다. Enterprise에서는 관리자가 각 모델을 켜야 하며 local 설정만으로 조직 정책을 우회할 수 없습니다. GPT-5.5는 2026년 10월 14일 ChatGPT와 Codex의 ChatGPT 로그인 기반 사용에서 종료될 예정이므로, 기존 작업을 Sol과 Luna 중 어디로 옮길지도 함께 점검해야 합니다. 이 일정은 API 제공 종료를 뜻하지 않습니다.
모델별 최신 제공 조건: OpenAI Codex 모델 문서
B. 비용 선택: standard credit rate가 역할 분담을 강제한다
standard speed에서 100만 token당 credit은 Luna가 Sol보다 크게 낮습니다. 따라서 짧고 반복적인 수정까지 Sol에 몰아주는 방식보다, Luna로 범위를 좁히고 중요한 판단과 복잡한 구현을 Sol에 넘기는 방식이 처리량을 안정시키기 쉽습니다.
| 모델 | Input | Cached input | Output | 운영 해석 |
|---|---|---|---|---|
| GPT-6 Sol | 50 | 5 | 250 | 복잡한 작업의 품질과 지속성 우선 |
| GPT-6 Luna | 2.5 | 0.25 | 12.5 | 반복량과 credit 효율 우선 |
| GPT-5.6 Sol | 100 | 10 | 500 | Sol 계열 이전 비교 기준 |
| GPT-5.6 Luna | 5 | 0.5 | 30 | Luna 계열 이전 비교 기준 |
표의 수치는 standard speed 기준 100만 token당 credit입니다. 지원되는 환경의 Fast mode는 standard보다 2.5배 credit을 사용합니다. 문서에 표시된 5시간당 local message 수는 작업 크기와 reasoning에 따라 달라지는 추정치이므로 고정 한도로 해석하면 안 됩니다.
최적의 모델은 가장 강한 모델이 아니라, 실패 비용과 반복 비용을 함께 고려했을 때 그 작업에 맞는 모델이다.
credit 산정과 속도별 배율: OpenAI Codex pricing 문서
C. 상호작용: 터미널을 검색 가능한 작업 화면으로 만든다
Codex CLI 0.156.0의 fullscreen TUI는 단순히 화면을 크게 쓰는 기능이 아닙니다. 대화가 길어질수록 필요한 것은 더 많은 출력이 아니라 과거 결정을 찾고, 필요한 부분을 선택하고, 다른 도구로 정확히 옮기는 능력입니다.
| 기능 | 동작 | 사용자 가치 |
|---|---|---|
| fullscreen TUI | `/tui`로 다음 실행부터 fullscreen UI 사용 | 긴 transcript를 별도 작업 화면에서 다룸 |
| transcript 탐색 | 검색, mouse selection, right-click copy | 과거 결정과 출력 재사용 시간을 줄임 |
| voice | 기본 활성화, F8 전환, `/voice settings` | 입력 방식을 작업 상황에 맞춰 즉시 변경 |
| voice runtime | Linux와 Windows용 audio runtime 번들 | 플랫폼별 별도 준비 마찰을 줄임 |
| 표현력 | 6개 terminal theme, Mermaid diagram, display equation | 구조와 수식을 터미널 안에서 더 읽기 쉽게 전달 |
voice가 기본 활성화된 점도 같은 맥락입니다. 키보드 입력을 대체하기보다 요구사항을 길게 설명할 때는 말하고, 코드와 명령을 정밀하게 다룰 때는 타이핑하는 식으로 입력 방식을 전환하게 합니다.
D. 운영: usage, task status, worktree를 하나의 제어면으로 묶는다
모델이 나뉘고 agent가 병렬로 움직일수록 사용자는 세 가지 질문에 답할 수 있어야 합니다. 무엇이 얼마나 사용됐는지, 어느 작업이 어떤 상태인지, 각 변경이 어느 checkout에 있는지입니다. `/usage`와 agent command center는 이 질문을 같은 CLI 경험 안에서 다룹니다.
| 운영 기능 | 제공 정보·동작 | 가치 |
|---|---|---|
| `/usage` | account usage, token totals, plugin·skill activity | 비용과 확장 기능 사용을 한 화면에서 점검 |
| task filtering | agent command center에서 상태별 task 필터 | 대기·진행·완료 작업을 빠르게 구분 |
| worktree session | command center에서 분리된 worktree session 생성 | 동시에 진행하는 변경의 checkout 충돌을 줄임 |
| 기본값 | worktree support 기본 활성화 | 별도 opt-in 없이 병렬 작업 공간을 사용 |
| `/daemon` | local background server 업데이트 | 오래 실행되는 로컬 서비스의 갱신 경로를 명시 |
| `--no-daemon` | background server를 우회해 실행 | daemon 문제가 의심될 때 독립 실행 경로 확보 |
CLI 0.156.0을 명시적으로 설치하려면 `npm install -g @openai/codex@0.156.0`을 사용할 수 있습니다. 설치 방식과 조직 배포 정책이 따로 있다면 기존 관리 경로를 우선해야 합니다.
worktree support가 기본값이 되면서 병렬 세션은 특수한 고급 설정이 아니라 표준 작업 방식에 가까워졌습니다. 다만 worktree는 코드 충돌을 자동 해결하는 기능이 아니므로, 작업 경계를 잘 나누고 합칠 시점을 관리하는 책임은 여전히 사용자와 팀에 있습니다.
E. 연속성: 중단과 재개 뒤에도 세션의 판단을 보존한다
장시간 agent 작업에서는 새 기능보다 중간 결과를 잃지 않는 것이 더 중요할 때가 많습니다. 이번 수정은 streaming 응답, Plan mode, 과거 prompt 편집, tmux·SSH, 조직 proxy와 MCP 인증처럼 세션이 끊기기 쉬운 경계를 다룹니다.
| 안정화 지점 | 변화 |
|---|---|
| streaming 보존 | 실패, interruption, subagent 완료 때 이미 받은 answer와 plan 보존 |
| tmux·SSH | clipboard 동작과 pasted tab indentation 개선 |
| Plan mode 재개 | resume 후 Plan mode를 복원 |
| 과거 prompt 편집 | thread identity와 settings를 유지 |
| 조직 네트워크 로그인 | system proxy를 존중하고 OAuth discovery 503에서도 MCP credential 흐름 보완 |
| voice 안정성 | 발화가 중간에 끊기거나 유실되는 문제 완화 |
핵심은 재시작 자체가 아니라 의미의 연속성입니다. 이미 받은 answer와 plan, 현재 mode, thread identity와 settings가 보존되어야 사용자가 이전 결정을 다시 설명하거나 잘못된 실행 상태를 추측하는 시간을 줄일 수 있습니다.
F. 보안: 알려진 sandbox 격리 틈을 줄이되 과신하지 않는다
0.156.0은 Windows inbound connection, Linux·macOS privileged socket, macOS read-only handle을 통한 쓰기와 관련된 알려진 sandbox isolation gap을 보완합니다. 여러 플랫폼에서 실제 실행 경계를 더 일관되게 만드는 중요한 수정입니다.
| 검토 항목 | 해석 |
|---|---|
| Windows inbound connection | sandbox 경계를 넘을 수 있던 알려진 수신 연결 경로 보완 |
| Linux·macOS privileged socket | 권한 있는 socket 접근과 관련된 격리 예외 보완 |
| macOS read-only handle | 읽기 전용 handle을 통한 쓰기 가능성을 차단 |
| 해석 기준 | 이번 수정은 알려진 gap을 줄인 것이며 완전한 격리를 증명하지는 않음 |
| 팀 권장 | 민감한 secret, network permission, write approval은 기존 최소 권한 정책을 계속 적용 |
보안 수정은 기존 최소 권한 원칙을 없애지 않습니다. sandbox는 알려진 위험을 제한하는 한 계층이며, 민감한 credential 노출 방지, 좁은 writable root, network와 write approval 검토는 계속 별도로 운영해야 합니다.
3. 사용자 세그먼트별 해석
복잡한 기능을 맡기는 개발자
GPT-6 Sol을 선택해 긴 구현과 디버깅의 품질을 우선하고, fullscreen TUI와 세션 복구로 작업 맥락을 오래 유지
반복 작업이 많은 개발자
GPT-6 Luna로 요약, 추출, 작은 수정의 credit 비용을 낮추고 필요한 순간에만 Sol로 전환
팀 리드
`/usage`에서 token과 plugin·skill activity를 보고 모델 배치와 자동화 범위를 실제 사용 패턴에 맞게 조정
병렬 작업 사용자
agent command center의 상태 필터와 기본 worktree session으로 여러 task의 진행 상태와 Git 변경을 분리
Enterprise 관리자
Sol과 Luna를 모델별로 승인하고 local 설정이 workspace 정책을 우회하지 못한다는 조건 아래 rollout을 관리
터미널 중심 사용자
transcript 검색, mouse selection, 우클릭 복사, theme, diagram, equation으로 CLI를 장시간 읽고 다루는 화면으로 사용
원격 환경 사용자
tmux·SSH clipboard, pasted tab, proxy 기반 login 개선으로 로컬과 원격 사이의 입력·인증 불일치를 줄임
보안 검토자
sandbox gap 수정은 확인하되 이를 완전 격리 보증으로 확대 해석하지 않고 secret과 권한 정책을 별도로 유지
4. 기능별 우선순위 평가
| 우선순위 | 기능 | 이유 |
|---|---|---|
| 1 | Sol·Luna 역할 분화와 credit rate | 업무 난이도와 반복량에 따라 품질·비용을 직접 조절하는 가장 큰 사용자 변화 |
| 2 | `/usage` analytics | 모델과 확장 기능 선택을 실제 사용량으로 되돌아볼 수 있어 운영 개선의 기준이 됨 |
| 3 | agent command center와 worktree | 병렬 agent 작업에서 상태와 checkout이 섞이는 구조적 문제를 줄임 |
| 4 | fullscreen TUI | 긴 CLI 세션의 검색·선택·복사를 개선해 누적되는 탐색 비용을 낮춤 |
| 5 | 세션 연속성 수정 | 중단·재개 시 answer, plan, mode, thread 설정을 지켜 장시간 작업 신뢰도를 높임 |
| 6 | sandbox isolation 보완 | 알려진 플랫폼별 격리 틈을 줄이지만 기존 최소 권한 운영을 대체하지는 않음 |
| 7 | voice 기본화 | 입력 선택지는 크게 넓지만 가치 크기는 개인의 작업 환경과 선호에 따라 달라짐 |
| 8 | 표현과 daemon 도구 | diagram·equation·theme와 daemon 제어가 전문 사용자의 세부 운영 경험을 다듬음 |
5. 한 줄 포지셔닝
2026년 9월의 Codex 업데이트는 Sol과 Luna로 작업의 깊이와 처리량을 나누고, CLI 0.156.0으로 그 선택을 관찰·분리·복구하는 agent 작업 운영 릴리스입니다.
1
GPT-6 Sol은 복잡한 agentic coding, GPT-6 Luna는 집중된 고빈도 작업에 배치해 품질과 credit 효율을 함께 관리한다
2
fullscreen TUI, voice, usage analytics, command center, worktree로 긴 CLI 세션을 탐색하고 관찰하며 분리한다
3
세션 복구와 sandbox 보완으로 중단 뒤의 의미 손실과 알려진 실행 경계의 틈을 줄인다