OpenAI Codex 플러그인, 코드 리뷰를 두 번째 LLM에 맡기다

OpenAI Codex 플러그인은 Claude Code 안에서 로컬 Codex에 코드 리뷰, 적대적 비평, 작업을 위임합니다.

OpenAI Codex 플러그인, 코드 리뷰를 두 번째 LLM에 맡기다
Share

작성한 코드의 최종 승인을 같은 모델에게 맡기는 것은 지름길이 아니라 구조적 약점이다. OpenAI의 새 Claude Code 플러그인은 리뷰를 내 컴퓨터에서 실행되는 경쟁 모델에 넘겨 이 문제를 보완한다.

Codex 플러그인이 단일 LLM 리뷰로는 놓치는 부분

한 모델이 코드를 작성한 뒤 그 코드를 다시 리뷰하면, 리뷰어와 작성자는 학습 단계에서 생긴 같은 사각지대를 공유한다. 같은 가중치에 기대는 이 안티패턴 때문에 셀프 리뷰는 구조적으로 약해진다. 두 번의 검토가 동일한 전제를 품고 있고, 리뷰어가 작성자의 오류를 그대로 이어가기 쉽기 때문이다 . openai/codex-plugin-cc 플러그인은 2026년 7월 8일 공개된 1.0.6 버전으로, Apache-2.0 라이선스이며 별은 약 29.7k개다 . 이 플러그인은 리뷰 작업을 로컬에서 실행되는 Codex 프로세스로 보내 루프 안에 다른 벤더, 다른 학습 코퍼스, 다른 실패 양식을 추가한다. 그래서 두 에이전트가 서로 놓칠 법한 실수를 잡아낼 수 있다.

"When reviewer and author share weights, both passes share identical blind spots and the reviewer perpetuates the author's errors." — codex-plugin-cc에 대한 독립 분석에서 (source: Daniel Vaughan).

기본으로 제공되는 읽기 전용 모드는 두 가지다. /codex:review는 표준 diff 검토를 실행하며(--base <ref>, 포그라운드 또는 백그라운드 지원), /codex:adversarial-review는 전제, 인증 경로, 데이터 손실 위험, 경쟁 상태, 롤백 커버리지를 겨냥해 더 강하게 검토한다 . 이 방식은 로컬에서 즉시 실행된다. 2026년 3월 9일 발표된 Anthropic의 관리형 Code Review와는 다르다. 해당 서비스는 PR마다 여러 에이전트를 실행하고 건당 대략 15~25달러와 약 20분이 들며, 내부적으로 의미 있는 리뷰 코멘트 비율을 16%에서 54%로 끌어올렸고 잘못된 것으로 표시된 발견은 1% 미만이었다 . 크로스 벤더 방식의 장점은 벤치마크로 입증된 우월함이 아니라 실제 상호 보완성이다. 특히 여러 파일에 걸친 diff, 위험한 아키텍처 변경, 보안 민감 경로에서 가장 설득력이 크다.

플러그인을 켜기 전에 준비할 것

What the Codex plugin does that a single LLM review misses (source: codex.danielvaughan.com)

슬래시 명령을 하나라도 실행하기 전에, 먼저 컴퓨터에 네 가지가 준비되어 있어야 한다. 이 플러그인은 새 프로젝트 시크릿을 추가하지 않고 독립적인 원격 API 호출도 하지 않는다. 로컬 Codex 설치를 감싸고, 이미 있는 인증과 설정을 그대로 재사용한다 .

  • PATH에 있는 Node.js 18.18 이상. 플러그인에는 codex-companion.mjs라는 Node 동반 프로세스가 포함되어 있으며, 인자를 파싱하고 git 상태를 찾고 작업 기록을 jobs/<job-id>.json 아래에 저장한다 .
  • 인증: ChatGPT 구독(무료 티어도 충분) 또는 OpenAI API 키. 해당 컴퓨터에서 Codex 인증을 한 적이 없다면, 플러그인을 호출하기 전에 codex login을 실행한다 .
  • 전역 codex 바이너리. 플러그인은 OpenAI를 직접 호출하지 않고 기존 설치를 감싼다. 없다면 /codex:setup으로 설치할 수 있고, 또는 npm install -g @openai/codex(또는 curl -fsSL https://chatgpt.com/codex/install.sh | sh 설치 스크립트)를 실행하면 된다 .

그 밖의 항목, 즉 config.toml, MCP 서버, 샌드박스 설정, repo checkout은 있는 그대로 재사용된다. 따라서 프로젝트 자체에 추가로 연결할 것은 없다.

Claude Code에서 Codex 플러그인 켜기

Screenshot of https://code.claude.com/docs/en/hooks

codex 바이너리가 준비되어 있다면, 세션에 플러그인을 연결하는 데 필요한 명령은 네 개다. 활성 Claude Code 세션 안에서 다음 순서대로 실행한다.

  1. 마켓플레이스 소스를 추가한다: /plugin marketplace add openai/codex-plugin-cc .
  2. 세션에 플러그인을 설치한다: /plugin install codex@openai-codex .
  3. 레지스트리를 다시 불러온다: /reload-plugins. Claude Code가 새 /codex: 슬래시 명령을 인식해야 호출할 수 있다.
  4. 설치와 인증을 확인한다: /codex:setup. 전역 codex 바이너리가 있고 인증되어 있는지 확인하며, 선택적으로 리뷰 게이트도 켤 수 있다(다음에서 다룸) .

첫 검토는 /codex:review로 실행한다. 기본적으로 작업 트리를 기준으로 staged 및 unstaged 변경을 리뷰하며, 추적되지 않는 콘텐츠는 24 KiB로 제한된다 . 특정 브랜치나 커밋과 diff를 보고 싶다면 /codex:review --base <ref>를 사용한다. 작업 트리가 깨끗하면 기본 브랜치를 기준으로 자동 감지가 실행된다 .

추론 깊이는 플러그인이 아니라 Codex 자체 설정에서 조정한다. ~/.codex/config.toml(사용자 전체) 또는 .codex/config.toml(프로젝트)에 model_reasoning_effort를 설정한다. 허용되는 값은 none, minimal, low, medium, high, xhigh다 . 프로젝트 수준 설정은 해당 파일을 명시적으로 신뢰한 경우에만 로드되므로, 신뢰하지 않은 repo의 .codex/config.toml은 작동하지 않는다.

현실적으로 알아둘 점: 두 공급자 비용, 중단 게이트, 대규모 diff 처리 속도

Activating the Codex plugin in Claude Code

이 플러그인을 실행하면 과금 미터가 두 개 동시에 돌아갑니다. Claude Code 세션에는 Anthropic 과금이, 모든 Codex 작업에는 OpenAI 과금이 적용됩니다. 플러그인 자체는 원격 호출을 하지 않습니다. 로컬 codex 바이너리를 감싸서 실행하므로 사용량은 Codex 한도에 집계됩니다 . 어느 한 공급자가 다른 쪽 비용을 상쇄해 주지 않으며, 둘 다 별도로 비용을 지불합니다.

선택 기능인 리뷰 게이트는 신중하게 다뤄야 합니다. /codex:setup --enable-review-gate로 활성화하면 900초 제한 시간이 있는 Stop 훅이 등록되고, Claude의 응답에 대해 Codex 검토가 실행됩니다. Codex가 문제를 찾으면 해당 문제가 해결될 때까지 Claude가 종료되지 못하게 막습니다 .

README는 이 기능이 "can create long-running Claude/Codex loops that drain usage limits"라고 경고합니다. 작업이 많은 저장소에서 게이트를 켜기 전에 읽어둘 만한 설계상 주의사항입니다 (source: codex-plugin-cc README).

처리 속도도 중요합니다. companion은 한 번에 하나의 스트리밍 요청만 처리합니다 . 따라서 여러 파일에 걸친 큰 diff는 백그라운드에서 실행하고 /codex:status로 상태를 확인한 뒤, /codex:result로 결과를 가져오는 편이 좋습니다. Node codex-companion.mjs와 Codex app server는 로컬 프로세스 오버헤드를 추가하므로, 메모리가 적은 노트북에서는 샌드박스와 메모리를 두고 경쟁할 수 있습니다. 내부적으로 app-server 프로토콜은 stdio JSONL 위에서 동작하는 JSON-RPC 2.0이며, thread/startturn/start 프리미티브를 사용합니다 . 리뷰가 멈췄을 때 jobs/<job-id>.json을 살펴보는 데 도움이 되는 배경 정보입니다.

더 활용하기: /codex:adversarial-review, /codex:rescue, /codex:transfer

표준 리뷰 흐름에 익숙해지면 세 가지 명령으로 플러그인을 단순한 수동 비평 도구에서 방향을 지정할 수 있고 쓰기까지 가능한 위임 도구로 확장할 수 있습니다. /codex:adversarial-review는 자유 텍스트 초점 인자를 받는 읽기 전용 검토입니다. 인증 흐름, 데이터 손실 경로, 경쟁 상태, 롤백 안전성 같은 특정 우려 지점을 Codex에 지정할 수 있으며, diff를 린트하기보다는 구현의 가정과 트레이드오프에 도전하도록 구성되어 있습니다 . 의도적인 반론이 필요할 때, 표준 리뷰가 깨끗하게 끝난 뒤 실행하면 좋습니다.

/codex:rescue는 디버깅이나 구현 작업을 codex-rescue 서브에이전트를 통해 Codex에 통째로 넘깁니다. 읽기 전용을 요청하지 않는 한 기본값은 쓰기 가능한 실행입니다 . 파일을 수정할 수 있으므로 범위 통제가 중요합니다. 초점이 좁은 프롬프트로 제한하세요. /codex:transfer는 현재 세션에서 비동기 인계를 위한 지속 Codex 스레드를 만듭니다. /codex:status로 상태를 추적하고(queued → running → success/failed/cancelled), /codex:result로 출력을 가져오며, /codex:cancel로 중단할 수 있습니다. 프로젝트별 기능과 비용의 균형을 고정하려면 config.toml에서 model_reasoning_effort와 함께 모델 별칭 spark를 설정하세요. 이 별칭은 gpt-5.3-codex-spark에 매핑됩니다 .

명령접근 권한주요 용도
/codex:review읽기 전용변경 사항이나 브랜치에 대한 표준 세컨드 모델 리뷰
/codex:adversarial-review읽기 전용가정, 인증, 경쟁 상태, 롤백에 대한 방향 지정형 비평
/codex:rescue쓰기디버깅/구현 작업을 Codex에 위임
/codex:transfer쓰기비동기 인계를 위한 지속 Codex 스레드 생성
/codex:status읽기 전용작업 생명주기 상태 확인
/codex:result읽기 전용작업 출력 가져오기
/codex:cancel읽기 전용실행 중이거나 대기 중인 작업 중단
/codex:setup읽기 전용설치/인증 확인 및 리뷰 게이트 전환

실무적으로는 검증에는 리뷰 명령을 사용하고, /codex:rescue는 파일을 수정하므로 범위가 좁은 프롬프트가 있을 때만 사용하며, 현재 세션보다 오래 지속되어야 하는 작업에는 /codex:transfer를 쓰면 됩니다. 이 명령들을 함께 사용하면 하나의 Claude Code 터미널을 명령 단위로 조정하는 두 공급자 워크플로로 바꿀 수 있습니다 .

자주 묻는 질문

플러그인이 자체 API 호출을 하나요, 아니면 기존 Codex 설정을 사용하나요?

기존 설정을 사용합니다. 이 플러그인은 독립적인 원격 API 호출을 하지 않습니다. 사용자의 컴퓨터에 이미 설치된 전역 codex 바이너리를 감싸서 실행하고, 로컬 인증, config.toml, MCP 서버, 샌드박스 설정, 저장소 체크아웃을 그대로 재사용합니다 . 플러그인 자체가 새 시크릿이나 API 키를 추가하지 않습니다. 로컬 Codex 런타임을 인증하는 수단이 그대로 플러그인의 작업 경로가 됩니다.

유료 OpenAI 플랜이 필요한가요?

아닙니다. Free 티어의 ChatGPT 계정이면 충분하며, OpenAI API 키도 대안으로 사용할 수 있습니다 . 반드시 필요한 조건은 codex login을 실행해 바이너리가 인증된 상태여야 한다는 점입니다. 이후 사용량은 사용자의 Codex 한도에서 차감됩니다. 또 다른 기본 요구 사항은 Node.js 18.18 이상입니다 .

/codex:review와 /codex:adversarial-review는 어떻게 다른가요?

/codex:review는 표준 읽기 전용 diff 검토입니다. README에 따르면 Codex 안에서 직접 /review를 실행할 때와 같은 품질의 리뷰를 제공하며, 현재 커밋되지 않은 변경 사항이나 --base <ref>로 지정한 브랜치를 대상으로 할 수 있습니다 . /codex:adversarial-review도 읽기 전용이지만 초점 텍스트를 받을 수 있고, 단순히 diff를 린트하는 데 그치지 않고 구현을 의도적으로 압박해 검토하도록 구성되어 있습니다. 가정, 트레이드오프, 인증 경로, 데이터 손실 위험, 경쟁 상태, 롤백 범위, 신뢰성 등을 따집니다 .

리뷰 게이트는 무엇을 하고, 켜야 하나요?

선택 사항인 리뷰 게이트는 /codex:setup --enable-review-gate로 활성화할 수 있으며, 900초 타임아웃이 있는 Stop 훅을 등록합니다. Codex가 문제를 찾으면 Claude가 턴을 끝내지 못하게 막고, 먼저 그 문제를 해결하도록 강제합니다 . README는 이것이 사용량 한도를 소모하는 장시간 Claude/Codex 루프를 만들 수 있다고 명확히 경고합니다 . 기본값으로 둘 기능이라기보다, 반드시 차단 게이트가 필요한 경우에만 선택적으로 켜는 기능으로 보세요.

Anthropic의 Code Review 기능과는 어떻게 다른가요?

두 기능은 문제의 서로 다른 부분을 해결합니다. 2026년 3월 9일 발표된 Anthropic의 관리형 Code Review는 Anthropic 인프라에서 풀 리퀘스트마다 여러 에이전트를 실행하고, 리뷰당 평균 약 20분과 약 15~25달러가 소요되며, Team 및 Enterprise 사용자를 대상으로 합니다 . Codex 플러그인은 로컬에서 즉시 실행되며 벤더를 넘나듭니다. 기존 Claude Code 세션 안에서 두 번째 제공자를 조율하고, 사용자의 OpenAI 계정으로 사용량이 측정됩니다 . 하나는 관리형 PR 서비스이고, 다른 하나는 터미널 안에서 세션 단위로 모델 다양성을 확보하는 방식입니다.

이 글이 도움이 되셨다면, 새 글이 올라올 때마다 이메일로 받아보세요.

구독하기