OpenAI Codex 플러그인, 코드 리뷰를 두 번째 LLM에 맡기다

OpenAI Codex 플러그인은 Claude Code 안에서 로컬 Codex에 코드 리뷰, 적대적 비평, 작업을 위임합니다.

OpenAI Codex 플러그인, 코드 리뷰를 두 번째 LLM에 맡기다
Share

작성한 코드의 최종 승인을 같은 모델에게 맡기는 것은 지름길이 아니라 구조적 약점이다. OpenAI의 새 Claude Code 플러그인은 리뷰를 내 컴퓨터에서 실행되는 경쟁 모델에 넘겨 이 문제를 보완한다.

Codex 플러그인이 단일 LLM 리뷰로는 놓치는 부분

한 모델이 코드를 작성한 뒤 그 코드를 다시 리뷰하면, 리뷰어와 작성자는 학습 단계에서 생긴 같은 사각지대를 공유한다. 같은 가중치에 기대는 이 안티패턴 때문에 셀프 리뷰는 구조적으로 약해진다. 두 번의 검토가 동일한 전제를 품고 있고, 리뷰어가 작성자의 오류를 그대로 이어가기 쉽기 때문이다 . openai/codex-plugin-cc 플러그인은 2026년 7월 8일 공개된 1.0.6 버전으로, Apache-2.0 라이선스이며 별은 약 29.7k개다 . 이 플러그인은 리뷰 작업을 로컬에서 실행되는 Codex 프로세스로 보내 루프 안에 다른 벤더, 다른 학습 코퍼스, 다른 실패 양식을 추가한다. 그래서 두 에이전트가 서로 놓칠 법한 실수를 잡아낼 수 있다.

"When reviewer and author share weights, both passes share identical blind spots and the reviewer perpetuates the author's errors." — codex-plugin-cc에 대한 독립 분석에서 (source: Daniel Vaughan).

기본으로 제공되는 읽기 전용 모드는 두 가지다. /codex:review는 표준 diff 검토를 실행하며(--base <ref>, 포그라운드 또는 백그라운드 지원), /codex:adversarial-review는 전제, 인증 경로, 데이터 손실 위험, 경쟁 상태, 롤백 커버리지를 겨냥해 더 강하게 검토한다 . 이 방식은 로컬에서 즉시 실행된다. 2026년 3월 9일 발표된 Anthropic의 관리형 Code Review와는 다르다. 해당 서비스는 PR마다 여러 에이전트를 실행하고 건당 대략 15~25달러와 약 20분이 들며, 내부적으로 의미 있는 리뷰 코멘트 비율을 16%에서 54%로 끌어올렸고 잘못된 것으로 표시된 발견은 1% 미만이었다 . 크로스 벤더 방식의 장점은 벤치마크로 입증된 우월함이 아니라 실제 상호 보완성이다. 특히 여러 파일에 걸친 diff, 위험한 아키텍처 변경, 보안 민감 경로에서 가장 설득력이 크다.

플러그인을 켜기 전에 준비할 것

What the Codex plugin does that a single LLM review misses (source: codex.danielvaughan.com)

슬래시 명령을 하나라도 실행하기 전에, 먼저 컴퓨터에 네 가지가 준비되어 있어야 한다. 이 플러그인은 새 프로젝트 시크릿을 추가하지 않고 독립적인 원격 API 호출도 하지 않는다. 로컬 Codex 설치를 감싸고, 이미 있는 인증과 설정을 그대로 재사용한다 .

  • PATH에 있는 Node.js 18.18 이상. 플러그인에는 codex-companion.mjs라는 Node 동반 프로세스가 포함되어 있으며, 인자를 파싱하고 git 상태를 찾고 작업 기록을 jobs/<job-id>.json 아래에 저장한다 .
  • 인증: ChatGPT 구독(무료 티어도 충분) 또는 OpenAI API 키. 해당 컴퓨터에서 Codex 인증을 한 적이 없다면, 플러그인을 호출하기 전에 codex login을 실행한다 .
  • 전역 codex 바이너리. 플러그인은 OpenAI를 직접 호출하지 않고 기존 설치를 감싼다. 없다면 /codex:setup으로 설치할 수 있고, 또는 npm install -g @openai/codex(또는 curl -fsSL https://chatgpt.com/codex/install.sh | sh 설치 스크립트)를 실행하면 된다 .

그 밖의 항목, 즉 config.toml, MCP 서버, 샌드박스 설정, repo checkout은 있는 그대로 재사용된다. 따라서 프로젝트 자체에 추가로 연결할 것은 없다.

Claude Code에서 Codex 플러그인 켜기

Screenshot of https://code.claude.com/docs/en/hooks

codex 바이너리가 준비되어 있다면, 세션에 플러그인을 연결하는 데 필요한 명령은 네 개다. 활성 Claude Code 세션 안에서 다음 순서대로 실행한다.

  1. 마켓플레이스 소스를 추가한다: /plugin marketplace add openai/codex-plugin-cc .
  2. 세션에 플러그인을 설치한다: /plugin install codex@openai-codex .
  3. 레지스트리를 다시 불러온다: /reload-plugins. Claude Code가 새 /codex: 슬래시 명령을 인식해야 호출할 수 있다.
  4. 설치와 인증을 확인한다: /codex:setup. 전역 codex 바이너리가 있고 인증되어 있는지 확인하며, 선택적으로 리뷰 게이트도 켤 수 있다(다음에서 다룸) .

첫 검토는 /codex:review로 실행한다. 기본적으로 작업 트리를 기준으로 staged 및 unstaged 변경을 리뷰하며, 추적되지 않는 콘텐츠는 24 KiB로 제한된다 . 특정 브랜치나 커밋과 diff를 보고 싶다면 /codex:review --base <ref>를 사용한다. 작업 트리가 깨끗하면 기본 브랜치를 기준으로 자동 감지가 실행된다 .

추론 깊이는 플러그인이 아니라 Codex 자체 설정에서 조정한다. ~/.codex/config.toml(사용자 전체) 또는 .codex/config.toml(프로젝트)에 model_reasoning_effort를 설정한다. 허용되는 값은 none, minimal, low, medium, high, xhigh다 . 프로젝트 수준 설정은 해당 파일을 명시적으로 신뢰한 경우에만 로드되므로, 신뢰하지 않은 repo의 .codex/config.toml은 작동하지 않는다.

현실적으로 알아둘 점: 두 공급자 비용, 중단 게이트, 대규모 diff 처리 속도

Activating the Codex plugin in Claude Code

이 플러그인을 실행하면 과금 미터가 두 개 동시에 돌아갑니다. Claude Code 세션에는 Anthropic 과금이, 모든 Codex 작업에는 OpenAI 과금이 적용됩니다. 플러그인 자체는 원격 호출을 하지 않습니다. 로컬 codex 바이너리를 감싸서 실행하므로 사용량은 Codex 한도에 집계됩니다 . 어느 한 공급자가 다른 쪽 비용을 상쇄해 주지 않으며, 둘 다 별도로 비용을 지불합니다.

선택 기능인 리뷰 게이트는 신중하게 다뤄야 합니다. /codex:setup --enable-review-gate로 활성화하면 900초 제한 시간이 있는 Stop 훅이 등록되고, Claude의 응답에 대해 Codex 검토가 실행됩니다. Codex가 문제를 찾으면 해당 문제가 해결될 때까지 Claude가 종료되지 못하게 막습니다 .

README는 이 기능이 "can create long-running Claude/Codex loops that drain usage limits"라고 경고합니다. 작업이 많은 저장소에서 게이트를 켜기 전에 읽어둘 만한 설계상 주의사항입니다 (source: codex-plugin-cc README).

처리 속도도 중요합니다. companion은 한 번에 하나의 스트리밍 요청만 처리합니다 . 따라서 여러 파일에 걸친 큰 diff는 백그라운드에서 실행하고 /codex:status로 상태를 확인한 뒤, /codex:result로 결과를 가져오는 편이 좋습니다. Node codex-companion.mjs와 Codex app server는 로컬 프로세스 오버헤드를 추가하므로, 메모리가 적은 노트북에서는 샌드박스와 메모리를 두고 경쟁할 수 있습니다. 내부적으로 app-server 프로토콜은 stdio JSONL 위에서 동작하는 JSON-RPC 2.0이며, thread/startturn/start 프리미티브를 사용합니다 . 리뷰가 멈췄을 때 jobs/<job-id>.json을 살펴보는 데 도움이 되는 배경 정보입니다.

더 활용하기: /codex:adversarial-review, /codex:rescue, /codex:transfer

표준 리뷰 흐름에 익숙해지면 세 가지 명령으로 플러그인을 단순한 수동 비평 도구에서 방향을 지정할 수 있고 쓰기까지 가능한 위임 도구로 확장할 수 있습니다. /codex:adversarial-review는 자유 텍스트 초점 인자를 받는 읽기 전용 검토입니다. 인증 흐름, 데이터 손실 경로, 경쟁 상태, 롤백 안전성 같은 특정 우려 지점을 Codex에 지정할 수 있으며, diff를 린트하기보다는 구현의 가정과 트레이드오프에 도전하도록 구성되어 있습니다 . 의도적인 반론이 필요할 때, 표준 리뷰가 깨끗하게 끝난 뒤 실행하면 좋습니다.

/codex:rescue는 디버깅이나 구현 작업을 codex-rescue 서브에이전트를 통해 Codex에 통째로 넘깁니다. 읽기 전용을 요청하지 않는 한 기본값은 쓰기 가능한 실행입니다 . 파일을 수정할 수 있으므로 범위 통제가 중요합니다. 초점이 좁은 프롬프트로 제한하세요. /codex:transfer는 현재 세션에서 비동기 인계를 위한 지속 Codex 스레드를 만듭니다. /codex:status로 상태를 추적하고(queued → running → success/failed/cancelled), /codex:result로 출력을 가져오며, /codex:cancel로 중단할 수 있습니다. 프로젝트별 기능과 비용의 균형을 고정하려면 config.toml에서 model_reasoning_effort와 함께 모델 별칭 spark를 설정하세요. 이 별칭은 gpt-5.3-codex-spark에 매핑됩니다 .

명령접근 권한주요 용도
/codex:review읽기 전용변경 사항이나 브랜치에 대한 표준 세컨드 모델 리뷰
/codex:adversarial-review읽기 전용가정, 인증, 경쟁 상태, 롤백에 대한 방향 지정형 비평
/codex:rescue쓰기디버깅/구현 작업을 Codex에 위임
/codex:transfer쓰기비동기 인계를 위한 지속 Codex 스레드 생성
/codex:status읽기 전용작업 생명주기 상태 확인
/codex:result읽기 전용작업 출력 가져오기
/codex:cancel읽기 전용실행 중이거나 대기 중인 작업 중단
/codex:setup읽기 전용설치/인증 확인 및 리뷰 게이트 전환

실무적으로는 검증에는 리뷰 명령을 사용하고, /codex:rescue는 파일을 수정하므로 범위가 좁은 프롬프트가 있을 때만 사용하며, 현재 세션보다 오래 지속되어야 하는 작업에는 /codex:transfer를 쓰면 됩니다. 이 명령들을 함께 사용하면 하나의 Claude Code 터미널을 명령 단위로 조정하는 두 공급자 워크플로로 바꿀 수 있습니다 .

자주 묻는 질문

플러그인이 자체 API 호출을 하나요, 아니면 기존 Codex 설정을 사용하나요?

기존 설정을 사용합니다. 이 플러그인은 독립적인 원격 API 호출을 하지 않습니다. 사용자의 컴퓨터에 이미 설치된 전역 codex 바이너리를 감싸서 실행하고, 로컬 인증, config.toml, MCP 서버, 샌드박스 설정, 저장소 체크아웃을 그대로 재사용합니다 . 플러그인 자체가 새 시크릿이나 API 키를 추가하지 않습니다. 로컬 Codex 런타임을 인증하는 수단이 그대로 플러그인의 작업 경로가 됩니다.

유료 OpenAI 플랜이 필요한가요?

아닙니다. Free 티어의 ChatGPT 계정이면 충분하며, OpenAI API 키도 대안으로 사용할 수 있습니다 . 반드시 필요한 조건은 codex login을 실행해 바이너리가 인증된 상태여야 한다는 점입니다. 이후 사용량은 사용자의 Codex 한도에서 차감됩니다. 또 다른 기본 요구 사항은 Node.js 18.18 이상입니다 .

/codex:review와 /codex:adversarial-review는 어떻게 다른가요?

/codex:review는 표준 읽기 전용 diff 검토입니다. README에 따르면 Codex 안에서 직접 /review를 실행할 때와 같은 품질의 리뷰를 제공하며, 현재 커밋되지 않은 변경 사항이나 --base <ref>로 지정한 브랜치를 대상으로 할 수 있습니다 . /codex:adversarial-review도 읽기 전용이지만 초점 텍스트를 받을 수 있고, 단순히 diff를 린트하는 데 그치지 않고 구현을 의도적으로 압박해 검토하도록 구성되어 있습니다. 가정, 트레이드오프, 인증 경로, 데이터 손실 위험, 경쟁 상태, 롤백 범위, 신뢰성 등을 따집니다 .

리뷰 게이트는 무엇을 하고, 켜야 하나요?

선택 사항인 리뷰 게이트는 /codex:setup --enable-review-gate로 활성화할 수 있으며, 900초 타임아웃이 있는 Stop 훅을 등록합니다. Codex가 문제를 찾으면 Claude가 턴을 끝내지 못하게 막고, 먼저 그 문제를 해결하도록 강제합니다 . README는 이것이 사용량 한도를 소모하는 장시간 Claude/Codex 루프를 만들 수 있다고 명확히 경고합니다 . 기본값으로 둘 기능이라기보다, 반드시 차단 게이트가 필요한 경우에만 선택적으로 켜는 기능으로 보세요.

Anthropic의 Code Review 기능과는 어떻게 다른가요?

두 기능은 문제의 서로 다른 부분을 해결합니다. 2026년 3월 9일 발표된 Anthropic의 관리형 Code Review는 Anthropic 인프라에서 풀 리퀘스트마다 여러 에이전트를 실행하고, 리뷰당 평균 약 20분과 약 15~25달러가 소요되며, Team 및 Enterprise 사용자를 대상으로 합니다 . Codex 플러그인은 로컬에서 즉시 실행되며 벤더를 넘나듭니다. 기존 Claude Code 세션 안에서 두 번째 제공자를 조율하고, 사용자의 OpenAI 계정으로 사용량이 측정됩니다 . 하나는 관리형 PR 서비스이고, 다른 하나는 터미널 안에서 세션 단위로 모델 다양성을 확보하는 방식입니다.

이 글이 도움이 되셨다면, 새 글이 올라올 때마다 이메일로 받아보세요.

구독하기

AI developer tools and ecosystem news for developers and technical founders

Sign up for insights and ideas

Subscribe for the latest news, stories, tips, and updates.

Subscribe