A VOIDLIGHT field guide · 2026.04.11

One IDE.
Every model.

Opus 4.6와 GPT-5.4가 Claude Code 한 화면에서 동시에 돌아간다. 라우터도, 프록시 설정도 없이. 환경변수 세 줄.

The Problem

Claude Code의 네이티브 UI를 유지하면서
GPT와 GLM 최신 모델을 같이 쓰는 법.

· Getting Started

설치부터
6 단계

VibeProxy는 macOS 네이티브 메뉴바 앱이다. ZIP 파일 하나 받아서 Applications에 옮기고, 메뉴바 아이콘 클릭 몇 번으로 끝난다. 터미널 명령어는 인증 후 포트 확인용 한 줄이 전부.

요구사항: macOS 13 Ventura 이상 · 인터넷 연결 · 각 서비스 구독 (Claude Pro/Max, ChatGPT Plus/Pro, Z.AI 등)

  1. 01
    Step 01

    다운로드

    VibeProxy 공식 Releases 페이지에서 내 Mac에 맞는 파일을 받는다.

    Apple Silicon (M1/M2/M3/M4)
    VibeProxy-arm64.zip
    Intel Mac
    VibeProxy-x86_64.zip

    코드 서명·공증 완료 — Gatekeeper 경고 없음

    Releases 페이지 열기 ↗
  2. 02
    Step 02

    설치

    ZIP 압축을 풀고 .app 파일을 Applications 폴더로 드래그한다.

    cd ~/Downloads
    unzip VibeProxy-arm64.zip
    mv VibeProxy.app /Applications/

    Finder에서 드래그-앤-드롭도 동일하게 동작

  3. 03
    Step 03

    실행

    Launchpad 또는 Applications에서 VibeProxy를 실행한다. 메뉴바 우측 상단에 작은 아이콘이 뜬다.

    초록 점 = 서버 실행 중 · 빨간 점 = 중지됨

  4. 04
    Step 04

    서비스 연결

    메뉴바 아이콘 클릭 → Open Settings → 사용할 서비스 옆 Connect 버튼을 누른다.

    Claude Code
    OAuth
    Codex (ChatGPT)
    OAuth
    Antigravity
    Google OAuth
    Gemini
    Google OAuth
    GitHub Copilot
    GitHub OAuth
    🔑
    Z.AI GLM
    API Key

    필요한 서비스만 연결하면 된다. 전부 다 연결할 필요는 없음.

  5. 05
    Step 05

    인증 완료

    브라우저가 자동으로 열리면 평소처럼 로그인. 완료되면 VibeProxy가 자동으로 감지해 상태를 'Connected'로 바꾼다.

    Z.AI GLM만 API key를 직접 붙여넣는 방식

  6. 06
    Step 06

    서버 포트 확인

    메뉴바 서비스가 초록불이면 localhost의 8317·8318 포트가 자동으로 LISTEN된다. 이제 Claude Code가 이 포트로 붙을 수 있다.

    lsof -iTCP:8318 -sTCP:LISTEN
    # cli-proxy  70103  localhost:8318 (LISTEN)

    이 단계까지 초록불이면 VibeProxy 설치는 끝. 이제 아래 해결법 섹션으로.

Q. Gatekeeper 경고가 뜬다?

공식 릴리즈는 코드 서명 + 공증 완료. 경고 뜨면 우클릭 → 열기.

Q. 구독 없이도 돼?

안 된다. VibeProxy는 기존 Claude Pro / ChatGPT Plus / Z.AI 구독을 재활용하는 브릿지. 구독이 없으면 모델을 못 부른다.

Q. 계정 정지 위험?

가능성 있음. Anthropic·OpenAI 약관 위반 소지. 최근엔 Vercel AI Gateway 경유 옵션도 지원 — 공식 sanctioned 경로.

· 삽질 기록

먼저,
안 된 것들

VibeProxy를 깔아놓고도 Claude Code에 GPT-5.4를 네이티브로 붙이는 방법이 명확하지 않다. 공식 문서는 Factory CLI 기준이고, Claude Code는 자체 스키마가 따로 있다. 세 가지 가설이 모두 빗나갔다.

01

Factory CLI 포맷을 Claude Code에 복붙

settings.json 스키마가 custom_models 필드를 모른다
❌ Unrecognized field
02

ccr code 로 Claude Code Router 붙이기

헤더는 Opus 4.6인데 실제는 GPT-5.4 — 어느 모델인지 UI에 안 보임
⚠️ 혼란스러운 UX
03

ANTHROPIC_BASE_URL=localhost:8317 지정

reasoning effort 서픽스 (high) 가 해석 안 됨
❌ 포트가 틀렸다
· 해결법

환경변수
세 줄

Claude Code는 ANTHROPIC_MODEL 값을 UI 헤더에 그대로 표시한다. 임의 문자열을 허용한다는 뜻. VibeProxy의 /v1/messages 엔드포인트는 모델명 prefix를 보고 자동 라우팅한다. 이 두 특성을 조합하면 라우터 없이도 네이티브 멀티모델이 완성된다.

~/.zshrc
vgpt · vglm · vclaude
# ========== VibeProxy 설정 (multi-model via localhost:8318) ==========
# 사용법: vgpt → gpt-5.4 (기본)
#        vgpt gpt-5.3-codex → 원하는 모델 지정
#        vglm → glm-4.7
#        vclaude → claude-opus-4-6 via vibeproxy (구독 경유)

vgpt() {
  ANTHROPIC_BASE_URL=http://localhost:8318 \
  ANTHROPIC_AUTH_TOKEN=dummy-not-used \
  ANTHROPIC_MODEL="${1:-gpt-5.4}" \
  claude "${@:2}"
}

vglm() {
  ANTHROPIC_BASE_URL=http://localhost:8318 \
  ANTHROPIC_AUTH_TOKEN=dummy-not-used \
  ANTHROPIC_MODEL="${1:-glm-4.7}" \
  claude "${@:2}"
}

vclaude() {
  ANTHROPIC_BASE_URL=http://localhost:8318 \
  ANTHROPIC_AUTH_TOKEN=dummy-not-used \
  ANTHROPIC_MODEL="${1:-claude-opus-4-6}" \
  claude "${@:2}"
}
사용
# 기본 Claude (그대로)
claude

# GPT-5.4 고효율 모드
vgpt "gpt-5.4(high)"

# Codex 계열
vgpt gpt-5.3-codex
vgpt gpt-5.2-codex

# GLM
vglm
vglm glm-4-flash
결과
  • UI 헤더에 gpt-5.4 그대로 표시
  • 모든 MCP / skills / hooks 공유
  • API 비용 0원, 구독만 사용
  • 터미널별 모델 격리
· 결정적 단서

포트 8318
정답이다

VibeProxy는 두 포트를 동시에 LISTEN한다. 8317은 raw upstream, 8318은 thinking proxy 레이어.

8317에 붙으면 (high) 같은 reasoning effort 서픽스가 해석되지 않는다. 8318이 suffix를 파싱해 provider별 형식(OpenAI의 reasoning_effort, Anthropic의 thinking.budget_tokens)으로 변환한다.

$ lsof -iTCP:8317,8318 -sTCP:LISTEN
CLIProxyM54503*:8317 (LISTEN)
← raw upstream, OpenAI-compat endpoint
cli-proxy70103localhost:8318 (LISTEN)
← thinking proxy — Claude Code가 붙어야 하는 포트

두 포트 모두 /v1/models 카탈로그는 동일. 라우팅 동작만 다르다.

· cmux / tmux

두 개의 Pane.
두 개의 뇌.

같은 프로젝트 안에서 Opus 4.6(깊은 사고·리뷰)과 GPT-5.4(빠른 구현·탐색)을 좌우 pane으로 띄운다. 두 모델이 파일 시스템을 메시지 버스처럼 공유하며 협업한다.

pane L
Opus 4.6
~/Project $ claude
claude-opus-4-6 · Claude Max
❯ 리뷰: src/auth.ts
JWT 검증 누락, 타이밍 공격 가능성…
pane R
GPT-5.4 high
~/Project $ vgpt "gpt-5.4(high)"
gpt-5.4 with high effort · Claude Max
❯ 구현: src/auth.ts 수정
timingSafeEqual 적용, issue 반영 완료…
좌: 리뷰·설계우: 구현·실행
방법 A · cmux (macOS)

GUI 기반 — 가장 쉬움

# 프로젝트에서 cmux 실행
cd ~/Project && cmux

# cmux 내부
claude                  # 좌측
# Cmd+D 로 pane 분할
vgpt                    # 우측
방법 B · tmux

CLI 네이티브 — 스크립트 가능

# 프로젝트에서 tmux
cd ~/Project
tmux new -s pair

# 좌측: Opus
claude

# prefix % 로 수직 분할
# 우측: GPT-5.4
vgpt
· 재사용 스크립트

~/bin/pair-code.sh

+
#!/bin/bash
# Claude Code 페어 프로그래밍 세션 — Opus ↔ GPT-5.4

PROJECT_DIR="${1:-$PWD}"
SESSION="pair-$(basename "$PROJECT_DIR")"

if tmux has-session -t "$SESSION" 2>/dev/null; then
  tmux attach -t "$SESSION"; exit 0
fi

tmux new-session -d -s "$SESSION" -c "$PROJECT_DIR"
tmux send-keys -t "$SESSION" 'claude' Enter
tmux split-window -h -t "$SESSION" -c "$PROJECT_DIR"
tmux send-keys -t "$SESSION" 'vgpt "gpt-5.4(high)"' Enter
tmux select-pane -L -t "$SESSION"
tmux attach -t "$SESSION"
· 실전 패턴

크로스
페어링

두 pane이 같은 워킹 디렉토리를 공유하므로, 한 쪽이 파일을 수정하면 다른 쪽이 즉시 본다. 두 모델이 Read/Edit 도구를 통해 파일 시스템을 비동기 메시지 버스처럼 사용한다.

Pattern 01

GPT 초안 → Opus 리뷰

pane R
GPT-5.4

"사용자 인증 미들웨어 구현해" → src/middleware/auth.ts 생성

pane L
Opus 4.6

"auth.ts 리뷰해. 보안 취약점 위주" → JWT 검증 누락, 타이밍 공격 지적

pane R
GPT-5.4

"리뷰 반영해서 수정" → timingSafeEqual 적용, 재커밋

Pattern 02

Opus 설계 → GPT 병렬 구현

pane L
Opus 4.6

"인증 시스템 설계해. 파일 경로, 인터페이스, 테스트까지" → ARCHITECTURE.md

pane R
GPT-5.4

"ARCHITECTURE.md 읽고 단계별로 구현" → 파일 순차 생성

pane L
Opus 4.6

"git diff HEAD 보고 설계 대비 누락 체크" → 빠진 부분 지적

Pattern 03

파일 시스템 = 메시지 버스

pane L
Opus 4.6

.claude/notes/opus-to-gpt.md 에 상세 명세 기록

pane R
GPT-5.4

명세 읽고 실행, 결과를 gpt-to-opus.md 에 기록

pane L
Opus 4.6

결과 검토 후 피드백 → 무한 루프로 협업

· 카탈로그

모든
모델.

현재 VibeProxy 세션에서 /v1/models 엔드포인트로 확인된 실제 사용 가능 목록. 구독 플랜에 따라 일부 모델은 차단될 수 있음.

OpenAI · via Codex OAuth
  • gpt-5.4최신 · 고효율
  • gpt-5.4-mini빠른 기본
  • gpt-5.3-codex코딩 특화
  • gpt-5.3-codex-sparkPlus/Pro 전용
  • gpt-5.2안정
  • gpt-5.2-codex코딩
  • gpt-5.1-codex-max장기 작업
  • gpt-5.1-codex
  • gpt-5.1
  • gpt-5-codex
Anthropic · via Claude Code OAuth
  • claude-opus-4-6최상급
  • claude-sonnet-4-6균형
  • claude-haiku-4-5-20251001가장 빠름
  • claude-opus-4-5-20251101이전 세대
  • claude-sonnet-4-5-20250929
Z.AI · GLM
  • glm-4.7최신 · 기본
  • glm-4-plus강화
  • glm-4-air균형
  • glm-4-flash최고속
  • glm-5Pro 전용 · ❌
Antigravity
  • gemini-3-pro-high최고 품질
  • gemini-3-pro-low
  • gemini-3-flash빠름
  • gemini-3.1-pro-high
  • gemini-3.1-flash-image비전
  • gpt-oss-120b-medium오픈소스
· 효과 접미사 (GPT-5.x)

GPT 계열은 괄호 서픽스로 reasoning effort 조절:

vgpt "gpt-5.4(low)"
vgpt "gpt-5.4(medium)"
vgpt "gpt-5.4(high)" # 추천 기본값
vgpt "gpt-5.4(xhigh)" # 극한 사고
· ToS 경고

이 방식은 제공자의 약관을 위반할 수 있다.

VibeProxy는 개인 구독(Claude Pro/Max, ChatGPT Plus/Pro, Z.AI)의 OAuth 토큰을 재활용해서 CLI 도구로 라우팅하는 방식이다. Anthropic, OpenAI 등이 탐지하면 계정 정지·영구 차단 등의 조치가 있을 수 있다.

이 사이트는 VibeProxy 사용을 권장하지 않으며, 교육/연구 목적의 기술 소개만을 담는다. 실제 사용 여부와 그로 인한 모든 위험은 사용자 본인이 감수한다.