설치부터
6 단계
VibeProxy는 macOS 네이티브 메뉴바 앱이다. ZIP 파일 하나 받아서 Applications에 옮기고, 메뉴바 아이콘 클릭 몇 번으로 끝난다. 터미널 명령어는 인증 후 포트 확인용 한 줄이 전부.
요구사항: macOS 13 Ventura 이상 · 인터넷 연결 · 각 서비스 구독 (Claude Pro/Max, ChatGPT Plus/Pro, Z.AI 등)
- 01Step 01
다운로드
VibeProxy 공식 Releases 페이지에서 내 Mac에 맞는 파일을 받는다.
Apple Silicon (M1/M2/M3/M4)VibeProxy-arm64.zipIntel MacVibeProxy-x86_64.zipReleases 페이지 열기 ↗코드 서명·공증 완료 — Gatekeeper 경고 없음
- 02Step 02
설치
ZIP 압축을 풀고 .app 파일을 Applications 폴더로 드래그한다.
cd ~/Downloads unzip VibeProxy-arm64.zip mv VibeProxy.app /Applications/Finder에서 드래그-앤-드롭도 동일하게 동작
- 03Step 03
실행
Launchpad 또는 Applications에서 VibeProxy를 실행한다. 메뉴바 우측 상단에 작은 아이콘이 뜬다.
초록 점 = 서버 실행 중 · 빨간 점 = 중지됨
- 04Step 04
서비스 연결
메뉴바 아이콘 클릭 → Open Settings → 사용할 서비스 옆 Connect 버튼을 누른다.
⚡Claude CodeOAuth⚡Codex (ChatGPT)OAuth⚡AntigravityGoogle OAuth⚡GeminiGoogle OAuth⚡GitHub CopilotGitHub OAuth🔑Z.AI GLMAPI Key필요한 서비스만 연결하면 된다. 전부 다 연결할 필요는 없음.
- 05Step 05
인증 완료
브라우저가 자동으로 열리면 평소처럼 로그인. 완료되면 VibeProxy가 자동으로 감지해 상태를 'Connected'로 바꾼다.
Z.AI GLM만 API key를 직접 붙여넣는 방식
- 06Step 06
서버 포트 확인
메뉴바 서비스가 초록불이면 localhost의 8317·8318 포트가 자동으로 LISTEN된다. 이제 Claude Code가 이 포트로 붙을 수 있다.
lsof -iTCP:8318 -sTCP:LISTEN # cli-proxy 70103 localhost:8318 (LISTEN)이 단계까지 초록불이면 VibeProxy 설치는 끝. 이제 아래 해결법 섹션으로.
공식 릴리즈는 코드 서명 + 공증 완료. 경고 뜨면 우클릭 → 열기.
안 된다. VibeProxy는 기존 Claude Pro / ChatGPT Plus / Z.AI 구독을 재활용하는 브릿지. 구독이 없으면 모델을 못 부른다.
가능성 있음. Anthropic·OpenAI 약관 위반 소지. 최근엔 Vercel AI Gateway 경유 옵션도 지원 — 공식 sanctioned 경로.
먼저,
안 된 것들
VibeProxy를 깔아놓고도 Claude Code에 GPT-5.4를 네이티브로 붙이는 방법이 명확하지 않다. 공식 문서는 Factory CLI 기준이고, Claude Code는 자체 스키마가 따로 있다. 세 가지 가설이 모두 빗나갔다.
ccr code 로 Claude Code Router 붙이기
ANTHROPIC_BASE_URL=localhost:8317 지정
환경변수
세 줄
Claude Code는 ANTHROPIC_MODEL 값을 UI 헤더에 그대로 표시한다. 임의 문자열을 허용한다는 뜻. VibeProxy의 /v1/messages 엔드포인트는 모델명 prefix를 보고 자동 라우팅한다. 이 두 특성을 조합하면 라우터 없이도 네이티브 멀티모델이 완성된다.
# ========== VibeProxy 설정 (multi-model via localhost:8318) ==========
# 사용법: vgpt → gpt-5.4 (기본)
# vgpt gpt-5.3-codex → 원하는 모델 지정
# vglm → glm-4.7
# vclaude → claude-opus-4-6 via vibeproxy (구독 경유)
vgpt() {
ANTHROPIC_BASE_URL=http://localhost:8318 \
ANTHROPIC_AUTH_TOKEN=dummy-not-used \
ANTHROPIC_MODEL="${1:-gpt-5.4}" \
claude "${@:2}"
}
vglm() {
ANTHROPIC_BASE_URL=http://localhost:8318 \
ANTHROPIC_AUTH_TOKEN=dummy-not-used \
ANTHROPIC_MODEL="${1:-glm-4.7}" \
claude "${@:2}"
}
vclaude() {
ANTHROPIC_BASE_URL=http://localhost:8318 \
ANTHROPIC_AUTH_TOKEN=dummy-not-used \
ANTHROPIC_MODEL="${1:-claude-opus-4-6}" \
claude "${@:2}"
}# 기본 Claude (그대로)
claude
# GPT-5.4 고효율 모드
vgpt "gpt-5.4(high)"
# Codex 계열
vgpt gpt-5.3-codex
vgpt gpt-5.2-codex
# GLM
vglm
vglm glm-4-flash- UI 헤더에
gpt-5.4그대로 표시 - 모든 MCP / skills / hooks 공유
- API 비용 0원, 구독만 사용
- 터미널별 모델 격리
포트 8318이
정답이다
VibeProxy는 두 포트를 동시에 LISTEN한다. 8317은 raw upstream, 8318은 thinking proxy 레이어.
8317에 붙으면 (high) 같은 reasoning effort 서픽스가 해석되지 않는다. 8318이 suffix를 파싱해 provider별 형식(OpenAI의 reasoning_effort, Anthropic의 thinking.budget_tokens)으로 변환한다.
두 포트 모두 /v1/models 카탈로그는 동일. 라우팅 동작만 다르다.
두 개의 Pane.
두 개의 뇌.
같은 프로젝트 안에서 Opus 4.6(깊은 사고·리뷰)과 GPT-5.4(빠른 구현·탐색)을 좌우 pane으로 띄운다. 두 모델이 파일 시스템을 메시지 버스처럼 공유하며 협업한다.
GUI 기반 — 가장 쉬움
# 프로젝트에서 cmux 실행
cd ~/Project && cmux
# cmux 내부
claude # 좌측
# Cmd+D 로 pane 분할
vgpt # 우측CLI 네이티브 — 스크립트 가능
# 프로젝트에서 tmux
cd ~/Project
tmux new -s pair
# 좌측: Opus
claude
# prefix % 로 수직 분할
# 우측: GPT-5.4
vgpt· 재사용 스크립트~/bin/pair-code.sh
+
~/bin/pair-code.sh
#!/bin/bash
# Claude Code 페어 프로그래밍 세션 — Opus ↔ GPT-5.4
PROJECT_DIR="${1:-$PWD}"
SESSION="pair-$(basename "$PROJECT_DIR")"
if tmux has-session -t "$SESSION" 2>/dev/null; then
tmux attach -t "$SESSION"; exit 0
fi
tmux new-session -d -s "$SESSION" -c "$PROJECT_DIR"
tmux send-keys -t "$SESSION" 'claude' Enter
tmux split-window -h -t "$SESSION" -c "$PROJECT_DIR"
tmux send-keys -t "$SESSION" 'vgpt "gpt-5.4(high)"' Enter
tmux select-pane -L -t "$SESSION"
tmux attach -t "$SESSION"크로스
페어링
두 pane이 같은 워킹 디렉토리를 공유하므로, 한 쪽이 파일을 수정하면 다른 쪽이 즉시 본다. 두 모델이 Read/Edit 도구를 통해 파일 시스템을 비동기 메시지 버스처럼 사용한다.
GPT 초안 → Opus 리뷰
GPT-5.4
"사용자 인증 미들웨어 구현해" → src/middleware/auth.ts 생성
Opus 4.6
"auth.ts 리뷰해. 보안 취약점 위주" → JWT 검증 누락, 타이밍 공격 지적
GPT-5.4
"리뷰 반영해서 수정" → timingSafeEqual 적용, 재커밋
Opus 설계 → GPT 병렬 구현
Opus 4.6
"인증 시스템 설계해. 파일 경로, 인터페이스, 테스트까지" → ARCHITECTURE.md
GPT-5.4
"ARCHITECTURE.md 읽고 단계별로 구현" → 파일 순차 생성
Opus 4.6
"git diff HEAD 보고 설계 대비 누락 체크" → 빠진 부분 지적
파일 시스템 = 메시지 버스
Opus 4.6
.claude/notes/opus-to-gpt.md 에 상세 명세 기록
GPT-5.4
명세 읽고 실행, 결과를 gpt-to-opus.md 에 기록
Opus 4.6
결과 검토 후 피드백 → 무한 루프로 협업
모든
모델.
현재 VibeProxy 세션에서 /v1/models 엔드포인트로 확인된 실제 사용 가능 목록. 구독 플랜에 따라 일부 모델은 차단될 수 있음.
gpt-5.4최신 · 고효율gpt-5.4-mini빠른 기본gpt-5.3-codex코딩 특화gpt-5.3-codex-sparkPlus/Pro 전용gpt-5.2안정gpt-5.2-codex코딩gpt-5.1-codex-max장기 작업gpt-5.1-codexgpt-5.1gpt-5-codex
claude-opus-4-6최상급claude-sonnet-4-6균형claude-haiku-4-5-20251001가장 빠름claude-opus-4-5-20251101이전 세대claude-sonnet-4-5-20250929
glm-4.7최신 · 기본glm-4-plus강화glm-4-air균형glm-4-flash최고속glm-5Pro 전용 · ❌
gemini-3-pro-high최고 품질gemini-3-pro-lowgemini-3-flash빠름gemini-3.1-pro-highgemini-3.1-flash-image비전gpt-oss-120b-medium오픈소스
GPT 계열은 괄호 서픽스로 reasoning effort 조절:
이 방식은 제공자의 약관을 위반할 수 있다.
VibeProxy는 개인 구독(Claude Pro/Max, ChatGPT Plus/Pro, Z.AI)의 OAuth 토큰을 재활용해서 CLI 도구로 라우팅하는 방식이다. Anthropic, OpenAI 등이 탐지하면 계정 정지·영구 차단 등의 조치가 있을 수 있다.
이 사이트는 VibeProxy 사용을 권장하지 않으며, 교육/연구 목적의 기술 소개만을 담는다. 실제 사용 여부와 그로 인한 모든 위험은 사용자 본인이 감수한다.