2026 Claude Opus 5 반값 Fable 5·Kimi K3 증류 논쟁 자칭 Claude: 지식 시각 의사결정 가이드
2026년 7월 24일 Anthropic이 Claude Opus 5를 출시하고 Claude Max 기본 모델로 지정했습니다. 가격은 $5/$25 per 100만 tokens 그대로인데 CursorBench에서는 Fable 5 피크와 0.5% 차이——실질적으로 반값에 플래그십에 근접한 포지션입니다. 같은 주에 Moonshot Kimi K3(총 2.8T 파라미터, 7월 16일 API)는 백악관의 증류 의혹과 Ryan Greenblatt의 「Claude 자칭 + 내부 배포 ID 출력」 통계로 화제가 됐습니다. 본 가이드는 뉴스 요약이 아니라 OpenClaw·사내 Agent 운영자를 위한 의사결정 매트릭스로, 3대 페인포인트·비교표·5단계 HowTo·인용 가능 수치를 정리합니다.
1. 3대 페인포인트: 가성비·출처·상시 가동
이번 주 두 이슈는 겉보기 무관하지만, 현장 의사결정에서는 다음 세 층으로 수렴합니다.
- 페인 1 — 플래그십 성능과 청구서의 가위차. Fable 5는 벤치 최전선이지만 token 단가 약 2배·30일 데이터 보존 정책이 걸림돌입니다. Opus 5는 단가 동결 채 CursorBench 0.5% 차이까지 접근——「0.5% 위해 2배를 낼 것인가」가 실무 질문입니다.
- 페인 2 — 오픈웨이트 훈련 출처 감사 불가. K3는 GPQA-Diamond 93.5%를 내세우지만 완전 가중치는 7월 27일까지 미공개. 증류 의혹과 신원 통계는 저가 고성능 모델을 프로덕션 라우트에 올릴 때 공급망 리스크로 다뤄야 합니다.
- 페인 3 — 모델이 뛰어나도 호스트가 자면 무의미. 장시간 tool loop, SSH 콜백, SFTP 동기화는 24시간 macOS 호스트에 의존합니다. 노트북 슬립·컨테이너 재생성으로 API 키가 사라지는 사고가 모델 선택보다 흔합니다.
2. Claude Opus 5: Max 기본화의 의미
7월 24일(태평양) Anthropic은 claude-opus-5를 API·Bedrock·Vertex 등에 제공하고 Claude Max 기본 및 Pro 최강 공개 모델로 배치했습니다. 입력 $5, 출력 $25 per 100만 tokens, 컨텍스트 100만 tokens, Thinking 기본 ON.
공개 벤치 핵심: Frontier-Bench v0.1에서 Opus 4.8 2배 이상·태스크당 비용 하락. CursorBench 3.2 max effort Fable 5 피크 0.5% 이내. ARC-AGI 3는 2위 3배. OSWorld 2.0에서 Fable 5 최고 기록을 비용 3분의 1 수준으로 상회.
기술 선정에서 놓치기 쉬운 점: Opus 5는 역대 Opus처럼 일반 이용 시 30일 데이터 보존을 강제하지 않습니다. Fable 5/Mythos 5는 opt-in 필요. 사내 코드·고객 데이터를 Agent에 넘길 때 이 차이가 0.5% 벤치 차보다 무거울 수 있습니다.
3. Kimi K3 증류 논쟁: 정치 vs 통계
Moonshot은 7월 16일 Kimi K3 공개. 총 2.8조 파라미터, 896 expert MoE(토큰당 16 활성, 약 500억 활성 상당), 100만 token 컨텍스트, 네이티브 비전.
7월 22–23일 백악관 OSTP 국장 Michael Kratsios가 X에서 Moonshot의 「대규모·은밀한 산업급 증류」로 Fable 역량 탈취를 공개 비난, Nvidia GB300 칩 불법 취득 의혹도 언급. 재무장관 Scott Bessent는 「중국 모델에서 미국 LLM watermark 발견」을 덧붙였습니다. Anthropic은 2026년 2월 Moonshot 등에 340만 회+ 이상 API 이상 상호작용을 지적한 바 있습니다.
TechCrunch(7/23)는 Braden Hancock(Snorkel AI 공동창업) 등 「Fable 7/1 공개→K3 7/16 공개, 2주에 증류·학습·배포는 비현실적」이라는 시각을 전했습니다. Allen AI Nathan Lambert는 증류보다 RL 훈련 체계 차이가 프론티어를 가른다고 분석합니다.
가장 엔지니어 친화적인 자료는 Greenblatt 7월 24일 전후 GitHub 분석(rgreenblatt/which_claude_is_k3)입니다. K3는 자기소개에서 비정상적으로 자주 Claude라고 답하고 claude-opus-4-5-20250929 등 Anthropic 내부 배포 ID를 출력합니다——진짜 Claude Sonnet 4.5는 보통 「Claude Sonnet 4.5」만 말합니다. Greenblatt는 「교사 모델 메타데이터를 교사보다 정확히 재현」하는 현상은 대화 모방만으로 설명하기 어렵고 배포 메타데이터가 붙은 Claude 데이터 혼입을 시사한다고 하면서, 증류의 직접 증명은 아니라고 강조합니다. K3 신호는 Claude 4.5 세대(2025년 말)에 고정, K2는 더 이른 Sonnet 4——세대마다 「최신 Claude 추격」 패턴이 보입니다.
4. 3모델 비교 매트릭스
| 관점 | Claude Opus 5 | Claude Fable 5 | Kimi K3 |
|---|---|---|---|
| token 단가 | $5 in / $25 out | 약 $10 / $50 | Fable 5 대비 대폭 저가(공식) |
| CursorBench 3.2 | Fable 5 피크 -0.5% | 기준 | 공식상 Fable 5 다음 |
| 데이터 보존 | 기본 30일 강제 없음 | 30일 보존 opt-in 필요 | 자체 호스트 시 통제(가중치 7/27) |
| Max 기본 | 예(7/24~) | 아니오 | 해당 없음 |
| 출처 리스크 | Anthropic SLA | 동일+보존 조항 | 증류 미확정·신원 통계 감사 필요 |
| 적합 용도 | 일상 Agent·컴플라이언스 | 극한 벤치·보존 허용 | 저비용 실험·가중치 공개 후 검증 |
5. 5단계 HowTo: 선정부터 프로덕션 검증
- 컴플라이언스·데이터 보존 문서화: 고객 소스·PHI 처리 시 30일 보존 거부하면 Opus 5 우선. K3 완전 가중치 전에는 기밀 Prompt를 Moonshot 엔드포인트로 보내지 않습니다.
- 워크로드에 벤치 레이어 할당: 코딩은 CursorBench/Frontier-Bench. 업무 자동화는 Zapier AutomationBench(Opus 5 100% 통과 보고). 생명과학은 내부 스펙트럼 추론 +10.2pt 등 참고.
- 오픈 모델 신원 프로브: 고정 Prompt 세트 100회+ 샘플링. 내부 ID 문자열 빈도가 임계치 초과 시 아키텍처 리뷰에 「훈련 계보 불명」 플래그.
- API 라우팅·fallback 구성: OpenClaw/OpenRouter에서
anthropic/claude-opus-5primary, Sonnet 5·GPT 계열 secondary. 429·비용 대시보드 동시 모니터링. - 상시 가동 원격 Mac E2E 검증:
openclaw gateway restart→channels status --probe→doctor. API 키·Skills·SFTP 워크스페이스가 launchd 단일 노드에 있는지 확인.
openclaw gateway restart
openclaw channels status --probe
openclaw doctor
6. 인용 가능 핵심 수치·타임라인
- Opus 5 가격: $5/$25 per 100만 input/output tokens(Fable 5 약 절반).
- CursorBench 3.2: max effort Fable 5 대비 0.5% 이내.
- Frontier-Bench: Opus 4.8 2배+.
- ARC-AGI 3: 2위 3배.
- K3 파라미터: 2.8T, API 7/16, 완전 가중치 7/27 예정.
- GPQA-Diamond: K3 공식 93.5%.
- 증류 시간창: Fable 7/1 → K3 7/16 = 14일.
- Anthropic 2월 지적: 이상 API 340만+ 회.
7. 자주 묻는 질문 FAQ
Opus 5는 Fable 5보다 얼마나 저렴합니까? token 비용 약 절반, CursorBench 차 1% 미만.
Opus 5가 Max 기본입니까? 예. 2026년 7월 24일부터 Claude Max 기본.
K3가 Claude를 증류했습니까? 미확정. 백악관 증거 없음, 타임라인 비판, Greenblatt 통계가 현재 최강 기술 단서.
완전 가중치는 언제? 2026년 7월 27일 예정. 공개 전 외부 재현 불가.
8. 결론: 모델 선택과 호스트 선택은 한 세트
Opus 5는 「단가 동결·능력 점프·데이터 보존 비강제」로 다수 OpenClaw 현장에서 Fable 5보다 실무적인 기본 업그레이드가 됩니다. Kimi K3는 저가 오픈웨이트 매력이 크지만, 가중치 공개·증류 논쟁이 정리되기 전에는 기밀 Agent primary에 부적합합니다.
어떤 API를 쓰든 추론 엔드포인트만 정해선 프로덕션이 돌지 않습니다. 장시간 tool loop와 SFTP 동기화에는 끊기지 않는 macOS 호스트가 필요합니다. 노트북 슬립, Docker pairing 소실, 해외 프록시 콜백 지연——벤치 0.5%보다 먼저 장애 티켓을 만듭니다.
Claude Opus 5 Agent를 Xcode 빌드·CI 산출물과 같은 노드에서 24시간 돌리려면 SFTPMAC 원격 Mac 임대가 현실적입니다. Apple Silicon 통합 메모리는 멀티 Agent에, macOS 권한 모델은 allowedPaths 축소에, 백본 회선은 API 콜백 지연을 줄입니다. 이번 주 모델 뉴스를 덮개 닫으면 멈추는 실험이 아니라 지속 가동 자동화로 연결하세요.