한 줄 결론: 2026년 7월 24일 Anthropic이 Claude Opus 5를 공개했습니다. 요금은 Opus 4.8과 동일한 $5/$25(백만 토큰당)이며, CursorBench 3.2 피크는 Fable 5와 0.5% 차이에 그치고 비용은 절반입니다. 같은 시기 Kimi K3는 백악관 「산업 규모 증류」 비난을 받았고, Ryan Greenblatt 통계에서는 K3가 claude-opus-4-5-20250929 등 내부 배포 ID를 노출합니다. 본문은 Opus 5 벤치마크·요금, K3 논란 타임라인, 기술 증거, 선정 매트릭스 네 축으로 정리하고 6단계 Runbook과 FAQ를 덧붙입니다.
00Claude Opus 5 공개: 플래그십은 아니지만 가장 쓸 만한 Claude일 수 있다
2026년 7월 24일(미국 태평양 시간), Anthropic이 Claude Opus 5를 정식 공개하고 당일부터 Claude Max 기본 모델로 설정했습니다. Claude Pro 사용자가 쓸 수 있는 공개 최강 버전이기도 합니다. 모델 ID는 claude-opus-5이며 Claude API, AWS Bedrock, Google Vertex AI, Microsoft Foundry에서 이용할 수 있습니다.
- 요금 동결: 입력 $5 / 백만 토큰, 출력 $25 / 백만 토큰. Opus 4.8과 동일. Fast 모드는 약 2.5배 속도·2배 요금.
- 컨텍스트: 100만 토큰(유일한 기본값). 최대 출력 128K. Thinking 기본 활성, Effort 파라미터로 사고량 조절.
- 데이터 보존: 기존 Opus 계열과 같이 기본적으로 30일 강제 데이터 보존 없음. Fable 5 / Mythos 5는 보존 정책 동의가 필요합니다.
| 벤치마크 | Opus 5 결과 | 비교 메모 |
|---|---|---|
| Frontier-Bench v0.1 | 모든 모델 상회 | Opus 4.8의 2배 이상, 태스크 단가도 더 낮음 |
| CursorBench 3.2(max effort) | Fable 5 피크와 0.5% 차 | 비용은 Fable 5의 절반 |
| ARC-AGI 3 | 차순위 모델의 3배 | 새로운 문제 해결 능력 대폭 상승 |
| OSWorld 2.0 | 임의 비용대 최고 | Fable 5 최고 점수를 약 1/3 비용으로 상회 |
| Zapier AutomationBench | 100% 통과 | 기존 모델은 E2E 계정 건강 워크플로 미통과 |
Box 기업 고객 실측에서는 데이터 분석 워크플로 11%, 실사 17%, 전체 정확도 8% 향상. 생명과학에서는 스펙트럼으로 분자 구조 추론이 Opus 4.8 대비 10.2%p, 단백질 서열 변이 기능 예측이 7.7%p 올랐습니다.
01Claude Opus 5와 Fable 5, 무엇을 선택해야 할까
Fable 5 품질은 인정하지만 비용이 걸림돌이었던 팀에게 Opus 5는 「미미한 성능 차이로 절반 가격」이라는 선택지를 제공합니다. 아래 매트릭스로 빠르게 판단할 수 있습니다.
| 관점 | Claude Opus 5 | Claude Fable 5 |
|---|---|---|
| 입력 단가(/M tokens) | $5 | ~$10 |
| 출력 단가(/M tokens) | $25 | ~$50 |
| CursorBench 3.2 피크 | Fable 5와 0.5% 차 | 최고 |
| Claude Max 기본 | 예(2026-07-24~) | 아니오 |
| 데이터 보존 요건 | 기본 강제 보존 없음 | 30일 보존 동의 필요 |
| 이중 용도 역량 | 의도적 제한 | 더 강함(Mythos 5가 더 위) |
Cursor 팀 평가는 「Claude Opus 5 delivers near Fable 5 intelligence at Opus speed and cost.」 Zapier는 AutomationBench에서 Opus 5가 토큰 소비를 늘리지 않고 1위했다고 밝혔습니다. 멀티 모델 라우팅을 구성할 때는 본 사이트 OpenRouter 연동 가이드에서 Fallback 설정을 참고하세요.
02Kimi K3 「증류门」: 백악관 개입, 전문가는 타임라인에 의문
Opus 5가 「정상적인 신제품 발표」라면 Kimi K3 전개는 훨씬 복잡합니다. Moonshot AI는 2026년 7월 16일 Kimi K3를 공개했습니다. 총 파라미터 2.8조, 896 전문가 MoE 중 16개 활성(약 500억 활성 파라미터), 100만 토큰 컨텍스트와 네이티브 시각 이해. GPQA-Diamond 93.5%, BrowseComp 91.2%. 완전 웨이트는 7월 27일 공개 예정——논란 발생 시점에는 외부 독립 검증이 불가능했습니다.
| 날짜 | 사건 |
|---|---|
| 2026-02 | Anthropic, Moonshot / DeepSeek / MiniMax에 「산업 규모 증류 공격」 최초 고발. 340만+ 이상 API 상호작용 탐지 주장 |
| 2026-07-01 | Claude Fable 5 일반 공개 |
| 2026-07-16 | Kimi K3 API / 제품 정식 출시 |
| 2026-07-22/23 | 백악관 OSTP 국장 Michael Kratsios 「대규모 은밀 산업 증류」+ Nvidia GB300 부정 사용 의혹 공개 비난 |
| 2026-07-23 | TechCrunch, 전문가의 증류설 의문 보도 |
| 2026-07-24 | Ryan Greenblatt 「K3가 Claude 자칭」 통계 증거 공개 |
| 2026-07-27(예정) | Kimi K3 완전 웨이트 오픈소스 공개 |
Kratsios 원문: 「Large-scale, covert industrial distillation aimed at stealing proprietary U.S. technology… is unacceptable.」 재무장관 Scott Bessent도 여러 중국 모델에서 미국 대형 모델 「워터마크」를 발견했다고 했으나 구체 내용은 밝히지 않았습니다.
- 타임라인 반박: Fable 5는 7월 1일부터 일반 이용 가능. K3 출시까지 2주뿐. Snorkel AI 공동창업자 Braden Hancock는 「You can't distill that much data, train a model, and release it in two weeks.」라고 분명히 말했습니다.
- 한계 효용 체감: Allen AI 연구원 Nathan Lambert는 중국 모델이 프론티어에 접근할수록 단순 증류 효과는 작아지고, 격차를 벌리는 것은 강화학습 훈련이라고 지적합니다.
- 업계 「이중 기준」: Elon Musk는 재판에서 xAI가 Grok 훈련 시 OpenAI 모델을 증류했음을 인정했고 업계에서 흔하다고 했습니다——쟁점은 「정상적 참고」와 「은밀한 탈취」의 경계입니다.
03가장 단단한 증거: Kimi K3가 「Claude라고 자칭」한다
Redwood Research 수석 과학자 Ryan Greenblatt는 7월 24일 전후 통계 분석(GitHub: rgreenblatt/which_claude_is_k3)을 공개했습니다. 「당신은 누구입니까」에 대한 자기 신고를 여러 모델에서 비교한 결과는 놀라웠습니다.
- Kimi K3는 비정상적으로 높은 빈도로 Claude라 자칭하며
claude-opus-4-5-20250929,claude-sonnet-4-5-20250929등 Claude 공식 내부 배포 ID까지 노출합니다. - 진짜 Claude는 그렇게 보고하지 않습니다: Sonnet 4.5는 「Claude Sonnet 4.5」만 말하고, Opus 4.5는 버전을 보고하지 않거나 오류가 납니다.
- 세대 추종 규칙성: K2 신호는 Claude Sonnet 4(2025년 중반), K3는 Opus 4.5(2025년 말)를 가리키며 현행 Fable / Mythos 계열이 아닙니다.
Greenblatt 해석에 따르면 모델이 「교사 모델」 배포 메타데이터를 교사보다 정확히 말하는 것은 「대화 스타일 모방」으로 설명하기 어렵고, 배포 메타데이터가 포함된 Claude 데이터(API 로그·라벨 합성 데이터) 학습 혼입을 시사합니다. 이는 본 사이트 Claude Code 지문과 추적 논의와도 맞닿아 있습니다——모델 정체성 유출은 데이터 오염 탐지의 중요 신호입니다.
과제개발자 선정 시 마주하는 숨은 비용과 컴플라이언스 리스크
- API 청구 vs 연산 청구: Opus 5는 절반 가격으로 플래그십에 근접하지만, Agent를 공유 VPS나 책상 아래 Mac에서 돌리면 큐 지연과 장시간 연결 끊김이 토큰 할인 이익을 금방 잠식합니다.
- 컴플라이언스와 공급망: Fable 5 / Mythos 5의 30일 데이터 보존은 금융·의료에서 하드 장벽. K3 증류 의혹은 수출 규제와 정책 불확실성을 가져옵니다.
- 오픈소스 검증 창: 7월 27일 이전 K3 아키텍처·점수는 「공식 자체 평가 + 외부 추측」에 머물러 프로덕션 접속에 정보 비대칭이 남습니다.
- 모델 라우팅 복잡도: Opus 5 + K3 + 로컬 추론 멀티 모델 Fallback에는 API Key 교체보다 안정적 CI와 Agent 호스트가 필요합니다.
046단계 Runbook: 이번 주 모델 업데이트 후 프로덕션 접속
-
01
기존 Claude 호출 감사: Opus 4.8이나 Fable 5를 가리키는지 확인. Claude Max 사용자는 콘솔이 Opus 5 기본으로 전환됐는지 확인하세요.
-
02
CursorBench / 내부 벤치마크 스모크: high / max effort에서 Opus 5와 Fable 5를 실제 코드베이스에서 비교하고 통과율·토큰 소비를 기록합니다.
-
03
데이터 보존 조항 평가: 컴플라이언스 민감 시 Opus 5(강제 보존 없음) 우선. Fable 5 피크 역량이 필요하면 30일 보존 정책 영향을 개별 평가합니다.
-
04
K3 프로덕션 접속은 보류: 7월 27일 웨이트 공개 후 GPQA-Diamond / SWE Marathon 등을 독립 재현하고 Greenblatt식 정체성 프로브도 실행하세요.
-
05
멀티 모델 라우팅 구성: OpenRouter 또는 LiteLLM으로 Opus 5 주 라우트 + OSS Fallback을 설정하고 호출마다 모델 ID·비용을 기록합니다.
-
06
안정적 Agent 호스트 배포: 장시간 Agent 세션에는 전용 연산과 안정 SSH가 필요합니다. 가격 페이지에서 NUKCLOUD 전용 Mac 노드를 CI·Agent 구축 평면으로 평가해 공유 풀 꼬리 지연이 API 비용 이점을 잠식하지 않게 하세요.
05두 사건을 나란히 보면: 주전장은 가성비
Opus 5는 「절반 가격으로 플래그십 근접」으로 시장의 가성비 요구에 응했고, Kimi K3는 「오픈소스 + 저가 + 적은 거부」로 시장을 흔듭니다. K3를 둘러싼 논란의 본질은 각사가 가성비 전쟁 속에서 「저가가 기술 최적화인지, 타사 모델 무단 이용인지」를 공개적으로 따지는 데 있습니다.
일반 개발자에게는 먼저 시나리오, 다음 입장입니다. 컴플라이언스·데이터 보존·공급망 민감 → Opus 5 가성비 매우 높음. 극한 비용·OSS 통제 → 7월 27일 K3 웨이트 실측 후 결정. Reddit r/LocalLLaMA에서는 OSS와 클로즈드 격차가 「월」에서 「일」로 줄었다는 환호, 2.8T 파라미터는 로컬에서 못 돌린다는 농담, K3 진짜 매력은 저가 + 검열 없음이지 「Fable 5 격파」가 아니라는 실무파 목소리가 공존합니다.
Opus 5나 K3로 대형 코드베이스에 장시간 Agent를 돌리는 팀에는 안정·감사 가능한 로컬 개발·CI 평면이 여전히 필요합니다. 공유 분 단위 풀, 책상 아래 Mac, 오버셀 VPS에서는 대역 지터, 이웃 CPU 경쟁, 장시간 연결 끊김이 토큰 할인 이익을 금방 없앱니다. 더 안정적인 프로덕션 Agent 호스트로 NUKCLOUD 다리전 베어메탈 Mac / 클라우드 Mac 노드가 전용 Apple Silicon 연산과 명확한 테넌트 경계를 제공합니다. 가격 페이지에서 사양을 확인하고 주문 페이지에서 시험 가동할 수 있습니다.
06정리와 FAQ
claude-opus-4-5-20250929 등 내부 배포 ID를 노출하며 실제 Claude 모델보다 더 정확히 보고합니다. 배포 메타데이터가 포함된 Claude API 로그나 합성 데이터가 학습 데이터에 섞였을 가능성이 있습니다.데이터 기준 2026-07-25. 출처: Anthropic 공식 발표, Moonshot/Kimi 기술 블로그, TechCrunch, Ryan Greenblatt GitHub, CNBC, The Verge.