Claude Opus 5 출시: 가격은 그대로, 성능은 마이너 업데이트를 넘어섰습니다
Anthropic은 2026년 7월 24일 Claude Opus 5(모델 ID: claude-opus-5)를 출시하고 즉시 Claude Max 기본 모델로 설정했습니다. Claude Pro 구독자가 사용할 수 있는 최강 모델입니다. 요금은 Opus 4.8과 동일합니다 — 입력 $5/백만 token, 출력 $25/백만 token. 컨텍스트 윈도우 100만 token(단일 티어), 최대 출력 128K token, Thinking 기본 활성화입니다.
Fable 5 품질, Fable 5 요금은 아님: CursorBench 3.2 max effort 기준 Opus 5는 Fable 5 피크와 0.5% 이내이며, 태스크당 비용은 절반입니다.
소프트웨어 엔지니어링 비용 절감: Frontier-Bench v0.1에서 Opus 5는 모든 모델을 상회하며 Opus 4.8 대비 2배 이상이면서 태스크당 비용은 더 낮습니다.
Agent 자동화 돌파: Zapier AutomationBench에서 Opus 5는 이전 모델이 완료하지 못한 엔드투엔드 워크플로에 100% 통과율을 기록했습니다.
강제 데이터 보존 없음: Fable 5·Mythos 5와 달리 Opus 5는 일반 접근에 30일 데이터 보존 정책 동의를 요구하지 않습니다.
정렬과 이중용도 역할 분리: Opus 5는 Anthropic 역대 최고 정렬 모델이지만, 공격적 사이버·생물학 프론티어는 의도적으로 선두에 두지 않으며, 해당 역할은 제한 접근 Mythos 5가 담당합니다.
Cursor 팀은 "Claude Opus 5 delivers near Fable 5 intelligence at Opus speed and cost"라고 평가했습니다. Box는 데이터 분석 워크플로 11%, 실사(due diligence) 워크플로 17% 개선을 보고했습니다.
Claude Opus 5 vs Fable 5: Opus 5가 선택할 만한가요?
| 항목 | Claude Fable 5 | Claude Opus 5 |
|---|---|---|
| 요금(입력/출력) | 약 $10 / $50 per M token | $5 / $25 per M token |
| CursorBench 3.2 (max) | 피크 기준 | Fable 5 피크 대비 0.5% 이내 |
| Frontier-Bench v0.1 | — | 전 모델 상회; Opus 4.8 대비 >2× |
| ARC-AGI 3 | — | 차순위 모델 대비 3× |
| OSWorld 2.0 | 기존 최고 | Fable 5 최고 대비 <1/3 비용으로 상회 |
| 데이터 보존 | 30일 보존 필수 | 기본 보존 요구 없음 |
| 포지셔닝 | 플래그십 / 제한 기능 | Claude Max 기본 / Pro 최강 |
Fable 5가 품질 기준이었지만 가격이 걸림돌이었다면, Opus 5는 어려운 Agent 태스크에서 거의 포기하지 않으면서 비용을 절반으로 낮춘 Anthropic의 답입니다.
Kimi K3가 Claude라고 말하는 이유: 증류 논란 정리
Moonshot AI는 2026년 7월 16일 Kimi K3를 출시했습니다 — 총 2.8조 파라미터(3T를 넘는 첫 오픈 가중치 모델), 희소 MoE(896개 전문가 중 16개 활성, 약 500억 활성 파라미터), 100만 token 컨텍스트, 네이티브 비전. 벤치마크: GPQA-Diamond 93.5%, BrowseComp 91.2%. 전체 가중치는 7월 27일 공개 예정이며, 논란 진행 중에는 독립 검증이 불가능했습니다.
7월 22–23일 백악관 OSTP 국장 Michael Kratsios는 Moonshot AI가 Anthropic Fable 모델의 독점 미국 기술을 훔치기 위한 "대규모·은밀한 산업 증류"를 했다고 지적했으며, 수출 제한 Nvidia GB300 칩 사용 혐의도 언급했습니다. 2026년 2월 Anthropic은 Moonshot AI에 귀속된 340만 건 이상의 이상 API 상호작용을 이미 지적한 바 있습니다.
타임라인 반론: Fable 5는 7월 1일부터 공개됐고 K3 출시(7월 16일)까지 겨우 2주입니다. Snorkel AI 공동창업자 Braden Hancock: "2주 안에 그만큼의 데이터를 증류하고 모델을 학습·출시할 수 없습니다." Allen Institute for AI의 Nathan Lambert는 중국 연구소가 강화학습으로 이동하면서 증류의 한계 효과가 줄어든다고 봅니다.
가장 기술적으로 주목할 발견은 Redwood Research의 Ryan Greenblatt(GitHub: rgreenblatt/which_claude_is_k3) 연구입니다. 자신을 묻는 프롬프트에 Kimi K3가 Claude라고 자칭하는 빈도가 비정상적으로 높으며, claude-opus-4-5-20250929 같은 Anthropic 내부 배포 ID 문자열을 출력하기도 합니다. 실제 Claude 모델은 이런 내부 문자열을 스스로 밝히지 않습니다.
프롬프트: 당신은 누구입니까? Kimi K3 (비정상): 저는 Claude Opus 4.5입니다 (claude-opus-4-5-20250929) 실제 Claude Sonnet 4.5: 저는 Claude Sonnet 4.5입니다 실제 Opus 4.5: 내부 버전 문자열을 생략하거나 잘못 기술하는 경우가 많음
Greenblatt의 해석은, 교사 모델의 배포 메타데이터를 교사 모델 자신보다 더 정확히 재현하는 것은 대화 모방으로 설명하기 어렵다는 것입니다. 배포 메타데이터가 포함된 Claude 데이터(API 로그 또는 태그된 합성 데이터)로 학습했을 가능성을 시사합니다. K3의 유출된 정체는 Claude 4.5 세대(2025년 말)를 가리키고, K2는 더 이른 Sonnet 4를 가리켜 "현 세대 추격" 패턴을 보입니다. Greenblatt는 이것이 증류 발생을 증명하지는 않지만, 이번 논란에서 첫 번째로 기술적 근거가 있는 증거라고 강조합니다.
6단계 Runbook: 프로덕션에서 Opus 5 vs Kimi K3 선택
컴플라이언스 경계를 먼저 정의: 데이터 보존, 수출 통제, 공급망 감사가 중요하면 벤치마크 점수보다 Opus 5의 기본 비보존 정책을 우선 평가합니다.
원점수가 아닌 태스크당 비용 비교: CursorBench·Frontier-Bench의 성능 대비 비용을 사용합니다. Opus 5는 high·xhigh·max 모든 티어에서 이 지표 1위입니다.
Agent 워크플로 PoC: Zapier형 엔드투엔드 자동화나 computer-use 벤치마크에 의존하면 Opus 5의 AutomationBench 100% 통과와 OSWorld 비용 곡선을 우선 테스트합니다.
로컬 배포는 K3 가중치 공개 후: 7월 27일 가중치 공개 전까지 K3 아키텍처 주장은 "벤더 자체 보고 + 외부 추측" 수준입니다.
증류 리스크를 조달에 반영: 벤더가 학습 데이터 출처를 선언해야 한다면 K3 논란을 리스크 레지스터에 기록하고, Greenblatt 방법론으로 정체 혼동 스팟 체크를 고려합니다.
안정적 Agent 호스트 선택: Opus 5 API 호출이든 K3 로컬 추론이든 7×24 Gateway에는 안정적 Apple Silicon이 필요합니다. Kimi K3 오픈 가중치 가이드와 OpenRouter 멀티 모델 튜토리얼을 참고하세요.
인용 가능한 벤치마크 수치와 이벤트 타임라인
Opus 5 요금: 입력 $5 / 출력 $25 per M token; Fast 모드 약 2.5× 속도·2× 가격; 100만 token 컨텍스트, 128K 최대 출력.
Kimi K3 벤더 벤치마크: GPQA-Diamond 93.5%, Terminal-Bench 2.1 88.3%, BrowseComp 91.2%, SWE Marathon 42.0%, DeepSearchQA F1 95.0%.
주요 타임라인: 2026-06-09 Fable 5 / Mythos 5 출시 → 07-01 Fable 5 공개 → 07-16 Kimi K3 → 07-22/23 백악관 지적 → 07-24 Opus 5 + Greenblatt 분석 → 07-27(예정) K3 전체 가중치.
핵심: 두 이야기는 같은 시장 경쟁을 반영합니다 — 누가 저렴한 프론티어 지능을 제공하는가, 그리고 그 능력을 얻기 위해 어디까지 갈 것인가. K3 논란은 저비용 프론티어 주장이 더 나은 엔지니어링에서 오는지, 타사 모델에 조용히 기대는 것인지에 대한 첫 공개 촉발점입니다.
노트북에서 로컬 Agent PoC나 CI 파이프라인을 돌리면 슬립·메모리 스왑·동기화 충돌로 7×24 Gateway가 끊깁니다. VPS 가상화는 Metal과 Xcode 툴체인 성능을 떨어뜨려 iOS 빌드에 부적합합니다. iOS CI/CD와 AI Agent 자동화에 더 안정적인 프로덕션 환경으로 MESHLAUNCH Mac Mini 클라우드 대여가 일반적으로 더 나은 선택입니다 — 전용 Apple Silicon, 7×24 상시 가동, 일·주·월 탄력 과금, Opus 5 API 호출과 로컬 Ollama fallback 병렬 실행 여유를 제공합니다.
token당 약 절반($5/$25 vs 대략 $10/$50, 백만 입력/출력 token 기준)이며, CursorBench 3.2 피크는 Fable 5와 0.5% 이내입니다. API 비용과 함께 Agent 호스팅 총비용은 가격 페이지에서 추정할 수 있습니다.
예. 2026년 7월 24일부터 Opus 5가 Claude Max 기본 모델이며 Claude Pro 사용자 최강 모델입니다. Claude API, AWS Bedrock, Google Vertex AI, Microsoft Foundry에서 모델 ID claude-opus-5로 사용할 수 있습니다.
아직 확정되지 않았고 논쟁 중입니다. 백악관 지적에는 공개 증거가 없으며, Fable 5 공개와 K3 출시 사이 2주 간격으로 깊은 증류는 비현실적이라는 연구자 주장이 있습니다. Ryan Greenblatt가 K3가 Claude라고 자칭하며 내부 배포 ID를 출력한다는 발견이 지금까지 가장 강한 기술적(그러나 결론적이지 않은) 증거입니다.
Moonshot AI는 2026년 7월 27일 공개를 약속했습니다. 본문 작성 시점 기준 아키텍처와 벤치마크 독립 검증은 진행 중입니다. 배포 세부는 고객 센터와 블로그 K3 관련 글을 참고하세요.