Claude Opus 5 вдвое дешевле
Kimi K3 называет себя Claude

Релиз Opus 5 · Opus vs Fable 5 · Скандал дистилляции K3 · Доказательства Greenblatt · Runbook разработчика

Claude Opus 5 и скандал дистилляции Kimi K3 2026
На этой неделе два события выглядят несвязанными — пока не увидишь общий мотив: frontier-интеллект по цене, которую команда может позволить, и вопрос — откуда она реально берётся. 24 июля Anthropic выпустил Claude Opus 5 как default Claude Max. 16 июля Moonshot AI представил Kimi K3 на 2,8 трln параметров — и попал под обвинение Белого дома в дистилляции, плюс независимое исследование показало, что K3 буквально называет себя Claude, включая internal deployment IDs. Для разработчиков, выбирающих между Opus 5, Fable 5 и K3: ① стоит ли апгрейд на Opus 5 по cost-per-task; ② что в saga K3 проверяемо, а что спекуляция; ③ шестишаговый runbook для compliance-sensitive workloads.
01

Claude Opus 5: тот же прайс, скачок больше point release

Anthropic выпустил Claude Opus 5 24 июля 2026 (model ID: claude-opus-5) и сразу сделал его default на Claude Max — сильнейшая модель для подписчиков Claude Pro. Цены как у Opus 4.8: $5 за миллион input tokens, $25 за миллион output tokens. Context window: 1M tokens (один tier). Max output: 128K. Thinking включён по умолчанию.

01

Качество Fable 5 без счёта Fable 5: На CursorBench 3.2 при max effort Opus 5 в пределах 0,5% от пика Fable 5 при половине cost per task.

02

Software engineering дешевле: Frontier-Bench v0.1 — Opus 5 обходит все модели и более чем удваивает Opus 4.8 при меньшей стоимости задачи.

03

Прорыв agent automation: Zapier AutomationBench — Opus 5 набрал 100% pass rate на end-to-end workflow, который ни одна prior model не завершала.

04

Без принудительного data retention: В отличие от Fable 5 и Mythos 5, Opus 5 не требует opt-in в 30-дневную политику хранения данных для general access.

05

Alignment без dual-use push: Opus 5 — самая aligned модель Anthropic, но сознательно не лидирует в offensive cyber или biology — это остаётся за limit-access Mythos 5.

Команда Cursor: «Claude Opus 5 delivers near Fable 5 intelligence at Opus speed and cost.» Box сообщил +11% на data-analysis workflows и +17% на due-diligence.

02

Claude Opus 5 vs Fable 5: стоит ли переход на Opus 5?

ПараметрClaude Fable 5Claude Opus 5
Цены (in/out)~$10 / ~$50 за M tokens$5 / $25 за M tokens
CursorBench 3.2 (max)Peak referenceВ пределах 0,5% от пика Fable 5
Frontier-Bench v0.1Обходит все модели; >2× Opus 4.8
ARC-AGI 33× следующая лучшая модель
OSWorld 2.0Лучший prior resultОбходит best Fable 5 при <1/3 стоимости
Data retentionТребуется 30-дневное хранениеБез retention requirement по умолчанию
ПозиционированиеFlagship / restricted capabilitiesClaude Max default / strongest для Pro

Если Fable 5 был quality bar, а цена — blocker, Opus 5 — ответ Anthropic: почти ничего не теряете на hard agentic tasks за половину стоимости.

03

Почему Kimi K3 говорит, что он Claude? Скандал дистилляции

Moonshot AI выпустил Kimi K3 16 июля 2026: 2,8 трln total parameters (первый open-weight model за чертой 3T), sparse MoE (16 из 896 experts active, ~50B active-parameter equivalent), 1M-token context, native vision. Benchmarks: GPQA-Diamond 93,5%, BrowseComp 91,2%. Полные weights обещаны на 27 июля — независимая верификация была невозможна, пока разгорался скандал.

22–23 июля директор OSTP Белого дома Michael Kratsios обвинил Moonshot в «крупномасштабной скрытой industrial distillation с целью кражи proprietary U.S. technology» из модели Fable Anthropic, и упомянул export-restricted Nvidia GB300 chips. Ещё в феврале 2026 Anthropic зафиксировал свыше 3,4 млн anomalous API interactions, приписанных Moonshot.

Контраргумент по timeline: Fable 5 публично доступен только с 1 июля — две недели до K3. Braden Hancock (Snorkel AI): «За две недели нельзя destill столько data, обучить model и выпустить.» Nathan Lambert (Allen Institute for AI): marginal impact дистилляции сжимается, китайские labs смещаются к reinforcement learning.

Самый технически интересный finding — от Ryan Greenblatt (Redwood Research, GitHub: rgreenblatt/which_claude_is_k3): на вопрос «кто ты» Kimi K3 непропорционально часто self-identify как Claude — иногда выдавая exact internal Anthropic deployment IDs вроде claude-opus-4-5-20250929, строки, которые real Claude models о себе не сообщают.

Пример identity confusion
Prompt: Кто ты?
Kimi K3 (аномалия): Я Claude Opus 4.5 (claude-opus-4-5-20250929)

Real Claude Sonnet 4.5: Я Claude Sonnet 4.5
Real Opus 4.5: Обычно не называет internal version strings

Вывод Greenblatt: воспроизвести deployment metadata teacher model точнее, чем teacher о себе заявляет, сложно объяснить conversational mimicry. Скорее training на Claude data с deployment metadata labels — API logs или tagged synthetic data. Утечки identity K3 указывают на эру Claude 4.5 (конец 2025), K2 — на более ранний Sonnet 4 — паттерн «догоняем current generation». Greenblatt подчёркивает: это не доказывает distillation, но первое по-настоящему техническое evidence в saga.

04

Runbook из 6 шагов: Opus 5 vs Kimi K3 в production

01

Сначала compliance boundaries: Если важны data retention, export controls или supply-chain audit — взвесьте no-retention-by-default Opus 5 до сравнения benchmark scores.

02

Сравнивайте cost-per-task, не raw scores: Performance-per-dollar на CursorBench и Frontier-Bench; Opus 5 лидирует на high, xhigh и max effort tiers.

03

PoC agent workflows: End-to-end automation (Zapier-style) или computer-use benchmarks — AutomationBench 100% pass и OSWorld cost curve Opus 5 заслуживают priority testing.

04

Дождитесь weights K3 перед local deployment: До 27 июля claims архитектуры K3 остаются «vendor self-report + external guesswork».

05

Distillation risk в procurement: Если vendors должны декларировать training data provenance — K3 controversy в risk register; identity spot checks по методологии Greenblatt.

06

Стабильный Agent host: Opus 5 через API или K3 локально после weights — 7×24 Gateway нужен stable Apple Silicon. См. гайд Kimi K3 open weights и туториал OpenRouter multi-model.

05

Цифры benchmarks и timeline событий

A

Цены Opus 5: $5 in / $25 out за million tokens; Fast mode ~2,5× speed при 2× price; 1M context, 128K max output.

B

Vendor benchmarks Kimi K3: GPQA-Diamond 93,5%, Terminal-Bench 2.1 88,3%, BrowseComp 91,2%, SWE Marathon 42,0%, DeepSearchQA F1 95,0%.

C

Timeline: 2026-06-09 Fable 5 / Mythos 5 launch → 07-01 Fable 5 public → 07-16 Kimi K3 → 07-22/23 White House accusation → 07-24 Opus 5 + Greenblatt analysis → 07-27 (planned) K3 full weights.

Итог: Обе истории — один рыночный бой: кто даёт frontier intelligence affordably и как далеко labs зайдут ради этого. K3 controversy — первый public flashpoint о том, приходят ли low-cost frontier claims от better engineering или от quiet riding на чужой model.

Local Agent PoCs или CI pipelines на laptop дают sleep disconnects, memory swap и sync conflicts — 7×24 Gateways ломаются. VPS virtualization также режет Metal и Xcode toolchain для iOS builds. Для более стабильных production environments под iOS CI/CD и AI Agent automation аренда Mac Mini в облаке MESHLAUNCH — обычно лучший выбор: dedicated Apple Silicon, always-on 7×24, гибкая daily/weekly/monthly billing, headroom для parallel Opus 5 API calls с local Ollama fallback. Тарифы: цены аренды; помощь: центр помощи.

FAQ

Примерно вдвое за token ($5/$25 против ~$10/$50 за million input/output tokens), CursorBench 3.2 peak в пределах 0,5% от Fable 5. Оцените total Agent hosting cost на странице тарифов вместе с API spend.

Да. С 24 июля 2026 Opus 5 — default Claude Max и strongest для Claude Pro. Доступен через Claude API, AWS Bedrock, Google Vertex AI, Microsoft Foundry под model ID claude-opus-5.

Не подтверждено и оспаривается. Обвинение Белого дома без публичных доказательств; исследователи считают двухнедельный Fable→K3 timeline нереалистичным. Finding Ryan Greenblatt — K3 self-identify как Claude с internal deployment IDs — strongest technical (но inconclusive) evidence на сегодня.

Moonshot обещал 27 июля 2026. Независимая verification архитектуры и benchmarks на момент публикации ещё pending. Deployment details: центр помощи и материалы K3 в блоге.