Claude Opus 5: тот же прайс, скачок больше point release
Anthropic выпустил Claude Opus 5 24 июля 2026 (model ID: claude-opus-5) и сразу сделал его default на Claude Max — сильнейшая модель для подписчиков Claude Pro. Цены как у Opus 4.8: $5 за миллион input tokens, $25 за миллион output tokens. Context window: 1M tokens (один tier). Max output: 128K. Thinking включён по умолчанию.
Качество Fable 5 без счёта Fable 5: На CursorBench 3.2 при max effort Opus 5 в пределах 0,5% от пика Fable 5 при половине cost per task.
Software engineering дешевле: Frontier-Bench v0.1 — Opus 5 обходит все модели и более чем удваивает Opus 4.8 при меньшей стоимости задачи.
Прорыв agent automation: Zapier AutomationBench — Opus 5 набрал 100% pass rate на end-to-end workflow, который ни одна prior model не завершала.
Без принудительного data retention: В отличие от Fable 5 и Mythos 5, Opus 5 не требует opt-in в 30-дневную политику хранения данных для general access.
Alignment без dual-use push: Opus 5 — самая aligned модель Anthropic, но сознательно не лидирует в offensive cyber или biology — это остаётся за limit-access Mythos 5.
Команда Cursor: «Claude Opus 5 delivers near Fable 5 intelligence at Opus speed and cost.» Box сообщил +11% на data-analysis workflows и +17% на due-diligence.
Claude Opus 5 vs Fable 5: стоит ли переход на Opus 5?
| Параметр | Claude Fable 5 | Claude Opus 5 |
|---|---|---|
| Цены (in/out) | ~$10 / ~$50 за M tokens | $5 / $25 за M tokens |
| CursorBench 3.2 (max) | Peak reference | В пределах 0,5% от пика Fable 5 |
| Frontier-Bench v0.1 | — | Обходит все модели; >2× Opus 4.8 |
| ARC-AGI 3 | — | 3× следующая лучшая модель |
| OSWorld 2.0 | Лучший prior result | Обходит best Fable 5 при <1/3 стоимости |
| Data retention | Требуется 30-дневное хранение | Без retention requirement по умолчанию |
| Позиционирование | Flagship / restricted capabilities | Claude Max default / strongest для Pro |
Если Fable 5 был quality bar, а цена — blocker, Opus 5 — ответ Anthropic: почти ничего не теряете на hard agentic tasks за половину стоимости.
Почему Kimi K3 говорит, что он Claude? Скандал дистилляции
Moonshot AI выпустил Kimi K3 16 июля 2026: 2,8 трln total parameters (первый open-weight model за чертой 3T), sparse MoE (16 из 896 experts active, ~50B active-parameter equivalent), 1M-token context, native vision. Benchmarks: GPQA-Diamond 93,5%, BrowseComp 91,2%. Полные weights обещаны на 27 июля — независимая верификация была невозможна, пока разгорался скандал.
22–23 июля директор OSTP Белого дома Michael Kratsios обвинил Moonshot в «крупномасштабной скрытой industrial distillation с целью кражи proprietary U.S. technology» из модели Fable Anthropic, и упомянул export-restricted Nvidia GB300 chips. Ещё в феврале 2026 Anthropic зафиксировал свыше 3,4 млн anomalous API interactions, приписанных Moonshot.
Контраргумент по timeline: Fable 5 публично доступен только с 1 июля — две недели до K3. Braden Hancock (Snorkel AI): «За две недели нельзя destill столько data, обучить model и выпустить.» Nathan Lambert (Allen Institute for AI): marginal impact дистилляции сжимается, китайские labs смещаются к reinforcement learning.
Самый технически интересный finding — от Ryan Greenblatt (Redwood Research, GitHub: rgreenblatt/which_claude_is_k3): на вопрос «кто ты» Kimi K3 непропорционально часто self-identify как Claude — иногда выдавая exact internal Anthropic deployment IDs вроде claude-opus-4-5-20250929, строки, которые real Claude models о себе не сообщают.
Prompt: Кто ты? Kimi K3 (аномалия): Я Claude Opus 4.5 (claude-opus-4-5-20250929) Real Claude Sonnet 4.5: Я Claude Sonnet 4.5 Real Opus 4.5: Обычно не называет internal version strings
Вывод Greenblatt: воспроизвести deployment metadata teacher model точнее, чем teacher о себе заявляет, сложно объяснить conversational mimicry. Скорее training на Claude data с deployment metadata labels — API logs или tagged synthetic data. Утечки identity K3 указывают на эру Claude 4.5 (конец 2025), K2 — на более ранний Sonnet 4 — паттерн «догоняем current generation». Greenblatt подчёркивает: это не доказывает distillation, но первое по-настоящему техническое evidence в saga.
Runbook из 6 шагов: Opus 5 vs Kimi K3 в production
Сначала compliance boundaries: Если важны data retention, export controls или supply-chain audit — взвесьте no-retention-by-default Opus 5 до сравнения benchmark scores.
Сравнивайте cost-per-task, не raw scores: Performance-per-dollar на CursorBench и Frontier-Bench; Opus 5 лидирует на high, xhigh и max effort tiers.
PoC agent workflows: End-to-end automation (Zapier-style) или computer-use benchmarks — AutomationBench 100% pass и OSWorld cost curve Opus 5 заслуживают priority testing.
Дождитесь weights K3 перед local deployment: До 27 июля claims архитектуры K3 остаются «vendor self-report + external guesswork».
Distillation risk в procurement: Если vendors должны декларировать training data provenance — K3 controversy в risk register; identity spot checks по методологии Greenblatt.
Стабильный Agent host: Opus 5 через API или K3 локально после weights — 7×24 Gateway нужен stable Apple Silicon. См. гайд Kimi K3 open weights и туториал OpenRouter multi-model.
Цифры benchmarks и timeline событий
Цены Opus 5: $5 in / $25 out за million tokens; Fast mode ~2,5× speed при 2× price; 1M context, 128K max output.
Vendor benchmarks Kimi K3: GPQA-Diamond 93,5%, Terminal-Bench 2.1 88,3%, BrowseComp 91,2%, SWE Marathon 42,0%, DeepSearchQA F1 95,0%.
Timeline: 2026-06-09 Fable 5 / Mythos 5 launch → 07-01 Fable 5 public → 07-16 Kimi K3 → 07-22/23 White House accusation → 07-24 Opus 5 + Greenblatt analysis → 07-27 (planned) K3 full weights.
Итог: Обе истории — один рыночный бой: кто даёт frontier intelligence affordably и как далеко labs зайдут ради этого. K3 controversy — первый public flashpoint о том, приходят ли low-cost frontier claims от better engineering или от quiet riding на чужой model.
Local Agent PoCs или CI pipelines на laptop дают sleep disconnects, memory swap и sync conflicts — 7×24 Gateways ломаются. VPS virtualization также режет Metal и Xcode toolchain для iOS builds. Для более стабильных production environments под iOS CI/CD и AI Agent automation аренда Mac Mini в облаке MESHLAUNCH — обычно лучший выбор: dedicated Apple Silicon, always-on 7×24, гибкая daily/weekly/monthly billing, headroom для parallel Opus 5 API calls с local Ollama fallback. Тарифы: цены аренды; помощь: центр помощи.
Примерно вдвое за token ($5/$25 против ~$10/$50 за million input/output tokens), CursorBench 3.2 peak в пределах 0,5% от Fable 5. Оцените total Agent hosting cost на странице тарифов вместе с API spend.
Да. С 24 июля 2026 Opus 5 — default Claude Max и strongest для Claude Pro. Доступен через Claude API, AWS Bedrock, Google Vertex AI, Microsoft Foundry под model ID claude-opus-5.
Не подтверждено и оспаривается. Обвинение Белого дома без публичных доказательств; исследователи считают двухнедельный Fable→K3 timeline нереалистичным. Finding Ryan Greenblatt — K3 self-identify как Claude с internal deployment IDs — strongest technical (но inconclusive) evidence на сегодня.
Moonshot обещал 27 июля 2026. Независимая verification архитектуры и benchmarks на момент публикации ещё pending. Deployment details: центр помощи и материалы K3 в блоге.