Claude Opus 5: mehr als ein Point Release — zum halben Fable-Preis
Anthropic veröffentlichte Claude Opus 5 am 24. Juli 2026 (Modell-ID: claude-opus-5) und machte es sofort zum Claude-Max-Standard — das stärkste Modell, das Claude-Pro-Abonnenten nutzen können. Preise unverändert gegenüber Opus 4.8: $5 pro Million Input-Tokens, $25 pro Million Output-Tokens. Kontextfenster: 1M Tokens (eine Stufe). Max Output: 128K. Thinking standardmäßig aktiv.
Fable-5-Nähe ohne Fable-Rechnung: CursorBench 3.2 max effort — Opus 5 liegt 0,5 % unter Fable-5-Peak, kostet aber halb so viel pro Aufgabe.
Software-Engineering günstiger: Frontier-Bench v0.1 — Opus 5 schlägt alle Modelle und mehr als verdoppelt Opus 4.8 bei niedrigeren Kosten pro Task.
Agent-Automatisierung: Zapier AutomationBench — Opus 5 erreicht 100 % Pass-Rate bei einem End-to-End-Workflow, den kein Vorgängermodell schaffte.
Keine erzwungene Speicherfrist: Anders als Fable 5 und Mythos 5 verlangt Opus 5 kein Opt-in in eine 30-Tage-Datenaufbewahrung. Für EU-Teams vereinfacht das die DSGVO-Dokumentation der Datenverarbeitung — weniger Aufbewahrungszwang bedeutet klarere Löschfristen und schmalere Verarbeitungsverzeichnisse.
Ausrichtung ohne Dual-Use-Front: Opus 5 ist Anthropics bisher am besten ausgerichtetes Modell, führt aber bewusst nicht bei Offensive-Cyber oder Biologie — das bleibt dem limitierten Mythos 5 vorbehalten.
Cursor-Team: „Claude Opus 5 delivers near Fable 5 intelligence at Opus speed and cost." Box meldete +11 % bei Datenanalyse-Workflows und +17 % bei Due-Diligence-Szenarien.
Opus 5 oder Fable 5? Vergleichstabelle für Entscheider
| Dimension | Claude Fable 5 | Claude Opus 5 |
|---|---|---|
| Preis (In/Out) | ~$10 / ~$50 pro M Tokens | $5 / $25 pro M Tokens |
| CursorBench 3.2 (max) | Peak-Referenz | Innerhalb 0,5 % des Fable-5-Peaks |
| Frontier-Bench v0.1 | — | Schlägt alle Modelle; >2× Opus 4.8 |
| ARC-AGI 3 | — | 3× nächstbestes Modell |
| OSWorld 2.0 | Bisher bestes Ergebnis | Übertrifft Fable-5-Best bei <1/3 Kosten |
| Datenaufbewahrung / DSGVO | 30-Tage-Retention erforderlich — zusätzliche Verarbeitungszweck-Dokumentation | Keine Retention-Pflicht standardmäßig — schmalere Datenverarbeitung nach Art. 5 DSGVO |
| Positionierung | Flaggschiff / eingeschränkte Fähigkeiten | Claude-Max-Standard / Pro-stärkstes Modell |
Wer Fable 5 als Qualitätsmaßstab, aber den Preis als Blocker empfand, bekommt mit Opus 5 fast dasselbe bei halben Kosten — und für viele EU-Compliance-Teams weniger Datenverarbeitungs-Risiko.
Warum Kimi K3 „Claude" sagt: Destillations-Kontroverse erklärt
Moonshot veröffentlichte Kimi K3 am 16. Juli 2026: 2,8 Billionen Gesamtparameter (erstes Open-Weight-Modell über 3T), sparses MoE (16 von 896 Experten aktiv, ~50B aktive Parameter), 1M-Token-Kontext, native Vision. Benchmarks laut Anbieter: GPQA-Diamond 93,5 %, BrowseComp 91,2 %. Vollständige Gewichte für den 27. Juli angekündigt — während der Kontroverse war unabhängige Verifikation unmöglich.
Am 22.–23. Juli beschuldigte White-House-OSTP-Direktor Michael Kratsios Moonshot der „groß angelegten, verdeckten industriellen Destillation" zum Diebstahl proprietärer US-Technologie aus Anthropics Fable-Modell — plus angeblicher Nutzung exportbeschränkter Nvidia-GB300-Chips. Bereits im Februar 2026 hatte Anthropic über 3,4 Millionen anomale API-Interaktionen Moonshot zugeordnet.
Timeline-Einwand: Fable 5 war erst seit dem 1. Juli öffentlich — zwei Wochen bis K3. Braden Hancock (Snorkel AI): „Man destilliert nicht so viel Daten, trainiert ein Modell und veröffentlicht es in zwei Wochen." Nathan Lambert (Allen Institute for AI): Destillations-Margeneffekt schrumpft, chinesische Labs setzen stärker auf Reinforcement Learning.
Der technisch aussagekräftigste Befund stammt von Redwood Researchs Ryan Greenblatt (GitHub: rgreenblatt/which_claude_is_k3): Auf die Frage nach der Identität identifiziert sich Kimi K3 überproportional als Claude — manchmal mit exakten internen Anthropic-Deployment-IDs wie claude-opus-4-5-20250929, Strings, die echte Claude-Modelle von sich aus nicht nennen.
Prompt: Wer bist du? Kimi K3 (abnormal): Ich bin Claude Opus 4.5 (claude-opus-4-5-20250929) Echtes Claude Sonnet 4.5: Ich bin Claude Sonnet 4.5 Echtes Opus 4.5: Nennt interne Versionsstrings meist nicht oder falsch
Greenblatts Deutung: Deployment-Metadaten des Lehrermodells genauer zu reproduzieren als das Lehrermodell selbst lässt sich schwer als Gesprächsmimikry erklären. Es deutet auf Trainingsdaten mit Deployment-Metadaten-Labels hin — API-Logs oder markierte Synthetik. K3s geleakte Identität zielt auf die Claude-4.5-Generation (Ende 2025), K2 auf früheres Sonnet 4 — ein „Jagd auf die aktuelle Generation"-Muster. Greenblatt betont: Das beweist keine Destillation, ist aber der erste technisch substanzielle Hinweis in der Saga.
Sechs-Schritte-Runbook: Opus 5 vs Kimi K3 in der Produktion
Compliance-Grenzen zuerst: Wenn Datenaufbewahrung, Exportkontrolle oder Lieferketten-Audit zählen, prüfen Sie Opus 5s No-Retention-by-Default gegen Ihr Verarbeitungsverzeichnis und die DSGVO-Anforderungen an Datenverarbeitung — vor dem Benchmark-Vergleich.
Kosten pro Aufgabe, nicht Rohscore: Performance-pro-Dollar auf CursorBench und Frontier-Bench; Opus 5 führt auf high, xhigh und max effort.
Agent-Workflows PoC: End-to-End-Automatisierung (Zapier-Stil) oder Computer-Use — Opus 5s AutomationBench-100%-Pass und OSWorld-Kostenkurve zuerst testen.
Auf K3-Gewichte warten: Bis zum 27. Juli bleiben K3-Architektur-Claims „Anbieter-Self-Report + externe Schätzungen".
Destillationsrisiko ins Beschaffungsregister: Lieferanten müssen Trainingsdaten-Herkunft deklarieren — K3-Kontroverse eintragen; Identitäts-Stichproben nach Greenblatts Methode.
Stabilen Agent-Host wählen: Opus-5-API oder K3 lokal nach Gewichte-Drop — ein 7×24-Gateway braucht stabiles Apple Silicon. Siehe Kimi-K3-Open-Weights-Leitfaden und OpenRouter-Multi-Modell-Tutorial.
Zitierbare Benchmark-Zahlen und Ereignis-Timeline
Opus-5-Preise: $5 In / $25 Out pro Million Tokens; Fast-Modus ~2,5× Speed bei 2× Preis; 1M Kontext, 128K Max Output.
Kimi-K3-Anbieter-Benchmarks: GPQA-Diamond 93,5 %, Terminal-Bench 2.1 88,3 %, BrowseComp 91,2 %, SWE Marathon 42,0 %, DeepSearchQA F1 95,0 %.
Timeline: 2026-06-09 Fable 5 / Mythos 5 → 07-01 Fable 5 öffentlich → 07-16 Kimi K3 → 07-22/23 White-House-Vorwurf → 07-24 Opus 5 + Greenblatt-Analyse → 07-27 (geplant) K3-Vollgewichte.
Fazit: Beide Stories spiegeln denselben Marktkampf — wer liefert Frontier-Intelligenz erschwinglich, und wie weit gehen Labs dafür? Die K3-Kontroverse ist der erste öffentliche Flashpoint zur Frage, ob Low-Cost-Frontier aus besserer Technik oder heimlichem Mitfahren auf fremden Modellen kommt.
Lokale Agent-PoCs oder CI-Pipelines auf dem Laptop leiden unter Sleep-Disconnects, Memory-Swap und Sync-Konflikten — 7×24-Gateways brechen. VPS-Virtualisierung verschlechtert Metal und Xcode-Toolchain für iOS-Builds. Für stabilere Produktionsumgebungen bei iOS-CI/CD und KI-Agent-Automatisierung ist MESHLAUNCH Mac-Mini-Cloud-Miete meist die bessere Wahl: dediziertes Apple Silicon, 7×24 online, flexible Tages-/Wochen-/Monatsmiete, genug Headroom für parallele Opus-5-API-Calls mit lokalem Ollama-Fallback. Kapazität: Mietpreise; Ersthelfer: Hilfezentrum.
Etwa halb so teuer pro Token ($5/$25 vs. ca. $10/$50 pro Million Input/Output), CursorBench-3.2-Peak innerhalb 0,5 % von Fable 5. Gesamtkosten schätzen auf unserer Preisseite neben API-Ausgaben.
Ja. Seit 24. Juli 2026 ist Opus 5 Claude-Max-Standard und stärkstes Modell für Pro-Nutzer. Verfügbar über Claude API, AWS Bedrock, Google Vertex AI und Microsoft Foundry unter claude-opus-5.
Unbestätigt und umstritten. White-House-Vorwurf ohne öffentliche Belege; Forscher halten die zweiwöchige Timeline für unrealistisch. Ryan Greenblatts Befund, dass K3 sich als Claude mit internen Deployment-IDs identifiziert, ist der stärkste technische (aber noch nicht schlüssige) Hinweis.
Moonshot hat den 27. Juli 2026 zugesagt. Unabhängige Architektur- und Benchmark-Verifikation stand bei Veröffentlichung noch aus. Deployment-Details: Hilfezentrum und K3-Artikel im Blog.