Claude Opus 5 halbiert den Preis
Kimi K3 behauptet, Claude zu sein

Opus-5-Launch · Fable-5-Vergleich · K3-Destillation · Greenblatt-Beweise · DSGVO-Runbook

Claude Opus 5 und Kimi K3 Destillations-Kontroverse 2026
Zwei Schlagzeilen dominieren diese Woche — und beide drehen sich um dieselbe Frage: Woher kommt Frontier-Intelligenz zum erschwinglichen Preis? Am 24. Juli 2026 setzte Anthropic Claude Opus 5 als Claude-Max-Standard. Am 16. Juli veröffentlichte Moonshot Kimi K3 (2,8 Billionen Parameter) und geriet ins Visier des Weißen Hauses — während Forscher entdeckten, dass K3 sich als Claude ausgibt, interne Deployment-IDs inklusive. Für Teams in der EU zählt dabei nicht nur der Benchmark: ① Opus-5-Kosten pro Aufgabe vs. Fable 5; ② was an der K3-Destillationsstory überprüfbar ist; ③ ein Sechs-Schritte-Runbook mit DSGVO-konformer Datenverarbeitung als Erstkriterium.
01

Claude Opus 5: mehr als ein Point Release — zum halben Fable-Preis

Anthropic veröffentlichte Claude Opus 5 am 24. Juli 2026 (Modell-ID: claude-opus-5) und machte es sofort zum Claude-Max-Standard — das stärkste Modell, das Claude-Pro-Abonnenten nutzen können. Preise unverändert gegenüber Opus 4.8: $5 pro Million Input-Tokens, $25 pro Million Output-Tokens. Kontextfenster: 1M Tokens (eine Stufe). Max Output: 128K. Thinking standardmäßig aktiv.

01

Fable-5-Nähe ohne Fable-Rechnung: CursorBench 3.2 max effort — Opus 5 liegt 0,5 % unter Fable-5-Peak, kostet aber halb so viel pro Aufgabe.

02

Software-Engineering günstiger: Frontier-Bench v0.1 — Opus 5 schlägt alle Modelle und mehr als verdoppelt Opus 4.8 bei niedrigeren Kosten pro Task.

03

Agent-Automatisierung: Zapier AutomationBench — Opus 5 erreicht 100 % Pass-Rate bei einem End-to-End-Workflow, den kein Vorgängermodell schaffte.

04

Keine erzwungene Speicherfrist: Anders als Fable 5 und Mythos 5 verlangt Opus 5 kein Opt-in in eine 30-Tage-Datenaufbewahrung. Für EU-Teams vereinfacht das die DSGVO-Dokumentation der Datenverarbeitung — weniger Aufbewahrungszwang bedeutet klarere Löschfristen und schmalere Verarbeitungsverzeichnisse.

05

Ausrichtung ohne Dual-Use-Front: Opus 5 ist Anthropics bisher am besten ausgerichtetes Modell, führt aber bewusst nicht bei Offensive-Cyber oder Biologie — das bleibt dem limitierten Mythos 5 vorbehalten.

Cursor-Team: „Claude Opus 5 delivers near Fable 5 intelligence at Opus speed and cost." Box meldete +11 % bei Datenanalyse-Workflows und +17 % bei Due-Diligence-Szenarien.

02

Opus 5 oder Fable 5? Vergleichstabelle für Entscheider

DimensionClaude Fable 5Claude Opus 5
Preis (In/Out)~$10 / ~$50 pro M Tokens$5 / $25 pro M Tokens
CursorBench 3.2 (max)Peak-ReferenzInnerhalb 0,5 % des Fable-5-Peaks
Frontier-Bench v0.1Schlägt alle Modelle; >2× Opus 4.8
ARC-AGI 33× nächstbestes Modell
OSWorld 2.0Bisher bestes ErgebnisÜbertrifft Fable-5-Best bei <1/3 Kosten
Datenaufbewahrung / DSGVO30-Tage-Retention erforderlich — zusätzliche Verarbeitungszweck-DokumentationKeine Retention-Pflicht standardmäßig — schmalere Datenverarbeitung nach Art. 5 DSGVO
PositionierungFlaggschiff / eingeschränkte FähigkeitenClaude-Max-Standard / Pro-stärkstes Modell

Wer Fable 5 als Qualitätsmaßstab, aber den Preis als Blocker empfand, bekommt mit Opus 5 fast dasselbe bei halben Kosten — und für viele EU-Compliance-Teams weniger Datenverarbeitungs-Risiko.

03

Warum Kimi K3 „Claude" sagt: Destillations-Kontroverse erklärt

Moonshot veröffentlichte Kimi K3 am 16. Juli 2026: 2,8 Billionen Gesamtparameter (erstes Open-Weight-Modell über 3T), sparses MoE (16 von 896 Experten aktiv, ~50B aktive Parameter), 1M-Token-Kontext, native Vision. Benchmarks laut Anbieter: GPQA-Diamond 93,5 %, BrowseComp 91,2 %. Vollständige Gewichte für den 27. Juli angekündigt — während der Kontroverse war unabhängige Verifikation unmöglich.

Am 22.–23. Juli beschuldigte White-House-OSTP-Direktor Michael Kratsios Moonshot der „groß angelegten, verdeckten industriellen Destillation" zum Diebstahl proprietärer US-Technologie aus Anthropics Fable-Modell — plus angeblicher Nutzung exportbeschränkter Nvidia-GB300-Chips. Bereits im Februar 2026 hatte Anthropic über 3,4 Millionen anomale API-Interaktionen Moonshot zugeordnet.

Timeline-Einwand: Fable 5 war erst seit dem 1. Juli öffentlich — zwei Wochen bis K3. Braden Hancock (Snorkel AI): „Man destilliert nicht so viel Daten, trainiert ein Modell und veröffentlicht es in zwei Wochen." Nathan Lambert (Allen Institute for AI): Destillations-Margeneffekt schrumpft, chinesische Labs setzen stärker auf Reinforcement Learning.

Der technisch aussagekräftigste Befund stammt von Redwood Researchs Ryan Greenblatt (GitHub: rgreenblatt/which_claude_is_k3): Auf die Frage nach der Identität identifiziert sich Kimi K3 überproportional als Claude — manchmal mit exakten internen Anthropic-Deployment-IDs wie claude-opus-4-5-20250929, Strings, die echte Claude-Modelle von sich aus nicht nennen.

Identitätsverwechslung
Prompt: Wer bist du?
Kimi K3 (abnormal): Ich bin Claude Opus 4.5 (claude-opus-4-5-20250929)

Echtes Claude Sonnet 4.5: Ich bin Claude Sonnet 4.5
Echtes Opus 4.5: Nennt interne Versionsstrings meist nicht oder falsch

Greenblatts Deutung: Deployment-Metadaten des Lehrermodells genauer zu reproduzieren als das Lehrermodell selbst lässt sich schwer als Gesprächsmimikry erklären. Es deutet auf Trainingsdaten mit Deployment-Metadaten-Labels hin — API-Logs oder markierte Synthetik. K3s geleakte Identität zielt auf die Claude-4.5-Generation (Ende 2025), K2 auf früheres Sonnet 4 — ein „Jagd auf die aktuelle Generation"-Muster. Greenblatt betont: Das beweist keine Destillation, ist aber der erste technisch substanzielle Hinweis in der Saga.

04

Sechs-Schritte-Runbook: Opus 5 vs Kimi K3 in der Produktion

01

Compliance-Grenzen zuerst: Wenn Datenaufbewahrung, Exportkontrolle oder Lieferketten-Audit zählen, prüfen Sie Opus 5s No-Retention-by-Default gegen Ihr Verarbeitungsverzeichnis und die DSGVO-Anforderungen an Datenverarbeitung — vor dem Benchmark-Vergleich.

02

Kosten pro Aufgabe, nicht Rohscore: Performance-pro-Dollar auf CursorBench und Frontier-Bench; Opus 5 führt auf high, xhigh und max effort.

03

Agent-Workflows PoC: End-to-End-Automatisierung (Zapier-Stil) oder Computer-Use — Opus 5s AutomationBench-100%-Pass und OSWorld-Kostenkurve zuerst testen.

04

Auf K3-Gewichte warten: Bis zum 27. Juli bleiben K3-Architektur-Claims „Anbieter-Self-Report + externe Schätzungen".

05

Destillationsrisiko ins Beschaffungsregister: Lieferanten müssen Trainingsdaten-Herkunft deklarieren — K3-Kontroverse eintragen; Identitäts-Stichproben nach Greenblatts Methode.

06

Stabilen Agent-Host wählen: Opus-5-API oder K3 lokal nach Gewichte-Drop — ein 7×24-Gateway braucht stabiles Apple Silicon. Siehe Kimi-K3-Open-Weights-Leitfaden und OpenRouter-Multi-Modell-Tutorial.

05

Zitierbare Benchmark-Zahlen und Ereignis-Timeline

A

Opus-5-Preise: $5 In / $25 Out pro Million Tokens; Fast-Modus ~2,5× Speed bei 2× Preis; 1M Kontext, 128K Max Output.

B

Kimi-K3-Anbieter-Benchmarks: GPQA-Diamond 93,5 %, Terminal-Bench 2.1 88,3 %, BrowseComp 91,2 %, SWE Marathon 42,0 %, DeepSearchQA F1 95,0 %.

C

Timeline: 2026-06-09 Fable 5 / Mythos 5 → 07-01 Fable 5 öffentlich → 07-16 Kimi K3 → 07-22/23 White-House-Vorwurf → 07-24 Opus 5 + Greenblatt-Analyse → 07-27 (geplant) K3-Vollgewichte.

Fazit: Beide Stories spiegeln denselben Marktkampf — wer liefert Frontier-Intelligenz erschwinglich, und wie weit gehen Labs dafür? Die K3-Kontroverse ist der erste öffentliche Flashpoint zur Frage, ob Low-Cost-Frontier aus besserer Technik oder heimlichem Mitfahren auf fremden Modellen kommt.

Lokale Agent-PoCs oder CI-Pipelines auf dem Laptop leiden unter Sleep-Disconnects, Memory-Swap und Sync-Konflikten — 7×24-Gateways brechen. VPS-Virtualisierung verschlechtert Metal und Xcode-Toolchain für iOS-Builds. Für stabilere Produktionsumgebungen bei iOS-CI/CD und KI-Agent-Automatisierung ist MESHLAUNCH Mac-Mini-Cloud-Miete meist die bessere Wahl: dediziertes Apple Silicon, 7×24 online, flexible Tages-/Wochen-/Monatsmiete, genug Headroom für parallele Opus-5-API-Calls mit lokalem Ollama-Fallback. Kapazität: Mietpreise; Ersthelfer: Hilfezentrum.

FAQ

Etwa halb so teuer pro Token ($5/$25 vs. ca. $10/$50 pro Million Input/Output), CursorBench-3.2-Peak innerhalb 0,5 % von Fable 5. Gesamtkosten schätzen auf unserer Preisseite neben API-Ausgaben.

Ja. Seit 24. Juli 2026 ist Opus 5 Claude-Max-Standard und stärkstes Modell für Pro-Nutzer. Verfügbar über Claude API, AWS Bedrock, Google Vertex AI und Microsoft Foundry unter claude-opus-5.

Unbestätigt und umstritten. White-House-Vorwurf ohne öffentliche Belege; Forscher halten die zweiwöchige Timeline für unrealistisch. Ryan Greenblatts Befund, dass K3 sich als Claude mit internen Deployment-IDs identifiziert, ist der stärkste technische (aber noch nicht schlüssige) Hinweis.

Moonshot hat den 27. Juli 2026 zugesagt. Unabhängige Architektur- und Benchmark-Verifikation stand bei Veröffentlichung noch aus. Deployment-Details: Hilfezentrum und K3-Artikel im Blog.