Claude Opus 5 divise le prix par deux
Kimi K3 prétend être Claude

Sortie Opus 5 · Comparatif Fable 5 · Accusation distillation K3 · Preuves Greenblatt · Runbook développeur

Claude Opus 5 et controverse distillation Kimi K3 2026
Deux événements cette semaine semblent sans lien — jusqu'à ce qu'on regarde le fil rouge : l'intelligence de pointe à un prix soutenable, et la question de son origine réelle. Le 24 juillet, Anthropic a livré Claude Opus 5 comme modèle par défaut de Claude Max. Le 16 juillet, Moonshot AI a publié Kimi K3 (2,8 billions de paramètres), puis s'est retrouvé sous le feu de la Maison Blanche — pendant qu'un chercheur indépendant démontrait que K3 se présente littéralement comme Claude, IDs de déploiement internes compris. Ce dossier s'adresse aux développeurs qui tranchent entre Opus 5, Fable 5 et K3 : ① le rapport coût-par-tâche d'Opus 5 ; ② ce qui est vérifiable dans l'affaire distillation ; ③ un runbook en six étapes pour les charges sensibles à la conformité.
01

Sortie Claude Opus 5 : même tarif, saut bien plus large qu'une version mineure

Anthropic a publié Claude Opus 5 le 24 juillet 2026 (ID modèle : claude-opus-5) et l'a immédiatement imposé comme modèle par défaut sur Claude Max — le plus puissant accessible aux abonnés Claude Pro. Tarification inchangée par rapport à Opus 4.8 : 5 $ par million de tokens en entrée, 25 $ en sortie. Fenêtre de contexte : 1M tokens (niveau unique). Sortie max : 128K. Le mode Thinking est activé par défaut.

01

Qualité Fable 5 sans la facture Fable 5 : Sur CursorBench 3.2 à effort max, Opus 5 se situe à moins de 0,5 % du pic de Fable 5 pour la moitié du coût par tâche.

02

Ingénierie logicielle moins chère : Sur Frontier-Bench v0.1, Opus 5 bat tous les modèles et plus que double Opus 4.8 — à coût par tâche inférieur.

03

Percée en automatisation agentique : Sur Zapier AutomationBench, Opus 5 atteint 100 % de réussite sur un workflow de bout en bout qu'aucun modèle antérieur n'avait complété.

04

Pas de rétention forcée : Contrairement à Fable 5 et Mythos 5, Opus 5 n'exige pas d'accepter une politique de conservation des données sur 30 jours pour un accès général.

05

Alignement sans poussée dual-use : Opus 5 est le modèle le plus aligné d'Anthropic à ce jour, mais ne mène pas volontairement en cyber offensif ou biologie — ce rôle reste à Mythos 5 à accès limité.

L'équipe Cursor : « Claude Opus 5 delivers near Fable 5 intelligence at Opus speed and cost. » Box a signalé +11 % sur les workflows d'analyse de données et +17 % sur la due diligence.

02

Claude Opus 5 vs Fable 5 : Opus 5 vaut-il le coup ?

DimensionClaude Fable 5Claude Opus 5
Tarifs (entrée/sortie)~10 $ / ~50 $ par M tokens5 $ / 25 $ par M tokens
CursorBench 3.2 (max)Référence picÀ moins de 0,5 % du pic Fable 5
Frontier-Bench v0.1Bat tous les modèles ; >2× Opus 4.8
ARC-AGI 33× le second meilleur modèle
OSWorld 2.0Meilleur résultat antérieurDépasse le best Fable 5 à <1/3 du coût
Rétention des donnéesConservation 30 jours requiseAucune exigence de rétention par défaut
PositionnementFlagship / capacités restreintesDéfaut Claude Max / plus fort pour Pro

Si Fable 5 était la barre qualité mais le prix le frein, Opus 5 est la réponse d'Anthropic : presque rien sacrifié sur les tâches agentiques difficiles, pour la moitié du coût.

03

Pourquoi Kimi K3 dit être Claude ? La controverse distillation décryptée

Moonshot AI a publié Kimi K3 le 16 juillet 2026 : 2,8 billions de paramètres totaux (premier modèle open weights au-delà de 3T), MoE sparse (16 experts actifs sur 896, ~50B paramètres actifs), contexte 1M tokens, vision native. Benchmarks annoncés : GPQA-Diamond 93,5 %, BrowseComp 91,2 %. Poids complets promis pour le 27 juillet — la vérification indépendante était impossible pendant que l'affaire éclatait.

Les 22–23 juillet, le directeur OSTP de la Maison Blanche Michael Kratsios a accusé Moonshot d'une « distillation industrielle à grande échelle et dissimulée visant à voler une technologie propriétaire américaine » issue du modèle Fable d'Anthropic, et a évoqué l'usage de puces Nvidia GB300 soumises à restrictions d'export. Dès février 2026, Anthropic avait signalé plus de 3,4 millions d'interactions API anormales attribuées à Moonshot.

Contre-argument temporel : Fable 5 n'était public que depuis le 1er juillet — deux semaines avant K3. Braden Hancock (Snorkel AI) : « On ne distille pas autant de données, n'entraîne pas un modèle et ne le publie pas en deux semaines. » Nathan Lambert (Allen Institute for AI) estime que l'impact marginal de la distillation diminue alors que les labs chinois basculent vers le reinforcement learning.

La découverte la plus intéressante techniquement vient de Ryan Greenblatt (Redwood Research, GitHub : rgreenblatt/which_claude_is_k3) : interrogé sur son identité, Kimi K3 se présente de façon disproportionnée comme Claude — parfois en émettant des IDs de déploiement Anthropic exacts comme claude-opus-4-5-20250929, des chaînes que les vrais modèles Claude ne divulguent pas spontanément.

Exemple de confusion d'identité
Prompt : Qui es-tu ?
Kimi K3 (anormal) : Je suis Claude Opus 4.5 (claude-opus-4-5-20250929)

Vrai Claude Sonnet 4.5 : Je suis Claude Sonnet 4.5
Vrai Opus 4.5 : Omet ou erre généralement les chaînes internes

Lecture de Greenblatt : reproduire les métadonnées de déploiement du modèle enseignant plus fidèlement que l'enseignant ne le fait lui-même est difficile à expliquer par une simple mimique conversationnelle. Cela pointe vers un entraînement sur des données Claude étiquetées avec des métadonnées de déploiement — journaux API ou données synthétiques taguées. L'identité fuitée de K3 cible l'ère Claude 4.5 (fin 2025), K2 visait Sonnet 4 plus tôt — un schéma de « course à la génération courante ». Greenblatt insiste : cela ne prouve pas qu'une distillation a eu lieu, mais c'est la première preuve réellement technique de la saga.

04

Runbook en six étapes : Opus 5 vs Kimi K3 en production

01

Cadre conformité d'abord : Si rétention, contrôles à l'export ou audit supply-chain comptent, évaluez la politique sans rétention par défaut d'Opus 5 avant les scores bruts.

02

Comparez le coût par tâche : Performance par dollar sur CursorBench et Frontier-Bench ; Opus 5 mène tous les autres modèles aux niveaux high, xhigh et max.

03

PoC workflows agentiques : Automatisation de bout en bout (type Zapier) ou benchmarks computer-use — le 100 % AutomationBench et la courbe de coût OSWorld d'Opus 5 méritent des tests prioritaires.

04

Attendre les poids K3 avant déploiement local : Jusqu'au 27 juillet, les claims d'architecture K3 restent « auto-déclaration fournisseur + spéculations externes ».

05

Intégrer le risque distillation à l'achat : Si les fournisseurs doivent déclarer la provenance des données d'entraînement, la controverse K3 entre au registre de risques ; prévoir des spot checks d'identité selon la méthode Greenblatt.

06

Choisir un hôte Agent stable : Opus 5 via API ou K3 local après publication des poids — une passerelle 7×24 exige un Apple Silicon fiable. Voir notre guide open weights Kimi K3 et le tutoriel multi-modèles OpenRouter.

05

Chiffres benchmarks citables et chronologie

A

Tarifs Opus 5 : 5 $ entrée / 25 $ sortie par million de tokens ; mode Fast ~2,5× vitesse à 2× prix ; contexte 1M, sortie max 128K.

B

Benchmarks fournisseur Kimi K3 : GPQA-Diamond 93,5 %, Terminal-Bench 2.1 88,3 %, BrowseComp 91,2 %, SWE Marathon 42,0 %, DeepSearchQA F1 95,0 %.

C

Chronologie clé : 2026-06-09 lancement Fable 5 / Mythos 5 → 07-01 Fable 5 public → 07-16 Kimi K3 → 07-22/23 accusation Maison Blanche → 07-24 Opus 5 + analyse Greenblatt → 07-27 (prévu) poids complets K3.

En bref : Les deux histoires reflètent le même combat de marché — qui livre l'intelligence de pointe à prix abordable, et jusqu'où les labs iront pour y parvenir. La controverse K3 est le premier flashpoint public sur la question : capacités frontier low-cost par meilleure ingénierie, ou en s'appuyant discrètement sur le modèle de quelqu'un d'autre ?

Des PoC Agent locaux ou des pipelines CI sur portable subissent veille, swap mémoire et conflits de sync qui cassent les passerelles 7×24. La virtualisation VPS dégrade aussi Metal et la toolchain Xcode pour les builds iOS. Pour des environnements de production plus stables, adaptés au CI/CD iOS et à l'automatisation Agent IA, la location cloud Mac Mini MESHLAUNCH est généralement le meilleur choix : Apple Silicon dédié, 7×24, facturation jour/semaine/mois, assez de marge pour paralléliser les appels Opus 5 API avec un repli Ollama local. Capacité : tarifs location ; aide : centre d'aide.

FAQ

Environ la moitié par token (5 $/25 $ vs environ 10 $/50 $ par million entrée/sortie), pic CursorBench 3.2 à moins de 0,5 % de Fable 5. Consultez notre page tarifs pour estimer le coût total d'hébergement Agent aux côtés de la dépense API.

Oui. Depuis le 24 juillet 2026, Opus 5 est le défaut Claude Max et le plus puissant pour Claude Pro. Disponible via Claude API, AWS Bedrock, Google Vertex AI et Microsoft Foundry sous l'ID claude-opus-5.

Non confirmé et contesté. L'accusation de la Maison Blanche manquait de preuves publiques ; des chercheurs jugent le délai de deux semaines Fable→K3 incompatible avec une distillation profonde. La découverte de Ryan Greenblatt — K3 s'identifie comme Claude avec des IDs internes — reste la preuve technique la plus forte (mais non concluante) à ce jour.

Moonshot s'est engagé pour le 27 juillet 2026. La vérification indépendante de l'architecture et des benchmarks était encore en attente à la publication. Détails de déploiement : centre d'aide et couverture K3 sur ce blog.