Sortie Claude Opus 5 : même tarif, saut bien plus large qu'une version mineure
Anthropic a publié Claude Opus 5 le 24 juillet 2026 (ID modèle : claude-opus-5) et l'a immédiatement imposé comme modèle par défaut sur Claude Max — le plus puissant accessible aux abonnés Claude Pro. Tarification inchangée par rapport à Opus 4.8 : 5 $ par million de tokens en entrée, 25 $ en sortie. Fenêtre de contexte : 1M tokens (niveau unique). Sortie max : 128K. Le mode Thinking est activé par défaut.
Qualité Fable 5 sans la facture Fable 5 : Sur CursorBench 3.2 à effort max, Opus 5 se situe à moins de 0,5 % du pic de Fable 5 pour la moitié du coût par tâche.
Ingénierie logicielle moins chère : Sur Frontier-Bench v0.1, Opus 5 bat tous les modèles et plus que double Opus 4.8 — à coût par tâche inférieur.
Percée en automatisation agentique : Sur Zapier AutomationBench, Opus 5 atteint 100 % de réussite sur un workflow de bout en bout qu'aucun modèle antérieur n'avait complété.
Pas de rétention forcée : Contrairement à Fable 5 et Mythos 5, Opus 5 n'exige pas d'accepter une politique de conservation des données sur 30 jours pour un accès général.
Alignement sans poussée dual-use : Opus 5 est le modèle le plus aligné d'Anthropic à ce jour, mais ne mène pas volontairement en cyber offensif ou biologie — ce rôle reste à Mythos 5 à accès limité.
L'équipe Cursor : « Claude Opus 5 delivers near Fable 5 intelligence at Opus speed and cost. » Box a signalé +11 % sur les workflows d'analyse de données et +17 % sur la due diligence.
Claude Opus 5 vs Fable 5 : Opus 5 vaut-il le coup ?
| Dimension | Claude Fable 5 | Claude Opus 5 |
|---|---|---|
| Tarifs (entrée/sortie) | ~10 $ / ~50 $ par M tokens | 5 $ / 25 $ par M tokens |
| CursorBench 3.2 (max) | Référence pic | À moins de 0,5 % du pic Fable 5 |
| Frontier-Bench v0.1 | — | Bat tous les modèles ; >2× Opus 4.8 |
| ARC-AGI 3 | — | 3× le second meilleur modèle |
| OSWorld 2.0 | Meilleur résultat antérieur | Dépasse le best Fable 5 à <1/3 du coût |
| Rétention des données | Conservation 30 jours requise | Aucune exigence de rétention par défaut |
| Positionnement | Flagship / capacités restreintes | Défaut Claude Max / plus fort pour Pro |
Si Fable 5 était la barre qualité mais le prix le frein, Opus 5 est la réponse d'Anthropic : presque rien sacrifié sur les tâches agentiques difficiles, pour la moitié du coût.
Pourquoi Kimi K3 dit être Claude ? La controverse distillation décryptée
Moonshot AI a publié Kimi K3 le 16 juillet 2026 : 2,8 billions de paramètres totaux (premier modèle open weights au-delà de 3T), MoE sparse (16 experts actifs sur 896, ~50B paramètres actifs), contexte 1M tokens, vision native. Benchmarks annoncés : GPQA-Diamond 93,5 %, BrowseComp 91,2 %. Poids complets promis pour le 27 juillet — la vérification indépendante était impossible pendant que l'affaire éclatait.
Les 22–23 juillet, le directeur OSTP de la Maison Blanche Michael Kratsios a accusé Moonshot d'une « distillation industrielle à grande échelle et dissimulée visant à voler une technologie propriétaire américaine » issue du modèle Fable d'Anthropic, et a évoqué l'usage de puces Nvidia GB300 soumises à restrictions d'export. Dès février 2026, Anthropic avait signalé plus de 3,4 millions d'interactions API anormales attribuées à Moonshot.
Contre-argument temporel : Fable 5 n'était public que depuis le 1er juillet — deux semaines avant K3. Braden Hancock (Snorkel AI) : « On ne distille pas autant de données, n'entraîne pas un modèle et ne le publie pas en deux semaines. » Nathan Lambert (Allen Institute for AI) estime que l'impact marginal de la distillation diminue alors que les labs chinois basculent vers le reinforcement learning.
La découverte la plus intéressante techniquement vient de Ryan Greenblatt (Redwood Research, GitHub : rgreenblatt/which_claude_is_k3) : interrogé sur son identité, Kimi K3 se présente de façon disproportionnée comme Claude — parfois en émettant des IDs de déploiement Anthropic exacts comme claude-opus-4-5-20250929, des chaînes que les vrais modèles Claude ne divulguent pas spontanément.
Prompt : Qui es-tu ? Kimi K3 (anormal) : Je suis Claude Opus 4.5 (claude-opus-4-5-20250929) Vrai Claude Sonnet 4.5 : Je suis Claude Sonnet 4.5 Vrai Opus 4.5 : Omet ou erre généralement les chaînes internes
Lecture de Greenblatt : reproduire les métadonnées de déploiement du modèle enseignant plus fidèlement que l'enseignant ne le fait lui-même est difficile à expliquer par une simple mimique conversationnelle. Cela pointe vers un entraînement sur des données Claude étiquetées avec des métadonnées de déploiement — journaux API ou données synthétiques taguées. L'identité fuitée de K3 cible l'ère Claude 4.5 (fin 2025), K2 visait Sonnet 4 plus tôt — un schéma de « course à la génération courante ». Greenblatt insiste : cela ne prouve pas qu'une distillation a eu lieu, mais c'est la première preuve réellement technique de la saga.
Runbook en six étapes : Opus 5 vs Kimi K3 en production
Cadre conformité d'abord : Si rétention, contrôles à l'export ou audit supply-chain comptent, évaluez la politique sans rétention par défaut d'Opus 5 avant les scores bruts.
Comparez le coût par tâche : Performance par dollar sur CursorBench et Frontier-Bench ; Opus 5 mène tous les autres modèles aux niveaux high, xhigh et max.
PoC workflows agentiques : Automatisation de bout en bout (type Zapier) ou benchmarks computer-use — le 100 % AutomationBench et la courbe de coût OSWorld d'Opus 5 méritent des tests prioritaires.
Attendre les poids K3 avant déploiement local : Jusqu'au 27 juillet, les claims d'architecture K3 restent « auto-déclaration fournisseur + spéculations externes ».
Intégrer le risque distillation à l'achat : Si les fournisseurs doivent déclarer la provenance des données d'entraînement, la controverse K3 entre au registre de risques ; prévoir des spot checks d'identité selon la méthode Greenblatt.
Choisir un hôte Agent stable : Opus 5 via API ou K3 local après publication des poids — une passerelle 7×24 exige un Apple Silicon fiable. Voir notre guide open weights Kimi K3 et le tutoriel multi-modèles OpenRouter.
Chiffres benchmarks citables et chronologie
Tarifs Opus 5 : 5 $ entrée / 25 $ sortie par million de tokens ; mode Fast ~2,5× vitesse à 2× prix ; contexte 1M, sortie max 128K.
Benchmarks fournisseur Kimi K3 : GPQA-Diamond 93,5 %, Terminal-Bench 2.1 88,3 %, BrowseComp 91,2 %, SWE Marathon 42,0 %, DeepSearchQA F1 95,0 %.
Chronologie clé : 2026-06-09 lancement Fable 5 / Mythos 5 → 07-01 Fable 5 public → 07-16 Kimi K3 → 07-22/23 accusation Maison Blanche → 07-24 Opus 5 + analyse Greenblatt → 07-27 (prévu) poids complets K3.
En bref : Les deux histoires reflètent le même combat de marché — qui livre l'intelligence de pointe à prix abordable, et jusqu'où les labs iront pour y parvenir. La controverse K3 est le premier flashpoint public sur la question : capacités frontier low-cost par meilleure ingénierie, ou en s'appuyant discrètement sur le modèle de quelqu'un d'autre ?
Des PoC Agent locaux ou des pipelines CI sur portable subissent veille, swap mémoire et conflits de sync qui cassent les passerelles 7×24. La virtualisation VPS dégrade aussi Metal et la toolchain Xcode pour les builds iOS. Pour des environnements de production plus stables, adaptés au CI/CD iOS et à l'automatisation Agent IA, la location cloud Mac Mini MESHLAUNCH est généralement le meilleur choix : Apple Silicon dédié, 7×24, facturation jour/semaine/mois, assez de marge pour paralléliser les appels Opus 5 API avec un repli Ollama local. Capacité : tarifs location ; aide : centre d'aide.
Environ la moitié par token (5 $/25 $ vs environ 10 $/50 $ par million entrée/sortie), pic CursorBench 3.2 à moins de 0,5 % de Fable 5. Consultez notre page tarifs pour estimer le coût total d'hébergement Agent aux côtés de la dépense API.
Oui. Depuis le 24 juillet 2026, Opus 5 est le défaut Claude Max et le plus puissant pour Claude Pro. Disponible via Claude API, AWS Bedrock, Google Vertex AI et Microsoft Foundry sous l'ID claude-opus-5.
Non confirmé et contesté. L'accusation de la Maison Blanche manquait de preuves publiques ; des chercheurs jugent le délai de deux semaines Fable→K3 incompatible avec une distillation profonde. La découverte de Ryan Greenblatt — K3 s'identifie comme Claude avec des IDs internes — reste la preuve technique la plus forte (mais non concluante) à ce jour.
Moonshot s'est engagé pour le 27 juillet 2026. La vérification indépendante de l'architecture et des benchmarks était encore en attente à la publication. Détails de déploiement : centre d'aide et couverture K3 sur ce blog.