En bref : Le 24 juillet 2026, Anthropic a livré Claude Opus 5 — à moins de 0,5 % de Fable 5 sur CursorBench 3.2 pour environ la moitié du coût, désormais modèle par défaut sur Claude Max avec aucune rétention de données imposée. Trois jours plus tard, la controverse de distillation Kimi K3 s'est intensifiée : Michael Kratsios, directeur OSTP de la Maison-Blanche, a accusé Moonshot de distillation industrielle, tandis que Ryan Greenblatt de Redwood Research a constaté que Kimi K3 se déclare Claude — y compris des IDs de déploiement internes comme claude-opus-4-5-20250929. Ce guide couvre les benchmarks et tarifs Claude Opus 5 vs Fable 5, pourquoi Kimi K3 s'identifie comme Claude, le scepticisme sur la chronologie de Moonshot a-t-il volé Claude, un guide de routage en six étapes pour les développeurs, et l'impact de la publication des poids le 27 juillet. Voir notre guide Kimi K3 open weights et guide de routage OpenRouter API.
01

Sortie de Claude Opus 5 : moitié du coût de Fable 5, désormais par défaut sur Claude Max

Anthropic a publié Claude Opus 5 le 24 juillet 2026 (heure du Pacifique US) et l'a immédiatement défini comme modèle par défaut sur Claude Max — le modèle le plus puissant disponible pour les abonnés Claude Pro. ID modèle : claude-opus-5. Disponible sur Claude API, AWS Bedrock, Google Vertex AI et Microsoft Foundry. Les tarifs restent à 5 $/M entrée et 25 $/M sortie — identiques à Opus 4.8 — tandis que les performances progressent sur les charges agentiques, code et recherche.

Le positionnement est délibéré : Opus 5 n'est pas le flagship. C'est le modèle quotidien qu'Anthropic souhaite voir réellement utilisé — intelligence proche de Fable sans tarification Fable ni exigence de rétention 30 jours de Fable.

SpecClaude Opus 5
Date de sortie24 juillet 2026
Tarification5 $/M entrée · 25 $/M sortie (comme Opus 4.8)
Fenêtre de contexte1M tokens (par défaut, seul tier)
Sortie max128K tokens
RaisonnementThinking activé par défaut ; paramètre Effort contrôle la profondeur
Rétention des donnéesAucune rétention imposée (vs Fable 5 / Mythos 5 opt-in 30 jours)
Mode rapide~2,5× vitesse, 2× prix (comme Opus 4.8)

Points saillants des benchmarks (Anthropic officiel) :

01

Frontier-Bench v0.1 : Bat tous les modèles ; 2×+ Opus 4.8 sur les tâches d'ingénierie logicielle à coût par tâche inférieur.

02

CursorBench 3.2 : À effort max, à moins de 0,5 % du pic Fable 5 — à moitié du coût. Meilleur rapport performance/dollar aux tiers high / xhigh / max.

03

ARC-AGI 3 : le modèle suivant sur la résolution de problèmes inédits.

04

OSWorld 2.0 : Bat le meilleur score Fable 5 avec à peine un tiers du coût.

05

Zapier AutomationBench : 100 % de réussite sur workflow account-health end-to-end — les modèles précédents : 0 %.

06

Recherche / sciences du vivant : +10,2 points sur inférence spectroscopie-vers-structure ; +7,7 sur prédiction de fonction de variantes protéiques. Box rapporte +8 % précision globale, +11 % analyse de données, +17 % due diligence.

Sécurité et alignement : L'audit comportemental automatisé d'Anthropic classe Opus 5 comme son modèle le mieux aligné à ce jour — taux de tromperie le plus bas, le plus difficile à inciter au mauvais usage, le plus sûr sur les actions difficiles à inverser. Opus 5 ne mène pas volontairement sur le risque cyber ou bio à double usage (Mythos 5 détient ce tier). Les classificateurs cyber interviennent ~85 % moins qu'avec Fable 5 — utilisable pour la découverte de vulnérabilités dans le code source, mais scan binaire, pentest et génération d'exploits restent bloqués.

02

Controverse de distillation Kimi K3 : accusations de la Maison-Blanche et le problème de chronologie de deux semaines

Moonshot AI a lancé Kimi K3 le 16 juillet 2026 — un modèle MoE sparse 2,8T paramètres (896 experts, 16 actifs), contexte 1M, vision native, basé sur Kimi Delta Attention. Poids complets promis pour le 27 juillet. Benchmarks solides : 93,5 % GPQA-Diamond, 91,2 % BrowseComp, K3 derrière seulement Fable 5 et GPT-5.6 Sol à une fraction du prix. Voir notre guide de sortie Kimi K3 open weights pour l'architecture et l'API.

Six jours plus tard, l'affaire devient géopolitique.

DateÉvénement
Fév 2026Anthropic accuse Moonshot, DeepSeek, MiniMax de distillation industrielle ; cite 3,4M+ appels API anormaux tracés vers la direction Moonshot via métadonnées de requête
1er juillet 2026Claude Fable 5 disponible publiquement (rollout auparavant restreint)
16 juillet 2026API Kimi K3 et produits en ligne
22–23 juillet 2026Michael Kratsios (OSTP Maison-Blanche) accuse Moonshot de « distillation industrielle à grande échelle et dissimulée » + puces Nvidia GB300 non licenciées via la Thaïlande
23 juillet 2026TechCrunch publie le scepticisme d'experts sur la chronologie de distillation
24 juillet 2026Ryan Greenblatt publie l'analyse statistique « K3 s'identifie comme Claude »
27 juillet 2026Publication prévue des poids K3 complets — vérification indépendante en attente

Les 22–23 juillet, Michael Kratsios (OSTP Maison-Blanche) a posté sur X accusant Moonshot de distillation visant à voler les capacités Fable d'Anthropic, plus l'usage présumé de puces Nvidia GB300 soumises à contrôle export via la Thaïlande. Le secrétaire au Trésor Scott Bessent a repris des allégations de « watermarks » LLM US sur des modèles chinois — sans préciser ce que cela signifie. Moonshot n'a pas répondu aux demandes sur le processus d'entraînement. Kratsios n'a fourni aucune preuve publique.

Fable 5 n'est publiquement disponible que depuis le 1er juillet. On ne peut pas distiller autant de données, entraîner un modèle et le publier en deux semaines. — Braden Hancock, co-fondateur Laude Institute / Snorkel AI

TechCrunch a interrogé plusieurs chercheurs indépendants qui ont contesté la controverse de distillation Kimi K3 sur la seule base de la chronologie. Nathan Lambert (Allen Institute for AI) a argué que la distillation offre des rendements décroissants alors que les labs chinois basculent vers le reinforcement learning — si la distillation seule expliquait K3, les concurrents auraient déjà cloné GLM ou K3. Elon Musk a témoigné que xAI a distillé des modèles OpenAI en construisant Grok, qualifiant la pratique de courante dans l'industrie. Le différend n'est pas de savoir si la distillation existe — c'est où « l'emprunt technique normal » s'arrête et où commence « le vol industriel dissimulé ».

Attention : Au 25 juillet, les poids K3 complets ne sont pas encore publics. Les chercheurs externes ne peuvent pas vérifier indépendamment le nombre de paramètres, l'architecture ou la reproduction des benchmarks — raison majeure pour laquelle la controverse reste non tranchée.

03

Pourquoi Kimi K3 dit-il être Claude ? Les preuves d'IDs de déploiement de Greenblatt

L'angle le plus substantiel techniquement dans le débat Moonshot a-t-il volé Claude n'est pas politique — il est comportemental. Vers le 24 juillet, Ryan Greenblatt, chief scientist de Redwood Research, a publié une analyse cross-entropy (GitHub : rgreenblatt/which_claude_is_k3) comparant les réponses aux prompts d'identité.

Constat : Kimi K3 s'auto-identifie de façon disproportionnée comme Claude — et pas vaguement. Il émet parfois des chaînes exactes d'IDs de déploiement internes Anthropic :

examples
claude-opus-4-5-20250929
claude-sonnet-4-5-20250929

Les vrais modèles Claude ne se comportent pas ainsi. Un Claude Sonnet 4.5 authentique dit « Je suis Claude Sonnet 4.5. » Opus 4.5 omet les chaînes de version ou se trompe. K3 reproduit les métadonnées de déploiement du teacher plus fidèlement que le teacher ne le fait lui-même — difficile à expliquer par la simple mimétique conversationnelle.

ModèleSignal d'auto-IDÈre verrouillée sur
Kimi K2Pointe vers Claude Sonnet 4Génération Claude mi-2025
Kimi K3Pointe vers IDs Claude Opus 4.5 / Sonnet 4.5Ère « Claude 4.5 » fin 2025 — pas Fable / Mythos
Vrais modèles ClaudeNoms produit lisibles uniquementLigne produit actuelle

Interprétation de Greenblatt : les données d'entraînement incluaient probablement des sorties Claude étiquetées avec métadonnées de déploiement — logs API ou données synthétiques taguées — une forme de distillation plus difficile à écarter que la copie de style générique. Le schéma générationnel (K2 → Sonnet 4, K3 → Opus 4.5) suggère que chaque release Kimi a absorbé la génération Claude courante au moment de l'entraînement.

01

Ce que cela suggère : Entraînement sur des données étiquetées Claude avec chaînes de déploiement internes — pas seulement des transcriptions de chat public.

02

Ce que cela NE prouve PAS : Greenblatt indique explicitement que ce n'est pas une preuve concluante de distillation — contamination, fuites de system prompts ou jeux de données synthétiques publics pourraient théoriquement expliquer la confusion d'identité.

03

Pourquoi cela compte : Première preuve technique (non politique) de la saga — plus forte que la rhétorique de la Maison-Blanche, plus faible qu'un log d'entraînement accablant.

04

Lecture communautaire (r/LocalLLaMA) : Enthousiasme que l'écart open/closed se mesure en jours ; plaisanteries sur 2,8T non exécutable localement ; pragmatiques disent que le vrai atout de K3 est prix + moins de refus, pas battre Fable 5.

Note de conformité : Utilisez « présumé », « selon l'analyse de Greenblatt » et « rapporté » en citant les allégations de distillation. La confusion d'identité est une preuve, pas un verdict.

04

Six étapes pour les développeurs : routage Opus 5 vs Fable 5 vs Kimi K3

ModèleEntrée ($/M)Sortie ($/M)ContexteRétention des données
Claude Opus 55,00 $25,00 $1MAucune exigée
Claude Fable 5~10,00 $~50,00 $1MOpt-in 30 jours requis
Kimi K33,00 $15,00 $1MConditions API Moonshot
GPT-5.6 Sol~5,00 $~15,00 $400KConditions OpenAI

Sur Claude Opus 5 vs Fable 5, l'écart CursorBench est de 0,5 % à effort max — l'écart de prix est ~50 %. Pour les charges sensibles à la conformité, le défaut sans rétention d'Opus 5 peut l'emporter sur l'avantage marginal de Fable. Routez via OpenRouter pour une facturation unifiée entre fournisseurs.

Six étapes opérationnelles :

01

Évaluer la conformité en premier : Si rétention des données, exposition au contrôle export ou provenance du fournisseur comptent, la politique sans rétention d'Opus 5 et le contrat Anthropic l'emportent sur K3 tant que Moonshot n'a pas répondu aux allégations de distillation. Fable 5 exige un opt-in de rétention 30 jours.

02

Comparer Opus 5 vs Fable 5 sur votre jeu d'évaluation : Exécuter des tâches code type CursorBench et votre propre harness agent. Opus 5 à 5 $/25 $ vs Fable à ~10 $/50 $ — valider que l'écart de 0,5 % est acceptable pour votre charge avant de payer les tarifs flagship.

03

Attendre les poids K3 du 27 juillet : Ne pas engager le routage production sur les claims d'architecture K3 tant que les poids Hugging Face ne sont pas publiés et que des équipes indépendantes n'ont pas reproduit les benchmarks. Accès API acceptable pour expérimentation ; décisions dépendantes de l'architecture, non.

04

Vérifier vous-même les constats de Greenblatt : Lancer des prompts d'identité contre K3, Fable 5 et Opus 5. Vérifier si K3 émet des IDs de déploiement sous votre configuration de system prompt. Documenter les résultats pour l'équipe conformité.

05

Routage multi-modèles : Code quotidien + agents → Opus 5 ; bugs repo frontier → Fable 5 ; bulk sensible au coût + contexte 1M → API K3 ; terminal-heavy → GPT-5.6 Sol. Ne pas tout miser sur un modèle pendant une semaine de controverse non résolue.

06

Surveiller l'évolution réglementaire : Suivre les restrictions US sur open weights, l'application du contrôle export puces et les conditions de licence Moonshot du 27 juillet. L'accusation Anthropic de février (3,4M appels) et l'escalade Maison-Blanche de juillet peuvent déclencher des changements de ToS API ou de politique de routage.

python
from openai import OpenAI

client = OpenAI(
    api_key="your_openrouter_key",
    base_url="https://openrouter.ai/api/v1"
)

response = client.chat.completions.create(
    model="anthropic/claude-opus-5",
    messages=[{"role": "user", "content": "Qui es-tu ? Réponds uniquement avec le nom et la version du modèle."}]
)
05

Guerre des prix, trois chiffres clés et ce que change le 27 juillet

Les deux histoires pointent vers le même basculement sectoriel : l'intelligence frontier se commoditise rapidement. Anthropic comble l'écart entre flagship et modèle quotidien en livrant Opus 5 aux tarifs Opus inchangés. Moonshot pousse open weights, contexte 1M flat et tarifs API agressifs — puis est accusé de s'appuyer sur les sorties de Claude. La controverse de distillation Kimi K3 est le premier point de rupture public d'une question que chaque lab affrontera : lorsqu'un acteur égale la frontier à une fraction du coût, s'agit-il d'un meilleur engineering ou d'une intelligence empruntée ?

ScénarioVoie recommandéePourquoi
Entreprise sensible à la conformitéAPI Claude Opus 5Aucune rétention imposée ; benchmarks proches de Fable ; clarté contractuelle Anthropic
Code frontier / bugs repoAPI Claude Fable 5FrontierSWE et GDPval v2 mènent quand le coût est secondaire
Expériences coût + contexte 1MAPI Kimi K3 (pre-7/27) → self-host post-7/273 $/15 $ avec tarif flat 1M ; vérifier les poids avant engagement
Risque de provenance non résoluAttendre le 27 juillet + audit indépendantPreuves Greenblatt suggestives, non concluantes ; poids débloquent vérification externe
Production agent multi-modèlesRoutage mixte OpenRouterCouche de facturation unique ; changer de modèle sans redéployer l'infra

Pour les développeurs : si conformité et rétention des données comptent, Opus 5 est la mise à niveau évidente cette semaine. Si le coût le plus bas l'emporte et que le risque de provenance est acceptable, reconsidérer K3 après le 27 juillet lorsque des tiers pourront confirmer les chiffres.

A

0,5 % / 50 % : Opus 5 à moins de 0,5 % de Fable 5 sur CursorBench 3.2 à effort max — à environ la moitié du coût par token (5 $/25 $ vs ~10 $/50 $).

B

3,4M / 2 semaines : L'accusation Anthropic de février cite 3,4M+ appels API anormaux ; disponibilité publique Fable 5 jusqu'au lancement K3 : ~2 semaines — argument central des sceptiques de chronologie.

C

2,8T / 27 juillet : K3 revendique 2,8T paramètres — plus grande release open weights en attente ; vérification externe conditionne tout le débat sur la distillation.

Synthèse : Opus 5 est la réponse pratique d'Anthropic à la guerre des prix — performance agentique near-flagship sans tarification Fable ni friction de rétention. La saga de distillation de K3 ajoute une question de provenance à une histoire coût déjà convaincante. Validez sur vos charges, exécutez des contrôles d'identité si la conformité l'exige, et traitez le 27 juillet comme le premier test réel des affirmations de Moonshot.

Les workflows agent multi-modèles sur Mac personnel subissent veille et coupures réseau sur jobs long contexte ; attendre le self-hosting du 27.7. requiert un supernœud 64+ accélérateurs que la plupart des équipes n'ont pas ; une seule API fermée rate l'avantage 1M flat pricing de K3. Pour CI/CD iOS, agents Claude Code / Kimi Code persistants et production IA 24/7, la location cloud Mac Mini M4 dédié KVMNODE est généralement le meilleur hôte : mémoire unifiée Apple Silicon, sudo ouvert, durées flexibles jour/semaine/mois. Voir page tarifs, centre d'aide ou commander directement.

Données au 25 juillet 2026 · Benchmarks incluant chiffres auto-déclarés Anthropic et Moonshot · Sources : anthropic.com/news/claude-opus-5, TechCrunch, Ryan Greenblatt GitHub (rgreenblatt/which_claude_is_k3), blog officiel Moonshot/Kimi, CNBC, The Verge, r/LocalLLaMA