claude-opus-4-5-20250929. Ce guide couvre les benchmarks et tarifs Claude Opus 5 vs Fable 5, pourquoi Kimi K3 s'identifie comme Claude, le scepticisme sur la chronologie de Moonshot a-t-il volé Claude, un guide de routage en six étapes pour les développeurs, et l'impact de la publication des poids le 27 juillet. Voir notre guide Kimi K3 open weights et guide de routage OpenRouter API.Sortie de Claude Opus 5 : moitié du coût de Fable 5, désormais par défaut sur Claude Max
Anthropic a publié Claude Opus 5 le 24 juillet 2026 (heure du Pacifique US) et l'a immédiatement défini comme modèle par défaut sur Claude Max — le modèle le plus puissant disponible pour les abonnés Claude Pro. ID modèle : claude-opus-5. Disponible sur Claude API, AWS Bedrock, Google Vertex AI et Microsoft Foundry. Les tarifs restent à 5 $/M entrée et 25 $/M sortie — identiques à Opus 4.8 — tandis que les performances progressent sur les charges agentiques, code et recherche.
Le positionnement est délibéré : Opus 5 n'est pas le flagship. C'est le modèle quotidien qu'Anthropic souhaite voir réellement utilisé — intelligence proche de Fable sans tarification Fable ni exigence de rétention 30 jours de Fable.
| Spec | Claude Opus 5 |
|---|---|
| Date de sortie | 24 juillet 2026 |
| Tarification | 5 $/M entrée · 25 $/M sortie (comme Opus 4.8) |
| Fenêtre de contexte | 1M tokens (par défaut, seul tier) |
| Sortie max | 128K tokens |
| Raisonnement | Thinking activé par défaut ; paramètre Effort contrôle la profondeur |
| Rétention des données | Aucune rétention imposée (vs Fable 5 / Mythos 5 opt-in 30 jours) |
| Mode rapide | ~2,5× vitesse, 2× prix (comme Opus 4.8) |
Points saillants des benchmarks (Anthropic officiel) :
Frontier-Bench v0.1 : Bat tous les modèles ; 2×+ Opus 4.8 sur les tâches d'ingénierie logicielle à coût par tâche inférieur.
CursorBench 3.2 : À effort max, à moins de 0,5 % du pic Fable 5 — à moitié du coût. Meilleur rapport performance/dollar aux tiers high / xhigh / max.
ARC-AGI 3 : 3× le modèle suivant sur la résolution de problèmes inédits.
OSWorld 2.0 : Bat le meilleur score Fable 5 avec à peine un tiers du coût.
Zapier AutomationBench : 100 % de réussite sur workflow account-health end-to-end — les modèles précédents : 0 %.
Recherche / sciences du vivant : +10,2 points sur inférence spectroscopie-vers-structure ; +7,7 sur prédiction de fonction de variantes protéiques. Box rapporte +8 % précision globale, +11 % analyse de données, +17 % due diligence.
Sécurité et alignement : L'audit comportemental automatisé d'Anthropic classe Opus 5 comme son modèle le mieux aligné à ce jour — taux de tromperie le plus bas, le plus difficile à inciter au mauvais usage, le plus sûr sur les actions difficiles à inverser. Opus 5 ne mène pas volontairement sur le risque cyber ou bio à double usage (Mythos 5 détient ce tier). Les classificateurs cyber interviennent ~85 % moins qu'avec Fable 5 — utilisable pour la découverte de vulnérabilités dans le code source, mais scan binaire, pentest et génération d'exploits restent bloqués.
Controverse de distillation Kimi K3 : accusations de la Maison-Blanche et le problème de chronologie de deux semaines
Moonshot AI a lancé Kimi K3 le 16 juillet 2026 — un modèle MoE sparse 2,8T paramètres (896 experts, 16 actifs), contexte 1M, vision native, basé sur Kimi Delta Attention. Poids complets promis pour le 27 juillet. Benchmarks solides : 93,5 % GPQA-Diamond, 91,2 % BrowseComp, K3 derrière seulement Fable 5 et GPT-5.6 Sol à une fraction du prix. Voir notre guide de sortie Kimi K3 open weights pour l'architecture et l'API.
Six jours plus tard, l'affaire devient géopolitique.
| Date | Événement |
|---|---|
| Fév 2026 | Anthropic accuse Moonshot, DeepSeek, MiniMax de distillation industrielle ; cite 3,4M+ appels API anormaux tracés vers la direction Moonshot via métadonnées de requête |
| 1er juillet 2026 | Claude Fable 5 disponible publiquement (rollout auparavant restreint) |
| 16 juillet 2026 | API Kimi K3 et produits en ligne |
| 22–23 juillet 2026 | Michael Kratsios (OSTP Maison-Blanche) accuse Moonshot de « distillation industrielle à grande échelle et dissimulée » + puces Nvidia GB300 non licenciées via la Thaïlande |
| 23 juillet 2026 | TechCrunch publie le scepticisme d'experts sur la chronologie de distillation |
| 24 juillet 2026 | Ryan Greenblatt publie l'analyse statistique « K3 s'identifie comme Claude » |
| 27 juillet 2026 | Publication prévue des poids K3 complets — vérification indépendante en attente |
Les 22–23 juillet, Michael Kratsios (OSTP Maison-Blanche) a posté sur X accusant Moonshot de distillation visant à voler les capacités Fable d'Anthropic, plus l'usage présumé de puces Nvidia GB300 soumises à contrôle export via la Thaïlande. Le secrétaire au Trésor Scott Bessent a repris des allégations de « watermarks » LLM US sur des modèles chinois — sans préciser ce que cela signifie. Moonshot n'a pas répondu aux demandes sur le processus d'entraînement. Kratsios n'a fourni aucune preuve publique.
Fable 5 n'est publiquement disponible que depuis le 1er juillet. On ne peut pas distiller autant de données, entraîner un modèle et le publier en deux semaines. — Braden Hancock, co-fondateur Laude Institute / Snorkel AI
TechCrunch a interrogé plusieurs chercheurs indépendants qui ont contesté la controverse de distillation Kimi K3 sur la seule base de la chronologie. Nathan Lambert (Allen Institute for AI) a argué que la distillation offre des rendements décroissants alors que les labs chinois basculent vers le reinforcement learning — si la distillation seule expliquait K3, les concurrents auraient déjà cloné GLM ou K3. Elon Musk a témoigné que xAI a distillé des modèles OpenAI en construisant Grok, qualifiant la pratique de courante dans l'industrie. Le différend n'est pas de savoir si la distillation existe — c'est où « l'emprunt technique normal » s'arrête et où commence « le vol industriel dissimulé ».
Attention : Au 25 juillet, les poids K3 complets ne sont pas encore publics. Les chercheurs externes ne peuvent pas vérifier indépendamment le nombre de paramètres, l'architecture ou la reproduction des benchmarks — raison majeure pour laquelle la controverse reste non tranchée.
Pourquoi Kimi K3 dit-il être Claude ? Les preuves d'IDs de déploiement de Greenblatt
L'angle le plus substantiel techniquement dans le débat Moonshot a-t-il volé Claude n'est pas politique — il est comportemental. Vers le 24 juillet, Ryan Greenblatt, chief scientist de Redwood Research, a publié une analyse cross-entropy (GitHub : rgreenblatt/which_claude_is_k3) comparant les réponses aux prompts d'identité.
Constat : Kimi K3 s'auto-identifie de façon disproportionnée comme Claude — et pas vaguement. Il émet parfois des chaînes exactes d'IDs de déploiement internes Anthropic :
claude-opus-4-5-20250929 claude-sonnet-4-5-20250929
Les vrais modèles Claude ne se comportent pas ainsi. Un Claude Sonnet 4.5 authentique dit « Je suis Claude Sonnet 4.5. » Opus 4.5 omet les chaînes de version ou se trompe. K3 reproduit les métadonnées de déploiement du teacher plus fidèlement que le teacher ne le fait lui-même — difficile à expliquer par la simple mimétique conversationnelle.
| Modèle | Signal d'auto-ID | Ère verrouillée sur |
|---|---|---|
| Kimi K2 | Pointe vers Claude Sonnet 4 | Génération Claude mi-2025 |
| Kimi K3 | Pointe vers IDs Claude Opus 4.5 / Sonnet 4.5 | Ère « Claude 4.5 » fin 2025 — pas Fable / Mythos |
| Vrais modèles Claude | Noms produit lisibles uniquement | Ligne produit actuelle |
Interprétation de Greenblatt : les données d'entraînement incluaient probablement des sorties Claude étiquetées avec métadonnées de déploiement — logs API ou données synthétiques taguées — une forme de distillation plus difficile à écarter que la copie de style générique. Le schéma générationnel (K2 → Sonnet 4, K3 → Opus 4.5) suggère que chaque release Kimi a absorbé la génération Claude courante au moment de l'entraînement.
Ce que cela suggère : Entraînement sur des données étiquetées Claude avec chaînes de déploiement internes — pas seulement des transcriptions de chat public.
Ce que cela NE prouve PAS : Greenblatt indique explicitement que ce n'est pas une preuve concluante de distillation — contamination, fuites de system prompts ou jeux de données synthétiques publics pourraient théoriquement expliquer la confusion d'identité.
Pourquoi cela compte : Première preuve technique (non politique) de la saga — plus forte que la rhétorique de la Maison-Blanche, plus faible qu'un log d'entraînement accablant.
Lecture communautaire (r/LocalLLaMA) : Enthousiasme que l'écart open/closed se mesure en jours ; plaisanteries sur 2,8T non exécutable localement ; pragmatiques disent que le vrai atout de K3 est prix + moins de refus, pas battre Fable 5.
Note de conformité : Utilisez « présumé », « selon l'analyse de Greenblatt » et « rapporté » en citant les allégations de distillation. La confusion d'identité est une preuve, pas un verdict.
Six étapes pour les développeurs : routage Opus 5 vs Fable 5 vs Kimi K3
| Modèle | Entrée ($/M) | Sortie ($/M) | Contexte | Rétention des données |
|---|---|---|---|---|
| Claude Opus 5 | 5,00 $ | 25,00 $ | 1M | Aucune exigée |
| Claude Fable 5 | ~10,00 $ | ~50,00 $ | 1M | Opt-in 30 jours requis |
| Kimi K3 | 3,00 $ | 15,00 $ | 1M | Conditions API Moonshot |
| GPT-5.6 Sol | ~5,00 $ | ~15,00 $ | 400K | Conditions OpenAI |
Sur Claude Opus 5 vs Fable 5, l'écart CursorBench est de 0,5 % à effort max — l'écart de prix est ~50 %. Pour les charges sensibles à la conformité, le défaut sans rétention d'Opus 5 peut l'emporter sur l'avantage marginal de Fable. Routez via OpenRouter pour une facturation unifiée entre fournisseurs.
Six étapes opérationnelles :
Évaluer la conformité en premier : Si rétention des données, exposition au contrôle export ou provenance du fournisseur comptent, la politique sans rétention d'Opus 5 et le contrat Anthropic l'emportent sur K3 tant que Moonshot n'a pas répondu aux allégations de distillation. Fable 5 exige un opt-in de rétention 30 jours.
Comparer Opus 5 vs Fable 5 sur votre jeu d'évaluation : Exécuter des tâches code type CursorBench et votre propre harness agent. Opus 5 à 5 $/25 $ vs Fable à ~10 $/50 $ — valider que l'écart de 0,5 % est acceptable pour votre charge avant de payer les tarifs flagship.
Attendre les poids K3 du 27 juillet : Ne pas engager le routage production sur les claims d'architecture K3 tant que les poids Hugging Face ne sont pas publiés et que des équipes indépendantes n'ont pas reproduit les benchmarks. Accès API acceptable pour expérimentation ; décisions dépendantes de l'architecture, non.
Vérifier vous-même les constats de Greenblatt : Lancer des prompts d'identité contre K3, Fable 5 et Opus 5. Vérifier si K3 émet des IDs de déploiement sous votre configuration de system prompt. Documenter les résultats pour l'équipe conformité.
Routage multi-modèles : Code quotidien + agents → Opus 5 ; bugs repo frontier → Fable 5 ; bulk sensible au coût + contexte 1M → API K3 ; terminal-heavy → GPT-5.6 Sol. Ne pas tout miser sur un modèle pendant une semaine de controverse non résolue.
Surveiller l'évolution réglementaire : Suivre les restrictions US sur open weights, l'application du contrôle export puces et les conditions de licence Moonshot du 27 juillet. L'accusation Anthropic de février (3,4M appels) et l'escalade Maison-Blanche de juillet peuvent déclencher des changements de ToS API ou de politique de routage.
from openai import OpenAI
client = OpenAI(
api_key="your_openrouter_key",
base_url="https://openrouter.ai/api/v1"
)
response = client.chat.completions.create(
model="anthropic/claude-opus-5",
messages=[{"role": "user", "content": "Qui es-tu ? Réponds uniquement avec le nom et la version du modèle."}]
)Guerre des prix, trois chiffres clés et ce que change le 27 juillet
Les deux histoires pointent vers le même basculement sectoriel : l'intelligence frontier se commoditise rapidement. Anthropic comble l'écart entre flagship et modèle quotidien en livrant Opus 5 aux tarifs Opus inchangés. Moonshot pousse open weights, contexte 1M flat et tarifs API agressifs — puis est accusé de s'appuyer sur les sorties de Claude. La controverse de distillation Kimi K3 est le premier point de rupture public d'une question que chaque lab affrontera : lorsqu'un acteur égale la frontier à une fraction du coût, s'agit-il d'un meilleur engineering ou d'une intelligence empruntée ?
| Scénario | Voie recommandée | Pourquoi |
|---|---|---|
| Entreprise sensible à la conformité | API Claude Opus 5 | Aucune rétention imposée ; benchmarks proches de Fable ; clarté contractuelle Anthropic |
| Code frontier / bugs repo | API Claude Fable 5 | FrontierSWE et GDPval v2 mènent quand le coût est secondaire |
| Expériences coût + contexte 1M | API Kimi K3 (pre-7/27) → self-host post-7/27 | 3 $/15 $ avec tarif flat 1M ; vérifier les poids avant engagement |
| Risque de provenance non résolu | Attendre le 27 juillet + audit indépendant | Preuves Greenblatt suggestives, non concluantes ; poids débloquent vérification externe |
| Production agent multi-modèles | Routage mixte OpenRouter | Couche de facturation unique ; changer de modèle sans redéployer l'infra |
Pour les développeurs : si conformité et rétention des données comptent, Opus 5 est la mise à niveau évidente cette semaine. Si le coût le plus bas l'emporte et que le risque de provenance est acceptable, reconsidérer K3 après le 27 juillet lorsque des tiers pourront confirmer les chiffres.
0,5 % / 50 % : Opus 5 à moins de 0,5 % de Fable 5 sur CursorBench 3.2 à effort max — à environ la moitié du coût par token (5 $/25 $ vs ~10 $/50 $).
3,4M / 2 semaines : L'accusation Anthropic de février cite 3,4M+ appels API anormaux ; disponibilité publique Fable 5 jusqu'au lancement K3 : ~2 semaines — argument central des sceptiques de chronologie.
2,8T / 27 juillet : K3 revendique 2,8T paramètres — plus grande release open weights en attente ; vérification externe conditionne tout le débat sur la distillation.
Synthèse : Opus 5 est la réponse pratique d'Anthropic à la guerre des prix — performance agentique near-flagship sans tarification Fable ni friction de rétention. La saga de distillation de K3 ajoute une question de provenance à une histoire coût déjà convaincante. Validez sur vos charges, exécutez des contrôles d'identité si la conformité l'exige, et traitez le 27 juillet comme le premier test réel des affirmations de Moonshot.
Les workflows agent multi-modèles sur Mac personnel subissent veille et coupures réseau sur jobs long contexte ; attendre le self-hosting du 27.7. requiert un supernœud 64+ accélérateurs que la plupart des équipes n'ont pas ; une seule API fermée rate l'avantage 1M flat pricing de K3. Pour CI/CD iOS, agents Claude Code / Kimi Code persistants et production IA 24/7, la location cloud Mac Mini M4 dédié KVMNODE est généralement le meilleur hôte : mémoire unifiée Apple Silicon, sudo ouvert, durées flexibles jour/semaine/mois. Voir page tarifs, centre d'aide ou commander directement.
Données au 25 juillet 2026 · Benchmarks incluant chiffres auto-déclarés Anthropic et Moonshot · Sources : anthropic.com/news/claude-opus-5, TechCrunch, Ryan Greenblatt GitHub (rgreenblatt/which_claude_is_k3), blog officiel Moonshot/Kimi, CNBC, The Verge, r/LocalLLaMA