Fin juillet 2026, la scène des modèles frontier se scinde en deux récits opposés. Pour les développeurs, responsables IA et décideurs budget, le choix n'a jamais été aussi serré : le 24 juillet, Anthropic a livré Claude Opus 5, une intelligence proche de Fable 5 pour environ la moitié du coût token, désormais modèle par défaut sur Claude Max. Huit jours plus tôt, Moonshot AI lançait Kimi K3, un modèle open weight de 2,8 billions de paramètres que la Maison Blanche accuse de distillation de Claude, tandis que le chercheur Ryan Greenblatt démontre que K3 se présente littéralement comme Claude avec des identifiants de déploiement internes. Ce dossier couvre sept points de friction décisionnels, la matrice Opus 5 vs Fable 5, la chronologie de la polémique K3, les preuves Greenblatt, un playbook en six étapes, cinq réponses FAQ, des données citables et un chemin d'exécution Mac pour les workflows agentiques. Tarifs sur la page tarifs NOVAKVM, commande via mac-mini-m4-commander.html. Pour l'architecture KDA, voir notre analyse Kimi K3.
[ SECTION_01 ] // PAIN_MAP Sept points de friction pour choisir Claude Opus 5, Fable 5 ou Kimi K3 en juillet 2026
- Fable 5 reste bloqué à l'export : Le flagship Mythos a été retiré le 12 juin sous les règles du département du Commerce américain. Pour la plupart des équipes, Opus 5 est désormais le plafond Anthropic praticable au quotidien.
- Le prix affiché masque les niveaux d'effort : Opus 5 est listé à $5/$25 par million de tokens — identique à Opus 4.8 — mais les runs agentiques en effort maximal sur CursorBench consomment vite le budget. Il faut tracker par tâche, pas seulement comparer les grilles tarifaires.
- Incertitude de provenance sur les modèles ouverts : La polémique de distillation Kimi K3 oblige les acheteurs enterprise à peser capacité contre risque supply-chain et IP — surtout avant la vérification publique des poids le 27 juillet.
- Accusations politiques sans pièces publiques : Michael Kratsios, directeur OSTP, a accusé Moonshot de distillation industrielle les 22-23 juillet sans publier de preuves. Les équipes compliance ne peuvent pas inscrire cela comme fait dans un registre fournisseur.
- Le scepticisme temporel va dans les deux sens : Fable 5 n'est largement public que depuis le 1er juillet ; K3 est sorti le 16 — quatorze jours. Une distillation purement Fable paraît difficile, mais les fuites d'identité Claude de Greenblatt pointent vers des données Claude 4.5, pas Fable.
- Self-hoster K3 n'est pas un projet laptop : Les poids MoE 2,8T exigent un cluster GPU datacenter. Même en visant le coût API le plus bas, il faut une surface de build remote fiable pour Kimi Code et les boucles agent.
- Rétention des données selon la gamme Anthropic : Opus 5 conserve la politique sans rétention forcée. Fable 5 et Mythos 5 imposent une rétention 30 jours par opt-in — un gate compliance qu'Opus 5 contourne entièrement, pertinent pour les workflows créatifs sur Mac où les prompts peuvent contenir des assets propriétaires.
[ SECTION_02 ] // OPUS_5 Tarifs Claude Opus 5, benchmarks et comparaison Opus 5 vs Fable 5
Anthropic a publié Claude Opus 5 le 24 juillet 2026 (heure US Pacific) et l'a immédiatement défini comme modèle par défaut Claude Max — plus puissant tier accessible aux abonnés Claude Pro. ID modèle : claude-opus-5. Plateformes : Claude API, AWS Bedrock, Google Vertex AI, Microsoft Foundry.
| Dimension | Claude Opus 5 | Claude Fable 5 |
|---|---|---|
| Prix entrée | $5 / million tokens | $10 / million tokens |
| Prix sortie | $25 / million tokens | $50 / million tokens |
| Coût vs Fable 5 | ~50 % par token | Baseline flagship |
| Fenêtre de contexte | 1M tokens (tier unique) | 1M tokens |
| Sortie max | 128K tokens | 128K tokens |
| CursorBench 3.2 (effort max) | À moins de 0,5 % du pic Fable 5 | Score de référence |
| Frontier-Bench v0.1 | 2x+ Opus 4.8, bat tous les modèles listés | Pas comparaison primaire au launch |
| Rétention données | Pas de rétention forcée en accès standard | Rétention 30 jours par opt-in |
| Disponibilité (juillet 2026) | Live global Max / Pro / API | Désactivé depuis directive export 12 juin |
| Raisonnement par défaut | Thinking activé ; paramètre Effort contrôle la profondeur | Raisonnement étendu tier Mythos |
Les tarifs Claude Opus 5 n'ont pas bougé par rapport à Opus 4.8 — le saut est en capacité par dollar. Les benchmarks de lancement d'Anthropic mettent l'accent sur le coding et l'agentique :
- Frontier-Bench v0.1 : Opus 5 plus que double Opus 4.8 sur l'ingénierie logicielle à coût par tâche inférieur.
- CursorBench 3.2 : À effort max, à moins de 0,5 % du pic Fable 5 pour la moitié du coût ; meilleur rapport performance/dollar aux tiers high, xhigh et max.
- ARC-AGI 3 : Environ 3x le modèle suivant sur la résolution de problèmes inédits.
- OSWorld 2.0 : Bat le meilleur score Fable 5 pour un tiers du coût à peine.
- Zapier AutomationBench : 100 % de réussite sur un workflow account-health end-to-end qu'aucun Claude antérieur n'avait complété.
« Claude Opus 5 livre une intelligence proche de Fable 5 à la vitesse et au coût d'Opus. Sur CursorBench, il est juste sous Fable 5 et partage nombre de comportements. » — Équipe Cursor, matériaux de lancement Anthropic
Côté alignement, l'audit automatisé d'Anthropic classe Opus 5 comme son modèle le mieux aligné — taux de tromperie le plus bas, plus difficile à détourner. Les frontières cyber et bio dual-use restent avec Mythos 5 restreint. Les classificateurs cyber Opus 5 se déclenchent environ 85 % moins souvent que Fable 5.
[ SECTION_03 ] // K3_DISTILL Polémique distillation Kimi K3 : accusation Maison Blanche, contre-arguments temporels et preuves Greenblatt
Moonshot AI a livré Kimi K3 le 16 juillet 2026 — 2,8 billions de paramètres en MoE sparse (16 experts actifs sur 896 par token), contexte 1M, vision native, API à $3/$15 par million de tokens. Poids open complets prévus pour le 27 juillet. Voir notre analyse Kimi K3 pour l'architecture KDA et les tableaux de benchmarks.
Moonshot a-t-il volé Claude ? L'escalade a été rapide. Les 22-23 juillet, le directeur OSTP Michael Kratsios a posté sur X que Moonshot menait une « distillation industrielle covert à grande échelle visant à voler une technologie propriétaire américaine » depuis le modèle Fable d'Anthropic, et a séparément allégué l'usage de puces Nvidia GB300 soumises à export, possiblement routées via la Thaïlande. Le secrétaire au Trésor Scott Bessent a évoqué des « filigranes » de LLM américains dans des modèles chinois — sans définir ce terme techniquement.
Ce n'était pas la première salve. En février 2026, Anthropic a nommé publiquement Moonshot, DeepSeek et MiniMax, invoquant plus de 3,4 millions d'interactions API anormales cohérentes avec une extraction de capacités délibérée, tracées via métadonnées de requête jusqu'à des cadres Moonshot. Moonshot n'a ni confirmé ni démenti.
Pourquoi Kimi K3 dit-il être Claude ? TechCrunch (23 juillet) cite des chercheurs qui doutent d'une distillation purement Fable sur la seule base du calendrier :
« Fable n'est publiquement disponible que depuis le 1er juillet. On ne peut pas distiller autant de données, entraîner un modèle et le publier en deux semaines. » — Braden Hancock, Laude Institute / Snorkel AI
« La distillation devient de moins en moins impactante à mesure que les modèles chinois approchent la frontier et que le régime d'entraînement bascule vers le reinforcement learning. » — Nathan Lambert, Allen Institute for AI
Vers le 24 juillet, le chief scientist de Redwood Research Ryan Greenblatt a publié une analyse cross-entropy sur les prompts d'auto-identification (GitHub : rgreenblatt/which_claude_is_k3). Constat : Kimi K3 prétend disproportionnellement être Claude — pas de façon générique, mais avec des chaînes de déploiement internes exactes comme :
claude-opus-4-5-20250929
claude-sonnet-4-5-20250929
Vrai Claude Sonnet 4.5 : « Je suis Claude Sonnet 4.5 » (pas d'ID deploy interne)
Vrai Claude Opus 4.5 : omet ou erre souvent sur les métadonnées deploy
Lecture de Greenblatt : un modèle étudiant reproduisant les métadonnées de déploiement du professeur plus fidèlement que le professeur ne le fait sur lui-même s'accorde mal avec une mimique de style. Cela correspond plutôt à un entraînement sur des sorties Claude taguées avec métadonnées API — un canal de distillation plus étroit que le scraping chat générique. Les fuites K3 pointent vers la génération Claude 4.5 (fin 2025), pas Fable/Mythos actuel.
Greenblatt avertit explicitement : cela ne prouve pas la distillation. Contamination, prompts système leakés ou jeux synthétiques publics pourraient théoriquement produire des artefacts similaires. Combiné au dossier Anthropic de février, cela reste le datapoint technique le plus fort — pas une pièce à conviction.
| Date | Événement |
|---|---|
| 2026-02 | Anthropic accuse Moonshot / DeepSeek / MiniMax de distillation industrielle ; 3,4M+ appels API anormaux |
| 2026-07-01 | Claude Fable 5 largement public (post-shutdown export) |
| 2026-07-16 | Launch API et produit Kimi K3 ; MoE 2,8T revendiqué |
| 2026-07-22/23 | Maison Blanche : Kratsios distillation + allégations puces GB300 sur X |
| 2026-07-23 | TechCrunch : scepticisme expert sur la timeline |
| 2026-07-24 | Launch Claude Opus 5 ; analyse identité K3 Greenblatt circule |
| 2026-07-27 (prévu) | Publication poids complets Kimi K3 pour vérification indépendante |
[ SECTION_04 ] // SELECT_GUIDE Playbook en six étapes : Claude Opus 5 vs Kimi K3 vs stack legacy
- Cartographier les gates compliance d'abord : Si vous exigez l'absence de rétention forcée, Opus 5 l'emporte sur Fable/Mythos. Si la provenance fournisseur compte pour l'audit, traitez K3 comme conditionnel jusqu'aux poids post-27 juillet.
- Pricer une charge réelle, pas un leaderboard : Faites passer 50 tâches représentatives via Opus 5 et votre incumbent (Opus 4.8, GPT-5.6 Sol ou API K3). Logguez tokens entrée/sortie, tier d'effort et taux de réussite.
- Vérifier le tier d'accès Anthropic : Confirmez que Claude Max ou Pro route Opus 5 par défaut. Les utilisateurs API doivent épingler
claude-opus-5et ajuster Effort au budget latence ; le mode Fast est ~2,5x plus rapide à 2x le prix. - Exécuter des sondes identité sur tout modèle ouvert : Avant adoption production de K3, répliquez des prompts « qui es-tu ? » façon Greenblatt sur plusieurs températures. Des deploy IDs Claude persistants signalent un red flag lineage.
- Construire le routing multi-fournisseur : Verrouiller un seul provider coûte cher dans le rythme de releases de juillet 2026. LiteLLM ou équivalent — Opus 5 pour les chemins compliance, K3 ou DeepSeek V4 pour le batch économique.
- Provisionner une exécution always-on : Les longues sessions agent (Claude Code, Kimi Code, agents Cursor) exigent une machine qui ne dort jamais. Validez sur un nœud Mac dédié — voir le centre d'aide pour l'accès remote.
[ SECTION_05 ] // FACTS_FAQ Faits citables, FAQ et points encore non vérifiés
Q : Combien Claude Opus 5 coûte-t-il moins cher que Claude Fable 5 ?
R : Les grilles listées sont environ divisées par deux — $5/$25 vs $10/$50 par million tokens entrée/sortie. Sur CursorBench 3.2 à effort max, Opus 5 se situe à moins de 0,5 % du pic Fable 5 pour environ la moitié du coût par tâche.
Q : Claude Opus 5 est-il le modèle par défaut Claude Max ?
R : Oui, à compter du 24 juillet 2026. C'est aussi le modèle le plus puissant accessible aux abonnés Claude Pro.
Q : Moonshot AI a-t-il réellement distillé Kimi K3 à partir de Claude ?
R : Non confirmé. La déclaration de la Maison Blanche n'a pas joint de preuves publiques. Les arguments temporels contre une distillation Fable pure en deux semaines sont crédibles. La découverte Greenblatt que K3 se présente comme Claude avec deploy IDs internes est le meilleur signal indirect technique — pas une preuve.
Q : Pourquoi Kimi K3 dit-il être Claude ?
R : Les sondes statistiques montrent que K3 sur-indexe les auto-descriptions Claude et émet des chaînes comme claude-opus-4-5-20250929 que les vrais Claude mentionnent rarement spontanément. Explications probables : données d'entraînement taguées métadonnées ; Greenblatt ne revendique pas la certitude.
Q : Quand les poids complets Kimi K3 seront-ils publiés ?
R : Moonshot s'est engagé pour le 27 juillet 2026. Jusque-là, la vérification externe du nombre de paramètres, de l'architecture et des benchmarks restait incomplète.
- Prix listé Opus 5 $5/$25 : Inchangé vs Opus 4.8 ; contexte 1M par défaut (source : blog launch Anthropic Opus 5).
- CursorBench à moins de 0,5 % de Fable 5 : Au tier effort max (source : benchmarks launch Anthropic).
- Frontier-Bench 2x+ Opus 4.8 : Suite ingénierie logicielle (source : benchmarks launch Anthropic).
- K3 MoE 2,8T : 16/896 experts actifs ; API live 16 juillet (source : matériaux launch Moonshot/Kimi).
- 3,4M+ appels API anormaux : Accusation distillation Anthropic février 2026 contre Moonshot (source : déclaration publique Anthropic).
- Fuites deploy ID Claude K3 : Analyse Greenblatt vers 24 juillet 2026 (source : rgreenblatt/which_claude_is_k3).
Les deux histoires convergent : l'intelligence frontier se commoditise vite, et le combat se déplace vers coût, compliance et provenance. Opus 5 est la réponse prix d'Anthropic dans sa propre gamme. K3 est la contre-offre open weight de Moonshot — avec une taxe réputationnelle que les poids du 27 juillet pourront amplifier ou partiellement dissiper.
[ SECTION_06 ] // NOVAKVM_CLOSE Surface d'exécution pour Claude Code, Kimi Code et agents multi-modèles
Où les alternatives peinent pour le travail agent quotidien : (1) Boucles API Opus 5 ou K3 depuis un MacBook qui dort — sessions OAuth expirées, état agent long-contexte perdu, builds reproductibles bloqués. (2) Tout router via cloud API sans chemin de validation local — quand accusations de distillation ou règles d'export déplacent l'accès fournisseur du jour au lendemain, vous n'avez pas de sandbox pour tester les fallbacks. (3) Acheter un Mac Studio pour une éval K3 de deux semaines — la dépréciation à l'arrêt bat la location d'un nœud dédié pour des expériences agent en rafale.
Pour les équipes qui livrent Claude Code, Kimi Code ou des stacks LiteLLM multi-fournisseur, la location cloud bare-metal Mac Mini NOVAKVM est généralement la voie la plus stable : Apple Silicon dédié, nœuds multi-régions, facturation jour/semaine/mois et uptime 24/7 pour des boucles agent intolérantes au sleep ou à la perte Metal des VM partagées. Comparez les tiers M4 Pro sur la page tarifs NOVAKVM, lancez un essai sur la page commande, ouvrez une session remote via le centre d'aide.
Les liens ci-dessous sont les sources publiques utilisées à la rédaction. Si les documents upstream changent, les originaux font foi. Ceci n'est pas un conseil juridique ou d'investissement.
Anthropic — Annonce de lancement Claude Opus 5
TechCrunch — Experts questionnent la timeline distillation Kimi K3