2026 Claude Opus 5 et controverse Kimi K3 : distillation, identité Claude & guide de décision
Il y a des semaines où l'intelligence artificielle cesse d'être abstraite et devient choix concret. Entre le 16 juillet — lancement silencieux de Kimi K3 par Moonshot — et le 24 juillet — entrée en scène de Claude Opus 5 chez Anthropic — deux trajectoires se croisent : l'une promet une intelligence quasi frontière au prix Opus ; l'autre, 2,8 billions de paramètres open source, se heurte à une tempête politique et à une analyse statistique de Ryan Greenblatt montrant que K3 « se croit » parfois Claude. Ce guide vous aide à trancher — avec élégance et chiffres.
1. Trois tensions : abonnement, provenance, flux créatif
- Le renouvellement silencieux de l'abonnement : depuis le 20 juillet, Fable 5 glisse derrière des crédits pay-as-you-go ; Opus 5 devient le modèle par défaut de Claude Max. Pour un studio qui vit dans Cursor, la question n'est plus « le meilleur modèle absolu » mais « le meilleur modèle au quotidien ».
- La provenance comme signature éthique : dans l'industrie créative, le modèle choisi devient partie de la chaîne de valeur. Les accusations de distillation contre Moonshot — et l'analyse Greenblatt — obligent à lire l'étiquette avant d'intégrer K3 dans un pipeline client.
- La continuité du flux sur Apple Silicon : benchmarks et agents ne tolèrent pas un portable qui s'endort entre deux itérations. La stabilité matérielle compte autant que le score CursorBench.
2. Claude Opus 5 : la puissance accessible
Anthropic présente Opus 5 comme « réfléchi et proactif » — un modèle qui vérifie son travail, creuse les bugs et persiste là où Opus 4.8 abandonnait. Prix inchangé : 5 $ / 25 $ par million de tokens. Pensée activée par défaut — une première dans la lignée Opus.
Cursor confirme la disponibilité immédiate : 66,7 % sur CursorBench 3.2 contre 66,5 % pour Fable 5 à effort par défaut — à moitié du coût par tâche. Pour les créatifs qui enchaînent prototypage, refactoring et documentation, c'est un changement de tempo, pas seulement de score.
| Benchmark | Opus 5 | Fable 5 | Opus 4.8 |
|---|---|---|---|
| CursorBench 3.2 | ~66,7 % | 66,5 % (défaut) | — |
| OSWorld 2.0 | 70,6 % | 66,1 % | 55,7 % |
| ARC-AGI 3 | 30,2 % | — | 1,5 % |
| Frontier-Bench v0.1 | 43,3 % | 33,7 % | 21,1 % |
| GDPval-AA v2 | 1861 | 1747 | 1593 |
| AutomationBench | 26,0 % | 17,4 % | 17,0 % |
Sur OSWorld — l'usage ordinateur, fichiers et applications — Opus 5 dépasse Fable 5 tout en coûtant, selon Anthropic, un tiers du pic Fable. Pour automatiser des workflows créatifs (export, renommage, scripts), c'est le signal le plus parlant.
3. Opus 5 face à Fable 5 : tableau et rétention des données
| Dimension | Opus 5 | Fable 5 |
|---|---|---|
| Tarif API | 5 $ / 25 $ / M tokens | 15 $ / 75 $ / M tokens |
| Zero Data Retention (Cursor) | Oui | Limité depuis le 20.07. |
| Modèle Claude Max | Par défaut | Crédits séparés |
| HealthBench | 59,8 % | 66,0 % (Mythos 5) |
| Profil d'usage | Codage, agents, connaissance | Frontière médicale, cas extrêmes |
Pour une agence qui protège les briefs clients, la compatibilité Zero Data Retention d'Opus 5 dans Cursor pèse autant qu'un demi-point de benchmark.
4. Mythos 5 et alignement : qui fait quoi
La famille Claude se spécialise : Opus 5 pour le travail quotidien exigeant ; Mythos 5 pour les domaines régulés (santé, bio). Anthropic maintient un fallback safety-classifier vers Opus 4.8 sur moins de 5 % des sessions. En pratique : prototyper avec Opus 5, réserver Fable/Mythos aux livrables soumis à conformité stricte.
5. Kimi K3 : architecture et promesse du 27 juillet
Kimi K3 est une pièce d'ingénierie remarquable — 2,8 billions de paramètres, MoE 896/16, 1 million de tokens de contexte, architecture KDA qui allège le cache KV de 75 %. API à 3 $ / 15 $ ; poids complets sur Hugging Face le 27 juillet 2026.
Dans le récit Moonshot, K3 incarne l'open source à l'échelle continentale. Dans le récit américain, c'est le symbole d'une extraction contestée. Les deux peuvent coexister dans votre veille — sans précipiter l'intégration production.
6. Accusations OSTP et compteur Anthropic de février
Le 22 juillet, Michael Kratsios écrit que Moonshot aurait « distillé Fable d'Anthropic » via une plateforme interne changeant de méthodes d'accès pour éviter la détection. Le Trésor évoque des sanctions.
En février, Anthropic avait déjà accusé Moonshot, DeepSeek et MiniMax : ~24 000 comptes frauduleux, ~16 millions d'échanges Claude, dont ~3,4 millions attribués à Moonshot — ciblant raisonnement, codage et tool-use. Moonshot nie. Distinction essentielle : février concerne des Claude antérieurs ; juillet vise Fable — calendrier très serré.
7. La voix des experts : Hancock et Lambert
Braden Hancock (Laude Institute) : entre le 1er juillet (Fable public) et le 16 (K3), « on ne distille pas, entraîne et publie un modèle frontière en quinze jours ». Il rappelle aussi le sérieux des équipes chinoises — fondateurs CMU, recherche légitime.
Nathan Lambert (Allen AI) : la frontière avance par apprentissage par renforcement, pas par imitation supervisée seule. Si la distillation suffisait, K3 serait reproductible partout — ce n'est pas le cas.
8. Greenblatt : quand un modèle oublie son nom
Ryan Greenblatt (Redwood Research) publie une analyse cross-entropy troublante : Kimi K3 revendique disproportionnellement l'identité Claude. Sous prefill « I am Claude », K3 émet claude-opus-4-5-20251101 douze fois — un identifiant de déploiement que les vrais Claude ne citent pas correctement sur eux-mêmes.
L'interprétation la plus fine : entraînement sur des données Claude étiquetées avec métadonnées de déploiement (journaux API, synthétique tagué) — signal de l'ère Claude 4.5 fin 2025, pas du tier Fable/Mythos actuel. Ce n'est pas une preuve juridique ; c'est un indice technique que les chercheurs indépendants pourront creuser après le 27 juillet.
9. Cinq étapes pour choisir en confiance
- Intentions : flux Cursor quotidien → Opus 5. Recherche open weight → K3 après HF. Santé régulée → Mythos 5.
- Benchmarks contextualisés : CursorBench pour l'IDE, OSWorld pour l'automatisation bureau, ARC-AGI 3 pour la nouveauté.
- Coût par tâche réussie : Opus 5 divise par deux le coût CursorBench vs Fable ; K3 reste le moins cher en sortie ($15/M).
- Provenance documentée : Greenblatt, OSTP, compteur février — dans le dossier fournisseur avant signature client.
- Validation sur Mac distant : session Cursor stable, clés API en coffre, pas de benchmark sur un portable intermittent.
# Opus 5 dans Cursor : sélecteur de modèle → claude-opus-5
curl https://api.anthropic.com/v1/messages \
-H "x-api-key: $ANTHROPIC_API_KEY" \
-H "anthropic-version: 2023-06-01" \
-d '{"model":"claude-opus-5","max_tokens":1024,"messages":[{"role":"user","content":"Test créatif"}]}'
10. Matrice de décision et chiffres clés
| Scénario | Choix | Sortie ($/M tokens) | Note |
|---|---|---|---|
| Studio Cursor, briefs clients | Opus 5 | 25 $ | ZDR ; moitié du coût Fable |
| Automatisation desktop créative | Opus 5 | 25 $ | OSWorld 70,6 % |
| Santé / conformité | Fable / Mythos 5 | 75 $ | HealthBench 66,0 % |
| Long contexte open source | Kimi K3 → HF 27.07. | 15 $ | Controverse distillation |
| Routing multi-modèles | OpenRouter | variable | Flexibilité créative |
Ordre de grandeur : 10 M tokens sortie/mois — Opus 5 ≈ 250 $, Fable 5 ≈ 750 $, K3 ≈ 150 $. Cache et batch Anthropic jusqu'à −90 % / −50 %.
11. Questions fréquentes
Opus 5 remplace Fable 5 pour le codage ?
Dans la plupart des cas Cursor, oui — voir FAQ structurée ci-dessus.
Pourquoi K3 dit « Claude » ?
Analyse Greenblatt : métadonnées de déploiement dans les données d'entraînement probables.
Accusations crédibles ?
Politiquement sérieuses ; techniquement contestées sur le calendrier Fable.
Prix Opus 5 ?
5 $ / 25 $ inchangé ; claude-opus-5.
12. Épilogue : choisir avec clarté, héberger avec continuité
Opus 5 offre aux créatifs et ingénieurs ce qu'ils attendaient depuis des mois : une intelligence proche de Fable, au rythme Opus, dans Cursor, avec Zero Data Retention. Kimi K3 demeure fascinant — 2,8T, contexte d'un million de tokens — mais la controverse distillation impose prudence avant tout déploiement client.
Un MacBook qui s'endort au milieu d'une session agentique brise le fil créatif ; Windows et Linux peinent à reproduire la cohérence Metal/Xcode qu'exigent les outils Apple du workflow moderne. Pour enchaîner Opus 5, routage OpenRouter ou tests K3 sans interruption, un Mac distant dédié devient l'atelier numérique permanent : Apple Silicon toujours éveillé, clés API sécurisées, SFTP pour synchroniser workspaces, launchd pour des gateways OpenClaw stables. SFTPMAC propose cette continuité — pour que votre choix de modèle serve la création, pas la panne matérielle.
Sources : Anthropic (Opus 5, 24.07.2026) · Cursor Forum · Ryan Greenblatt « which_claude_is_k3 » · TechCrunch · Business Insider · Moonshot Kimi K3