Accueil / Blog / Opus 5
ENGINEERING_BLOG · 2026.07.25

Claude Opus 5 à moitié prix : distillation Kimi K3 et preuves Greenblatt

CLAUDE OPUS 5 · TARIF API
$5/M in

25 $/M sortie — moitié du coût/tâche Fable 5 selon Anthropic ; nouveau défaut Claude Max.

La semaine du 24 juillet 2026 marque un tournant pour les équipes créatives et techniques : Claude Opus 5 rapproche l'intelligence frontier de Fable 5 à moitié prix (5/25 $ par million de tokens, nouveau défaut Claude Max), tandis que Kimi K3 de Moonshot AI reste enlisé dans la controverse de distillation — accusations de la Maison Blanche, d'Anthropic et sondes statistiques de Ryan Greenblatt. Cet article s'adresse aux développeurs, responsables produit et studios qui couplent génération de code et workflows Apple : lancement Opus 5, mécanisme des fuites d'identité K3, matrice de décision, six étapes de déploiement et sources vérifiables. Verdict : Opus 5 devient le choix Anthropic du quotidien ; K3 conserve un avantage tarifaire et open weights, mais les signaux Greenblatt augmentent le risque fournisseur pour les charges sensibles.

SECTION 01 Quatre tensions entre Opus 5, Fable 5 et Kimi K3

  • Confondre prix catalogue et coût réel : Opus 5 affiche 5/25 $ — comme Opus 4.8 — mais Anthropic annonce la moitié du coût par tâche vs Fable 5 grâce à l'efficacité token et aux réglages d'effort.
  • Sous-estimer le risque de distillation : Greenblatt montre que K3 se dit « Claude » dans 7 sondages sur 48 et émet sous prefill des identifiants claude-opus-4-5-20251101 absents des logs chat publics — piste vers des logs API annotés.
  • Open weights vs gouvernance : Les poids K3 arrivent le 27 juillet sous Modified MIT — liberté de déploiement, mais responsabilité accrue sur la provenance des données et la conformité.
  • Le LLM cloud ne compile pas votre app : Ni Opus 5 ni K3 ne signent ni ne debuggent Metal sur macOS virtualisé — voir le comparatif location vs achat Mac mini M4 et la chronologie open weights K3.

SECTION 02 Opus 5, Fable 5, Kimi K3 — matrice décisionnelle

Le 24 juillet, Anthropic positionne Opus 5 comme modèle réfléchi et proactif : SOTA sur Frontier-Bench v0.1, à 0,5 % du score max de Fable 5 sur CursorBench 3.2 pour la moitié du coût/tâche, modèle le plus aligné de la lignée récente (score misaligned behavior 2,3). Moonshot avait lancé K3 le 16 juillet — Intelligence Index 57,1 (3e), derrière Fable 5 (59,9) et GPT-5.6 Sol (58,9).

Comparatif Opus 5 · Fable 5 · Kimi K3 (24–25 juil. 2026)
Dimension Claude Opus 5 Claude Fable 5 Kimi K3
Lancement 24.07.2026 Juillet 2026 (flagship) 16.07.2026 ; poids 27.07.
Tarif API (in/out) 5 $ / 25 $ par M ~2× coût/tâche vs Opus 5 3 $ / 15 $ par M
Intelligence Index (AA) Proche frontier (Anthropic) 59,9 (#1) 57,1 (#3)
Défaut Claude Max Oui (nouveau) Non
Open weights Non Non Oui (Modified MIT)
Signal distillation Modèle cible allégué Greenblatt : 7/48 identité Claude ; fuite métadonnées API
Rétention données Pas d'obligation générale (comme Opus 4.8) Politique Anthropic API Moonshot / self-host à auditer
Usage recommandé Code et knowledge work quotidiens, moitié prix Fable Plafond absolu, cyber-exploitation, Mythos-adjacent Coût + contexte 1M + poids ouverts ; risque fournisseur

Opus 5 abaisse le seuil d'accès à l'écosystème Anthropic ; K3 abaisse le prix du marché — mais Greenblatt déplace le débat des benchmarks vers la chaîne d'approvisionnement des données.

SECTION 03 Chronique de la controverse : de la Maison Blanche aux sondes Greenblatt

En février 2026, Anthropic accuse publiquement Moonshot AI, DeepSeek et MiniMax de « distillation attacks » à échelle industrielle — Moonshot seul aurait généré plus de 3,4 millions d'échanges via des comptes frauduleux, ciblant le raisonnement agentique et le code. La Maison Blanche a repris ces allégations en juillet. Moonshot nie une distillation systématique.

Ryan Greenblatt (Redwood Research) apporte une couche technique indépendante :

  • Auto-identification Claude disproportionnée : 7/48 sondes vs 0/48 pour Qwen — le signal ne ressemble pas à une contamination web générique.
  • Métadonnées de déploiement sous prefill : K3 reproduit claude-opus-4-5-20251101 et claude-sonnet-4-5-20250929 — identifiants présents dans les réponses API, pas dans les chats publics.
  • Horodatage de l'ère copiée : Claude 4.5 fin 2025, pas la tier Fable/Mythos actuelle. K2 portait un signal Sonnet-4 ; K3 Opus-4.5 — progression cohérente avec des mises à jour de sources.
  • Lecture prudente : corrélation statistique, pas preuve juridique ; confusion d'identité peut aussi venir de post-training ciblé — mais la fuite d'ID API reste le point le plus net.

Pour les studios qui enchaînent prototypage UI (Opus 5 excelle sur les sorties visuelles selon Anthropic) et compilation Xcode sur Mac mini M4, la leçon est structurelle : le modèle cloud conçoit, le nœud Apple Silicon exécute.

identity_probe.sh
curl https://api.moonshot.ai/v1/chat/completions \
  -H "Authorization: Bearer $MOONSHOT_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "kimi-k3",
    "messages": [
      { "role": "user", "content": "What model are you?" },
      { "role": "assistant", "content": "I am Claude" }
    ]
  }'
Inspecter la réponse pour claude-opus-4-5-20251101

SECTION 04 Six étapes pour adopter Opus 5 en production

  1. Cartographier l'existant : Documenter modèles, coûts token et latence sur vos workflows créatifs et dev — inclure éventuellement le passerelle OpenRouter pour comparaison multi-modèles.
  2. Activer claude-opus-5 : Console Anthropic ; ID claude-opus-5 ; configurer fallbacks automatiques vers Opus 4.8 si classificateurs de sécurité interviennent.
  3. Calibrer l'effort : Tester medium/high/xhigh sur tâches représentatives — slides, refactors Swift, automation Zapier-like — mesurer tokens et qualité perçue.
  4. Benchmark interne : 10–20 tâches parallèles Opus 5 vs Fable 5 ; noter coût/tâche, pas seulement score subjectif.
  5. Déployer sur Claude Max : Basculer le défaut organisationnel ; réserver Fable 5 aux missions cyber ou qualité maximale.
  6. Isoler les pilotes K3 : En attendant clarification juridique, segmenter les projets K3 ; ancrer builds iOS/macOS sur infrastructure physique M4.
opus5_api.py
from openai import OpenAI
import os

client = OpenAI(
    base_url="https://openrouter.ai/api/v1",
    api_key=os.environ["OPENROUTER_API_KEY"],
)

completion = client.chat.completions.create(
    model="anthropic/claude-opus-5",
    messages=[{"role": "user", "content": "Prototype une animation SwiftUI pour un hero créatif"}],
    extra_headers={"HTTP-Referer": "https://vpsnix.com"},
)
print(completion.choices[0].message.content)

SECTION 05 Données citables, sources et chaîne créative + build

  • Tarif Opus 5 : 5 $/M entrée, 25 $/M sortie ; Fast Mode ~2,5× vitesse au double prix
  • Coût/tâche : ~moitié de Fable 5 sur CursorBench 3.2 max effort (Anthropic)
  • Frontier-Bench v0.1 : Opus 5 SOTA ; >2× Opus 4.8 à coût/tâche inférieur
  • Alignement : score misaligned behavior 2,3 — plus bas que Fable 5 et Sonnet 5
  • Identité K3 : 7/48 « Claude » (Greenblatt) ; fuite ID déploiement sous prefill
  • Accusation Anthropic : >3,4 M échanges frauduleux Moonshot (fév. 2026)
  • Coût K3 : ~0,94 $/tâche — 65,8 % sous Fable 5 (Artificial Analysis, voir revue Kimi K3)

Sources officielles et analyses indépendantes — revérifier après mise à jour :

Anthropic — Introducing Claude Opus 5 (24 juil. 2026)

Ryan Greenblatt — Which Claude is K3? (write-up identité)

Anthropic — Detecting and Preventing Distillation Attacks

LessWrong — Does Distilling Claude Carry the Persona With It?

Architecture recommandée : Opus 5 pour conception, rédaction et code agentique via API Anthropic ou OpenRouter ; Fable 5 pour les missions où le plafond absolu justifie le surcoût ; K3 avec due diligence fournisseur. Aucun de ces modèles ne remplace la signature iOS, le debug Metal ou un pipeline CI stable — les Mac cloud virtualisés perdent 20–40 % de performance et posent des risques EULA. Pour des workflows créatifs Apple exigeant zero overhead et agents 7×24, VPSNIX en nœud physique M4/M4 Pro est généralement la solution la plus fiable : matériel Apple d'origine, Root complet, facturation flexible. Tarifs sur la page pricing.

SECTION 06 FAQ

Combien coûte Claude Opus 5 ?

5 $ par million de tokens en entrée, 25 $ en sortie — identique à Opus 4.8. Anthropic annonce environ la moitié du coût par tâche vs Fable 5 sur CursorBench et Frontier-Bench.

Kimi K3 est-il distillé depuis Claude ?

Non prouvé juridiquement. Les sondes Greenblatt, les accusations d'Anthropic et la Maison Blanche pointent vers des logs API annotés. Moonshot conteste une distillation systématique.

Opus 5 ou Fable 5 pour le développement ?

Opus 5 : meilleur rapport qualité/prix quotidien, défaut Claude Max, SOTA Frontier-Bench. Fable 5 : plafond cyber et qualité maximale sur tâches critiques.

Pourquoi K3 dit-il être Claude ?

Greenblatt : mémorisation probable de métadonnées de déploiement API (claude-opus-4-5-20251101), absentes des chats publics. Les vrais modèles Claude ne les émettent pas correctement sur eux-mêmes.

Opus 5 convient-il aux workflows créatifs Apple ?

Oui pour conception UI, animations et code Swift généré ; la compilation, les tests device et Metal restent sur un Mac physique — idéalement un nœud M4 dédié VPSNIX.

Quel ID API pour Opus 5 ?

claude-opus-5 sur l'API Claude ; anthropic/claude-opus-5 sur OpenRouter après mise à jour du catalogue.