Aller au contenu
Actu IA

Claude Opus 5: effort, agents longs, quoi changer en PME

Claude Opus 5 (24 juil. 2026): même prix qu'Opus 4.8, effort ladder, 1M de contexte. Ce que ça change pour les agents en prod PME, sans redo du guide Claude Code.

Illustration pour l'article : Claude Opus 5: effort, agents longs, quoi changer en PME

Claude Opus 5 en faits (24 juil. 2026)

Anthropic a publié Claude Opus 5 le 24 juillet 2026. Model ID API: claude-opus-5. Prix annoncé: $5 / $25 par million de tokens (input / output), identique à Opus 4.8. Fenêtre de contexte 1M tokens, jusqu'à 128k tokens de sortie, thinking activé par défaut.

Disponible sur l'API Claude, Amazon Bedrock, Google Cloud (Vertex) et Microsoft Foundry. Fast mode: environ 2,5× la vitesse par défaut, au double du prix de base (même logique qu'Opus 4.8).

Le message produit d'Anthropic: un Opus « de tous les jours » qui se rapproche de Fable 5 sur le coding et le knowledge work, à environ la moitié du coût par tâche dans leurs évaluations internes (Frontier-Bench, CursorBench selon leur annonce). On ne reprend pas leurs classements comme vérité absolue. On regarde ce que tu dois figer côté équipe.

Effort ladder: le vrai levier coût / qualité

Sur Opus 5, le contrôle principal n'est plus seulement le modèle. C'est effort: low, medium, high, xhigh, max. max est réservé aux tâches où la capacité prime. Le release note dit clairement que effort devient le curseur principal pour piloter le modèle.

Breaking change utile à noter: désactiver thinking n'est autorisé qu'à effort high ou moins. thinking: disabled avec effort xhigh ou max renvoie une 400 (changement vs Opus 4.8).

En pratique PME: une page de policy modèle. Tâche de routine (lint, résumé court, ticket simple) = effort bas ou moyen. Review sensible, migration, debug multi-fichiers = high. Rarement max, et seulement avec plafond de tours et owner. Sans ça, tu payes le plafond par défaut sur tout le backlog.

Agents longs: ce qui change, ce qui ne change pas

Anthropic positionne Opus 5 pour les agents long-running: mieux vérifier son travail, itérer, tenir un fil multi-étapes. Les retours early access citent debugging, root cause, workflows métier de bout en bout. Utile. Pas une raison d'ouvrir full-access en prod.

Ce qui ne change pas avec un modèle plus fort: le contrat d'approbation, le HITL sur auth / paiement / PII / push main, la mesure tokens + % de livrables acceptés, le fait qu'un transcript d'agent n'est pas une doc d'équipe.

Deux betas plateforme à suivre si tu codes des agents custom: mid-conversation tool changes (ajouter / retirer des tools sans casser le prompt cache, header beta mid-conversation-tool-changes-2026-07-01) et automatic fallbacks (route vers un autre modèle si un classifieur sécu bloque, au lieu de couper net).

Si ton sujet c'est « Claude Code pourrit en session », le guide evergreen Claude Code reste la référence. Cet actu date le delta Opus 5 et la policy d'effort.

Checklist migration PME (1 page)

1) Inventaire des appels qui hardcodent claude-opus-4-8 (API, Bedrock, Vertex, Foundry, Claude Code default). 2) Map effort par type de tâche (table 4-5 lignes). 3) Plafonds: max tokens out, max tours outils, budget hebdo owner. 4) Tests de non-régression sur 5-10 workflows critiques (même prompts, comparer coût et acceptation). 5) Fallbacks sécu documentés (qui reçoit quoi si classifieur cyber). 6) Date de cutover + rollback ID modèle. 7) Une alerte coût hebdo, pas un dashboard vanity.

Sources: annonce Anthropic Claude Opus 5, release notes plateforme 24 juil. 2026. Relis le system card et le guide de prompting Opus 5 avant de basculer les agents sensibles.

Si vous voulez figer la policy modèle / effort sur un process réel (pas une démo), on peut cadrer en 20-40 minutes.

FAQ

Quel est le prix de Claude Opus 5 ?
$5 / MTok input et $25 / MTok output, comme Opus 4.8. Fast mode environ 2× le prix de base pour ~2,5× la vitesse.
Faut-il migrer tous les agents vers Opus 5 ?
Non. Migre d'abord les workflows où la qualité ou la longueur de session justifie le coût. Garde un modèle plus léger pour le volume trivial, avec une table effort par type de tâche.
C'est quoi l'effort ladder ?
Un curseur API (low → max) pour piloter intelligence vs coût / latence. Sur Opus 5 c'est le contrôle principal; thinking off est limité aux efforts high et moins.
Lien avec Claude Code vs Codex ?
L'actu contrôles / tokens compare les surfaces d'agents coding. Ici on date le modèle Opus 5 et la policy effort. Sujets distincts.
Où lire l'annonce officielle ?
anthropic.com/news/claude-opus-5 (24 juil. 2026) et les release notes Claude Platform du même jour.

Articles liés

Cadrez votre premier agent IA

20 minutes pour vérifier vos outils, vos données et le premier cas utile. Sans jargon, sans engagement.