Claude Sonnet 5 : comment Anthropic rend l’agentique accessible à 60 % du prix d’Opus
Sur quoi repose cet articleRapport
Type de travail
Rapport ou annonce
À garder en tête
Un rapport ou une annonce n’a pas été évalué par des pairs comme une étude publiée.
Anthropic a lancé, le 30 juin 2026, Claude Sonnet 5, une nouvelle itération de son modèle de milieu de gamme taillée pour l’exécution agentique de bout en bout. Le pari est limpide : offrir une exécution multi-étapes comparable à celle d’Opus 4.8 — le modèle phare de la société — pour un coût d’inférenceInférence Inférence désigne, dans le contexte de l'intelligence artificielle, le processus opérationnel par lequel un modèle entraîné applique ses connaissances acquises à de nouvelles données inédites pour effectuer une prédiction, une… inférieur de près de 60 %, et en faire le modèle par défaut pour les utilisateurs Free et Pro dès l’ouverture du service.
L’annonce s’inscrit dans un mouvement de marché que l’on observe depuis deux mois : OpenAI a mis en preview GPT-5.6 Sol le 26 juin, Google pousse Gemini 3.5 Flash comme un modèle agentique dès mai, et Anthropic aligne désormais son mid-tier sur la même trajectoire. La nouvelle ligne de front n’est plus « qui fait le modèle le plus agentique », mais « qui le fait au meilleur prix sans sacrifier la fiabilité ».
Ce que Sonnet 5 fait, en pratique
D’après le billet de lancement d’Anthropic, Sonnet 5 est décrit comme « le modèle Sonnet le plus agentique à ce jour » : il planifie des tâches, utilise des outils comme un navigateur ou un terminal, et exécute des enchaînements longs sans supervision humaine étroite — ce que la société résume par « un niveau d’autonomie qui, il y a quelques mois, exigeait encore des modèles plus grands et plus chers ».
Les premiers retours publiés par Anthropic vont dans ce sens. Daniel Shepard, ingénieur senior chez Zapier, explique avoir confié à Sonnet 5 une tâche à deux étapes — mettre à jour des tiers de comptes Salesforce, puis envoyer une annonce à des contacts entreprise — que le modèle a terminée intégralement, là où les Sonnet précédents « calaient à mi-chemin ». Du côté de Lovable, le co-fondateur Fabian Hedin insiste sur la constance du refus de requêtes risquées : « un modèle qui sait dire non est aussi important qu’un modèle qui sait construire ».
Benchmarks : le mid-tier rattrape le flagship
TechCrunch cite un score de 63,2 % sur un benchmark de codage agentique, contre 69,2 % pour Opus 4.8 et 58,1 % pour Sonnet 4.6 — un gain net de cinq points sur la génération précédente, à six points du fleuron. Sur un benchmark de knowledge work, Sonnet 5 surperforme légèrement Opus 4.8, ce qu’Anthropic explique par une meilleure calibration sur les tâches de raisonnement long.

Trois repères pour situer Sonnet 5
- Codage agentique — 63,2 % (vs 58,1 % pour Sonnet 4.6 et 69,2 % pour Opus 4.8).
- Knowledge work — Sonnet 5 surpasse légèrement Opus 4.8.
- Comportements non alignés — moins qu’Sonnet 4.6, mais davantage qu’Opus 4.8 et Mythos Preview sur l’audit comportemental automatisé d’Anthropic.
Prix : une compression ciblée
Sonnet 5 est lancé à 2 dollars par million de tokens en entrée et 10 dollars par million de tokens en sortie jusqu’au 31 août 2026. Passé cette date, le tarif standard passe à 3 $/MTok en entrée et 15 $/MTok en sortie — un niveau qui reste, d’après TechCrunch, inférieur à celui d’Opus 4.8, de GPT-5.5 et de Gemini 3.1 Pro, mais supérieur à Gemini 3.5 Flash. Pour les déploiements à fort volume d’agents, l’écart de 60 % avec Opus 4.8 change l’économie d’un produit SaaS.
Sécurité : l’agentique sous garde-fou
L’enchaînement « agentique + accessible au grand public » posait une question évidente de sécurité. Anthropic y répond sur deux fronts. Premièrement, Sonnet 5 montre moins d’hallucinations et de sycophancy que Sonnet 4.6, et résiste mieux aux attaques par prompt injection. Deuxièmement, ses capacités offensives en cybersécurité restent nettement en deçà d’Opus 4.8 et de Mythos 5 — sur le test de développement d’exploits Firefox mené avec Mozilla, Sonnet 5 n’a jamais produit d’exploit fonctionnel (0 %), avec seulement un léger mieux que Sonnet 4.6 en termes de « succès partiel ».
En pratique, Anthropic active par défaut les cyber safeguards déjà utilisés pour Opus 4.7 et 4.8, plus permissifs que ceux de Fable 5 mais plus stricts que la configuration standard. Le programme Cyber Verification reste ouvert aux organisations qui veulent lever ces limites pour des usages offensifs autorisés.
Disponibilité et déploiement
Sonnet 5 est disponible dès aujourd’hui dans toutes les offres d’Anthropic : Free, Pro, Max, Team et Enterprise, ainsi que dans Claude Code et sur l’API Claude (identifiant claude-sonnet-5). Les limites de débit ont été relevées sur Chat, Cowork, Claude Code et la plateforme pour absorber la consommation supérieure induite par les niveaux d’effort élevés.
Sur le plan de l’infrastructure managée, le programme Cyber Verification est annoncé sur la plateforme native, sur AWS et sur Microsoft Foundry (Azure), avec une arrivée à venir sur Google Vertex. Les organisations déjà inscrites au programme héritent automatiquement de l’accès Sonnet 5 sans nouvelle candidature.
Ce que disent les premiers testeurs
Au-delà de Zapier et Lovable cités plus haut, Anthropic publie plusieurs retours d’usage en conditions réelles :
- Un client non nommé confie à Sonnet 5 un bug complexe : le modèle rédige de lui-même un test de non-régression, applique le correctif, puis « stash » le changement pour vérifier que le bug réapparaît sans le patch — le tout en un seul passage.
- Eve, plateforme pour les avocats en droit des préjudices corporels, place Sonnet 5 sur la frontière de Pareto pour la recherche et l’analyse juridiques, citant un rapport qualité-prix qui rend la migration « évidente ».
- ClickHouse évoque un temps de réponse réduit pour les agents qui explorent des données en direct, ressenti directement par les clients finaux.
- Pace, dans l’assurance, utilise Sonnet 5 pour orchestrer des workflows de souscription et de gestion de sinistres, et souligne la fiabilité du choix d’action sur des SI existants.
Ce qu’il faut surveiller dans les prochaines semaines
Plusieurs éléments restent à confirmer, que le billet de Sonnet 5 ne tranche pas :
- Architecture : taille exacte, structure (dense ou MoE), type d’attention, fenêtre de contexte utile — non communiqués publiquement à ce stade.
- Comparaison directe à GPT-5.6 Sol et Gemini 3.5 Flash sur des benchmarks tiers indépendants (au-delà des chiffres annoncés par chaque éditeur).
- Effet sur la concurrence mid-tier : la baisse tarifaire d’Anthropic exerce une pression visible sur Gemini 3.1 Pro et sur les futures itérations de GPT-5.x en milieu de grille.
L’arrivée de Sonnet 5, combinée à la sortie concomitante de Claude Science (workbench dédié aux chercheurs), confirme qu’Anthropic mise moins sur la course au modèle le plus gros que sur l’occupation systématique de chaque étage de prix — y compris celui où la majorité des agents de production finiront par tourner.



![Inscription « DevDay 2026 [Recap] » sur fond noir, entourée de cercles colorés portant des signes graphiques.](https://media.scienceactu.com/2026/10/scienceactu-20261001-openai-devday-2026-sol-agents-api-dots-1024x576.webp)





La discussion