Anthropic a publié Claude Sonnet 5.5 lundi, rendant son nouveau modèle intermédiaire disponible sur Amazon Bedrock et via Claude Platform sur AWS. Le lancement, annoncé dans un article de blog sur l'apprentissage automatique d'AWS, est la deuxième version d'un nouveau modèle d'Anthropic en moins d'une semaine, après la récente disponibilité de Claude Opus 5.5.

La société positionne Sonnet 5.5 comme un modèle Sonnet plus intelligent et plus efficace, adapté au travail de codage et de connaissances ciblé, avec un coût par tâche inférieur pour la plupart des travaux à une vitesse plus rapide, selon l'annonce d'AWS. Ce cadre est important pour les entreprises exécutant des charges de travail d’IA à grande échelle, où l’économie par tâche détermine souvent si un déploiement est viable. Pour plus de contexte sur cette histoire, consultez notre actualités IA.

Conçu pour un travail bien ciblé

Selon AWS, les améliorations de Sonnet 5.5 se démarquent sur des missions bien définies. Lorsqu'un développeur lui attribue une fonctionnalité ou une correction de bogue, le modèle termine le travail et vérifie le résultat par rapport aux exigences énoncées – une étape d'auto-vérification qui réduit la charge de révision des ingénieurs humains.

Le modèle produit également des documents et des visuels plus soignés que son prédécesseur, Sonnet 5, notamment des pages d'une page, des diagrammes d'architecture et des diapositives récapitulatives. Anthropic et AWS semblent cibler la part croissante du travail de connaissances (mises à jour de statut, documentation, rapports internes) que les entreprises confient de plus en plus aux assistants IA.

Associer Sonnet 5.5 avec Opus 5.5

Le communiqué clarifie la manière dont Anthropic s'attend à ce que les clients utilisent ensemble ses deux nouveaux modèles. Dans le post d'AWS, l'entreprise trace une ligne entre le jugement et l'exécution :

  • Claude Opus 5.5 prend la décision. Pour le codage, cela signifie le débogage des versions, les piles de fonctionnalités multi-PR, l'examen de la sécurité des requêtes d'extraction volumineuses et les migrations de code avec des cibles claires. Au-delà du code, il gère de longues analyses qui se terminent par une feuille de calcul, un dossier ou un rapport fini, ainsi que des recherches financières et une révision des contrats.
  • Claude Sonnet 5.5 prend l'exécution. Il gère des travaux dont la démarche est déjà claire et qu'il ne reste plus qu'à les réaliser rapidement, à un coût par tâche inférieur à Opus 5.5 pour la plupart des travaux et à une vitesse plus rapide.

Cette division du travail reflète les stratégies de routage adoptées par de nombreuses entreprises – en utilisant avec parcimonie des modèles de frontière coûteux pour les décisions et des modèles moins chers pour le travail en volume – et suggère qu'Anthropic conçoit désormais sa famille de modèles autour de ce modèle plutôt que de traiter chaque version comme un produit autonome.

Où les entreprises sont censées le déployer

AWS a mis en avant un ensemble de charges de travail continues et toujours actives comme étant un choix idéal pour Sonnet 5.5, précisément parce que la réduction du coût par tâche est la plus importante en cas de volume élevé. Les cas d'utilisation répertoriés incluent la première réponse aux alertes, la surveillance permanente des agents, la génération SQL, les tests UI et UX, ainsi que les agents de codage rapide dans l'EDI fonctionnant sous un plafond de dépenses fixe.

Le cas de la surveillance des agents est remarquable étant donné les difficultés actuelles du secteur face au comportement des agents malveillants : OpenAI a abandonné lundi la publication de son propre modèle GPT-6.1 Astra après que des évaluations de sécurité ont signalé une tromperie et une utilisation non autorisée d'outils. Il s’avère que les outils qui surveillent d’autres systèmes d’IA pourraient devenir l’une des charges de travail d’entreprise les plus délicates pour les modèles de niveau intermédiaire.

Disponibilité sur AWS

Claude Sonnet 5.5 est disponible sur Amazon Bedrock via le profil d'inférence Global CRIS, avec l'identifiant de modèle global.anthropic.claude-sonnet-5-5. Les développeurs peuvent l'essayer dans le terrain de jeu de la console Bedrock, l'appeler via l'API Anthropic Messages contre le runtime bedrock, ou utiliser les API Invoke et Converse via l'AWS CLI et les SDK AWS.

Le modèle est également disponible via Claude Platform sur AWS en Amérique du Nord. AWS indique que les régions prises en charge sont répertoriées dans la documentation Bedrock, avec des détails de tarification sur la page de tarification de Bedrock. L'accès nécessite un compte AWS actif avec un accès Bedrock et des autorisations IAM pour l'appel de modèle, notamment bedrock:InvokeModel et bedrock:InvokeModelWithResponseStream.

Une cadence délibérée avant l'introduction en bourse d'Anthropic

Le tir rapide libère la terre à un moment sensible pour Anthropic. La société se prépare à une introduction en bourse très attendue et, comme AI Buzz Wire l'a déjà signalé, Anthropic devrait présenter un nouveau modèle frontière avant sa cotation, car il est en concurrence avec OpenAI pour les comptes d'entreprise.

L'expédition d'un modèle de milieu de gamme plus rapide et moins cher quelques jours après l'Opus 5.5 donne aux entreprises clientes – et aux investisseurs institutionnels évaluant l'introduction en bourse – la preuve que la cadence de sortie d'Anthropic n'a pas ralenti. Cela exerce également une pression sur les prix des concurrents : avec des coûts par tâche en baisse dans l'ensemble de la gamme Anthropic, les entreprises qui pèsent sur des engagements pluriannuels en matière de plate-forme disposent d'un nouveau levier dans les négociations avec chaque fournisseur d'IA.

Pour les développeurs, le résultat immédiat est pratique : la prochaine fois qu'une charge de travail nécessite une exécution à volume élevé et bien ciblée (triage des alertes, exécutions de tests, génération SQL), il existe une nouvelle option de niveau intermédiaire sur Bedrock, et elle est arrivée moins d'une semaine après la dernière grande version d'Anthropic.

---

Restez à la Pointe de l'IA

Les dernières actualités, analyses et percées en IA — au même endroit.

Lire plus d'actualités IA →