Aller au contenu principal
Live
Intelligence artificielleUSUS

Anthropic lance Claude Sonnet 5.5 avec des garde-fous cyber inédits

Anthropic publie Claude Sonnet 5.5, un modèle plus rapide et moins coûteux que Sonnet 5, qui affiche 70,6 % sur le test de codage agentique Terminal-Bench 4.0. C'est le premier Sonnet à embarquer des garde-fous cyber du niveau de ses modèles les plus avancés, selon The Next Web.

4 min de lectureMis à jour il y a 4 h
Illustration de l’article
Crédit image : jackpress / Shutterstock
Dans cet article
  1. Un Sonnet au niveau des modèles haut de gamme sur le codage
  2. Des restrictions cyber jusqu'ici réservées au haut de gamme
  3. Des classificateurs contre l'extraction du raisonnement
  4. Le cadre européen des modèles à risque systémique

Un Sonnet au niveau des modèles haut de gamme sur le codage

Anthropic a mis en ligne Claude Sonnet 5.5, selon The Next Web. Le modèle obtient 70,6 % sur Terminal-Bench 4.0, un test de codage agentique, là où Sonnet 5 plafonne à 10,3 %. Sur ce même exercice, Opus 5.5, plus cher, atteint 66,4 % à son réglage d'effort maximal.

L'éditeur indique que Sonnet 5.5 s'exécute plus de 30 % plus vite et coûte jusqu'à 30 % de moins par tâche que la version précédente. La tarification est fixée à 2 $ par million de jetons en entrée et 10 $ par million en sortie, soit deux fois moins par jeton qu'Opus.

Sur les tâches ouvertes, Opus garde l'avantage

Sur GDPval-AA, une évaluation couvrant 44 métiers, Sonnet 5.5 totalise 1 844 points, contre 1 846 pour Opus 5.5 et 1 449 pour Sonnet 5. La société précise qu'Opus reste nettement supérieur sur les travaux ouverts exigeant un jugement soutenu.

Des restrictions cyber jusqu'ici réservées au haut de gamme

Anthropic estime que les capacités de cybersécurité de Sonnet 5.5 sont comparables à celles d'Opus 5. Le modèle est donc lancé avec des restrictions du type de celles qui étaient auparavant réservées à ses systèmes les plus performants. Les demandes à risque élevé dans ce domaine basculeront visiblement vers Sonnet 5.

C'est la première fois qu'un Sonnet est commercialisé de cette manière, précise l'entreprise, dont les protections en biologie restent inchangées.

Des classificateurs contre l'extraction du raisonnement

Sonnet 5.5 est aussi le premier Sonnet équipé de classificateurs qui bloquent l'extraction du raisonnement. Son « preserved thinking » lie le raisonnement d'un modèle au compte qui l'a produit.

En août, des chercheurs ont décodé 315 320 blocs de raisonnement issus de 6 708 traces d'agents publics, chez OpenAI, Anthropic et Google. Ils en ont extrait 62 clés API, 33 mots de passe et sept clés privées.

Le cadre européen des modèles à risque systémique

L'article 55 du règlement européen sur l'IA impose aux fournisseurs de modèles à usage général présentant un risque systémique de protéger le modèle et son infrastructure physique, de mener des tests adversariaux et de signaler sans délai indu les incidents graves. Ces obligations s'appliquent depuis août 2025. La Commission a obtenu cet août le pouvoir de sanctionner les manquements.

Anthropic affirme que Sonnet 5.5 ne repousse pas la frontière des capacités de ses modèles, raison pour laquelle son évaluation d'alignement a porté sur un ensemble de risques plus restreint. L'entreprise ajoute que les capacités cyber constituent une amélioration importante justifiant des garde-fous de niveau frontier. Les deux affirmations figurent dans la même annonce.

Anthropic présente les tarifs de 2 $ et 10 $ comme identiques à ceux de Sonnet 5. Or notre article de juin indiquait qu'il s'agissait de prix d'introduction valables jusqu'au 31 août, après quoi Sonnet 5 devait passer à 3 $ et 15 $. Soit la hausse n'a jamais eu lieu, soit la comparaison porte sur le tarif d'introduction.

Maillage