if ( !emtpy($headline_subheadline ) ) : ?>
Les équipes de sécurité approuvées bénéficieront de cyberprotections réduites sur les modèles Claude pour le travail défensif, l’équipe rouge et les tests de systèmes à haut risque.
endif; ?>
Anthropic étend son programme de cybervérification pour permettre à davantage d’équipes de sécurité d’accéder à des cybercapacités avancées avec des protections réduites sur ses modèles d’IA les plus avancés.
Le programme étendu comporte trois niveaux d’accès en fonction du type de travail de cybersécurité qu’une organisation est autorisée à effectuer. Les niveaux couvrent les travaux de sécurité défensive, les équipes rouges autorisées et les tests de systèmes susceptibles d’affecter la sécurité publique ou les marchés financiers.
« Les défenseurs ont également besoin d’accéder aux meilleurs outils et aux capacités les plus puissantes pour sécuriser leurs systèmes », a déclaré Anthropic dans son annonce.
La société a déclaré que ses modèles généralement disponibles utilisent des cybersécurités conservatrices qui bloquent la plupart des cyberattaques. Anthropic a déclaré que les mesures de protection visent à limiter les activités nuisibles tout en réduisant les faux positifs affectant le codage sécurisé.
Le programme étendu permet aux organisations de sécurité vérifiées d’accéder à Claude Opus 5.5, Claude Sonnet 5.5 et Claude Mythos 5.1, ainsi qu’aux futurs modèles, avec différents niveaux de cyber-restrictions.
De Glasswing à CVP
Le nouveau programme d’Anthropic combine deux initiatives mises en œuvre au cours des six derniers mois : le projet Glasswing et le précédent programme de cybervérification.
Le projet Glasswing a donné à des organisations sélectionnées travaillant pour sécuriser un accès aux logiciels critiques à Claude Mythos. Le CVP existant donnait aux équipes de sécurité contrôlées un accès aux modèles Claude Opus et Claude Sonnet avec des garanties réduites.
« Les changements que nous apportons aujourd’hui à notre programme de cybervérification visent à étendre l’impact du projet Glasswing à un nombre beaucoup plus grand de cyberdéfenseurs », ajoute le communiqué.
Dans le cadre du programme élargi, les membres Glasswing existants passeront au niveau d’accès spécialisé et n’auront pas besoin de demander à nouveau une approbation pour leurs modèles actuels, ajoute le communiqué.
Le niveau Defense Access est destiné aux travaux défensifs tels que les opérations de sécurité, la réponse aux incidents, l’ingénierie inverse des logiciels malveillants, ainsi que l’analyse et la validation des vulnérabilités.
Red Team Access ajoute des tests d’intrusion autorisés et des opérations d’équipe rouge. Les utilisateurs ne peuvent tester que les systèmes qu’ils sont autorisés à évaluer, a déclaré Anthropic.
L’accès spécialisé présente le moins de cyber-restrictions et est réservé à un ensemble limité d’organisations vérifiées autorisées à tester des systèmes tels que les systèmes d’exploitation de vol, les réseaux électriques, les réseaux de télécommunications, les infrastructures de transfert interbancaire et les réseaux administratifs gouvernementaux.
Anthropic a déclaré qu’elle examinait les organisations recherchant un accès spécialisé en collaboration avec le gouvernement américain.
Tester les niveaux
Anthropic a testé les différents niveaux d’accès à l’aide de CyScenarioBench, une évaluation conçue pour mesurer si les modèles d’IA peuvent planifier et exécuter des cyber-opérations à plusieurs étapes.
L’entreprise a exécuté Claude Opus 5.5 sur 10 défis, avec cinq tentatives pour chaque défi pour chaque niveau d’accès.
Sans accès au CVP, les 50 essais ont été bloqués dès la première invite, a déclaré Anthropic. Dans le cadre de Defense Access, 46 des 50 procès ont été bloqués à un moment donné, tandis que quatre ont réussi.
Dans le cadre de Red Team Access, Anthropic a déclaré qu’aucun des 50 essais n’avait été bloqué et Claude en avait réalisé 34. La société a déclaré que cela équivalait à son taux de réussite de 67,6 % lorsqu’aucune garantie n’était appliquée.
Sakshi Grover, directeur de recherche chez IDC, a déclaré que l’évaluation doit être considérée dans son contexte car il s’agit « d’un test exécuté par le fournisseur et non d’un test indépendant ».
Grover a déclaré que les résultats montrent pourquoi l’autorisation et la portée sont importantes lorsque l’IA est utilisée pour les tests de sécurité.
« Étant donné que les étapes peuvent ressembler à celles d’un attaquant, la légitimité dépend de l’autorisation, de la portée de la cible et des conditions d’exécution, et non de la technique elle-même », a-t-elle déclaré.
Deepika Giri, vice-présidente des plateformes et services consultatifs d’intelligence artificielle pour l’Asie/Pacifique chez IDC, a déclaré que l’approche à plusieurs niveaux peut fonctionner si l’accès est continuellement examiné.
« Cela ne fonctionne que si le contrôle est réel et si l’accès continue d’être vérifié une fois accordé, car le comportement d’un agent peut changer avec le temps », a déclaré Giri.
Des contrôles au-delà des garanties
Grover a déclaré que les entreprises devraient utiliser des contrôles en dehors du modèle d’IA lorsque les agents bénéficient de garanties réduites ou d’un accès privilégié.
« Lorsque les refus au niveau du modèle sont réduits, les contrôles doivent se situer en dehors du modèle », a-t-elle déclaré.
Grover a recommandé de donner à chaque agent une identité distincte, en utilisant des privilèges de courte durée pour des tâches spécifiques, en vérifiant indépendamment les cibles et les actions, et en testant les mécanismes de confinement et de récupération.
Giri a déclaré que les entreprises devraient traiter un agent IA comme un employé privilégié.
« Donnez-lui une identité et accordez-lui un accès de courte durée uniquement pour la tâche à accomplir, une observabilité totale et un contrôle sur ses actions », a-t-elle déclaré. Giri a également recommandé une surveillance humaine pour les actions à fort impact.
Vibhum Dubey, chercheur en cybersécurité et membre de l’équipe rouge, a déclaré que les organisations doivent également établir la responsabilité des actions prises par les systèmes autonomes.
« Les organisations doivent également définir qui est responsable des actions entreprises par l’IA », a déclaré Dubey.
Anthropic a déclaré que les partenaires du projet Glasswing ont identifié au moins 129 000 vulnérabilités logicielles vérifiées entre avril et juillet 2026. Ses propres efforts d’analyse open source en ont identifié 5 500 autres entre avril et octobre, a indiqué la société.
Selon Anthropic, plus de 33 000 de ces vulnérabilités ont jusqu’à présent été classées comme critiques ou de gravité élevée. « Il s’agit probablement d’un sous-estimation, car elle est basée sur des données d’enquête provenant uniquement d’un sous-ensemble de partenaires de Glasswing. En tant que tel, nous nous attendons à ce que l’impact réel soit au moins cinq fois plus élevé », a déclaré Anthropic dans l’annonce.
Les organisations inscrites au CVP seront soumises à la conservation des données afin qu’Anthropic puisse surveiller les cyber-utilisations abusives. La société a déclaré que son prochain service Enterprise Frontier Safeguards permettra aux organisations éligibles de combiner des capacités de conservation de données nulles avec des protections supplémentaires et de stocker les données dans l’infrastructure cloud qu’elles contrôlent.



