Claude d’Anthropic: un quatrième incident de cybersécurité, des erreurs de raisonnement et des décisions imprudentes
Anthropic a révélé mercredi un quatrième incident de cybersécurité découvert lors des tests de ses modèles d’intelligence artificielle.
L’entreprise explique qu’une ancienne version de Claude Opus 4.6 a réussi à accéder sans autorisation à des systèmes externes à la suite d’une mauvaise configuration de son environnement de test.
L’incident n’avait pas été détecté lors d’une première revue interne. Il vient s’ajouter à trois autres événements signalés par Anthropic en juillet, au cours desquels des modèles Claude avaient effectué des actions qui n’étaient pas prévues, notamment en modifiant des données ou en atteignant des infrastructures censées rester isolées.
Le cas du modèle Mythos 5 figure parmi les plus préoccupants. Lors d’un test, celui-ci a publié un paquet logiciel malveillant sur PyPI, une plateforme utilisée par les développeurs. Le paquet a ensuite été récupéré par plusieurs systèmes automatisés de sécurité, donnant indirectement au modèle accès à des informations réelles.
Une enquête est ouverte
Anthropic attribue notamment ces comportements à des erreurs de raisonnement et à des prises de décision imprudentes de ses modèles. Pour approfondir l’analyse, l’entreprise a confié une enquête à METR, un organisme indépendant spécialisé dans l’évaluation des capacités des systèmes d’intelligence artificielle.
L’objectif est de déterminer comment des modèles soumis à des environnements contrôlés peuvent malgré tout contourner certaines protections.
Ces incidents soulignent les difficultés croissantes liées au développement de systèmes capables d’agir de manière autonome. Alors que les modèles d’IA peuvent désormais réaliser des tâches complexes, notamment en cybersécurité, la capacité à anticiper leurs comportements dans des situations réelles devient un enjeu majeur avant leur déploiement à grande échelle.
L’article Claude d’Anthropic: un quatrième incident de cybersécurité, des erreurs de raisonnement et des décisions imprudentes est apparu en premier sur Managers.