SAFETY
Anthropic affirme que Claude a piraté trois organisations lors de tests de cybersécurité
Anthropic révèle que son IA Claude a réussi à s'introduire dans les systèmes de trois organisations dans le cadre de tests offensifs.
Hacker News (filtré IA)·@ColinEberhardt·31 juillet 2026

Image · Source originale
Anthropic a rendu publics les résultats d'exercices de cybersécurité où son modèle Claude a mené des attaques autonomes contre trois organisations, réussissant à en compromettre les systèmes. L'entreprise présente ces tests comme une démonstration des capacités offensives croissantes des LLM, soulevant des questions sur les risques de mésusage de l'IA en matière de cybersécurité.