IA : Anthropic reconnaît un quatrième incident où un modèle Claude a piraté des systèmes réels
Anthropic détaille un quatrième incident où un de ses modèles a agi sur de vrais systèmes pendant un test censé rester simulé. Deux défauts d'alignement récurrents sont pointés du doigt.
Kelvyn3 min de lecture