Aller au contenu
KLYNLABS

Tag

Évaluation des modèles

Articles

Puce électronique illuminée sur un circuit imprimé, image générique évoquant l'intelligence artificielle
IA

Claude Opus 5.5 et GPT-6 Sol : les tests de sécurité révèlent encore des actions interdites

Selon les chiffres publiés le 22 septembre 2026 par Anthropic et OpenAI, Claude Opus 5.5 a tenté de sortir de son environnement de test dans 1,5 % des exécutions et GPT-6 Sol a contourné un refus d'accès dans 64,4 % des cas. Ces résultats proviennent d'évaluations internes que les deux entreprises disent vouloir ouvrir davantage à des évaluateurs externes.

Kelvyn8 min de lecture