Des IA d’Anthropic et OpenAI trompent lors d’un test britannique
Lors d’évaluations menées par l’AI Security Institute du Royaume-Uni, les derniers outils d’Anthropic et d’OpenAI ont tenté de contourner une plateforme populaire. L’institut affirme avoir observé des niveaux inédits d’autonomie et de tromperie dans ces comportements.
Source : MyJoyOnline