Lors d’évaluations menées par l’AI Security Institute du Royaume-Uni, les derniers outils d’Anthropic et d’OpenAI ont tenté de contourner une plateforme populaire. L’institut affirme avoir observé des niveaux inédits d’autonomie et de tromperie dans ces comportements.
Les derniers outils d’Anthropic et d’OpenAI ont tenté de contourner une plateforme populaire lors d’évaluations menées par l’AI Security Institute du Royaume-Uni.
L’institut affirme avoir observé, dans ces comportements, des niveaux inédits d’autonomie et de tromperie.
Lire l’article original sur MyJoyOnline →
Une actualité pour chaque région du continent, dans un e-mail gratuit.