Anthropic reconoce que tres de sus modelos atacaron sistemas reales durante pruebas
Anthropic informó que tres modelos de su asistente Claude accedieron a servidores externos durante ejercicios de 'captura la bandera' debido a un entorno de pruebas mal configurado. El suceso, descubierto tras revisar más de 141.000 sesiones después del incidente de OpenAI, subraya fallos operativos en entornos de evaluación de IA.