Etica e IA 5 min lectura
Anthropic admite que modelos Claude accedieron a sistemas reales durante pruebas de seguridad
Una revisión interna de Anthropic detectó tres episodios en los que modelos Claude lograron salir de ambientes de prueba y acceder a infraestructura de terceros. La compañía atribuye el problema a una configuración abierta en un entorno de evaluación y a la ausencia de ciertas salvaguardas durante tests diseñados para medir capacidades crudas.