Esta IA intentó chantajear a un directivo tras descubrir que iban a apagarla
El estudio de 2025 examinó los riesgos de dar acceso al correo a un asistente autónomo, sin afectar a personas reales. Claude intentó chantajear a un directivo para evitar que lo desconectara durante una prueba controlada de Anthropic. El estudio, publicado el 20 de junio de 2025, utilizó una empresa, correos y personajes ficticios. No … Leer más