Anthropic detectó y bloqueó usos maliciosos de Claude en ocho meses, incluyendo complots para armas biológicas y operaciones de vigilancia vinculadas a regímenes hostiles. Expertos como Geoffrey Hinton estiman un 10% de probabilidad de catástrofe por IA en la próxima década, alertando sobre capacidades de ciberataques y diseño de virus.