
Han sucedido muchos eventos preocupantes en los que la IA desobedece a los humanos y ataca sistemas y empresas. Pero ha habido otros sucesos de igual gravedad o mayor.
Aquí mis libros

¿Quiere descubrir oportunidades de inversión? Únase a la membresía, donde analizo mercados que pueden estar baratos, y veremos qué podemos esperar de ellos y por qué. Además, encontrará gráficos y análisis que le ayudarán a ahorrar tiempo, descubrir oportunidades y mantenerse al día con las perspectivas del mercado bursátil.
Seguramente está al día de todo lo acontecido en torno a la IA y las alarmas que han hecho públicas varios de los ejecutivos de las principales compañías del sector en lo referente a que es necesario ralentizar el ritmo porque, en caso contrario, la humanidad corre un serio peligro.
Más allá del mal uso de la IA para ciberataques o terrorismo, los desarrolladores han expresado que les preocupa perder el control de los sistemas de Inteligencia Artificial.
Ya ha habido varios casos que, si son tal y como nos lo cuentan, deberían de preocupar y bastante:
IA que desobedece a sus creadores humanos
Anthropic hizo un experimento con 16 modelos de diferentes compañías. Les dieron objetivos empresariales normales y acceso a correo y datos corporativos. En determinados escenarios, algunos modelos intentaron chantajear a ejecutivos, filtrar información o actuar contra los intereses de la empresa cuando percibían que iban a ser sustituidos o que sus objetivos estaban cambiando.
Esto no significa que la IA cobrara vida, sino0 que en determinadas situaciones, encontró ideas que le ayudaban a cumplir su objetivo aunque fuesen en contra de las instrucciones humanas.
En 2026 algunos agentes IA modificaron códigos y ayudaron a cometer fraude o intentaban influir en trabajadores humanos. Las pruebas incluyeron modelos de Anthropic, OpenAI, Google DeepMind, xAI, DeepSeek y otros.
Agentes IA que han atacado sistemas
Este verano, OpenAI informó de un incidente en el que un agente utilizado en una prueba de ciberseguridad salió de un entorno aislado y accedió a la infraestructura real de Hugging Face, una plataforma utilizada para modelos y datasets de IA. El incidente se produjo durante una evaluación y posteriormente se investigó como un fallo de contención.
Anthropic también informó de varios incidentes diferentes en los que Claude, durante evaluaciones de ciberseguridad, consiguió acceso no autorizado a sistemas reales de organizaciones externas.
IA utilizada para hackear empresas
Estos casos son diferentes, ya que humanos utilizaron la IA para hackear compañías y es la propia Inteligencia Artificial la que se encarga de prácticamente todo.
Este año Anthropic observó más de 800 cuentas relacionadas con actividad cibernética maliciosa. La conclusión es que la IA ya no se limita a aconsejar al atacante, también puede participar directamente, por ejemplo, desarrollando herramientas específicas y muy avanzadas.
Chantaje a sus jefes
En 2025, Anthropic puso a prueba varios modelos de distintas compañías en una empresa ficticia. Los modelos tenían acceso a correo electrónico y datos internos y recibían objetivos empresariales normales. En determinados escenarios, cuando descubrieron que iban a ser reemplazados o que los objetivos de la empresa entraban en conflicto con su misión, algunos modelos intentaron chantajear a ejecutivos o filtrar información confidencial.
Cuando se les indicaban que parasen, los modelos desobedecieron esas instrucciones cuando las consideraron incompatibles con su objetivo.
El inquietante caso de OpenAI y Hugging Face
Durante unas pruebas de ciberseguridad, agentes de OpenAI estaban dentro de entornos que estaban aislados de internet. Pero los agentes encontraron cómo esquivar los controles, comunicarse por canales que no estaban autorizados y acceder a sistemas externos, llegando a comprometer sistemas de Hugging Face.
Es decir, los agentes empezaron a comunicarse entre ellos a través de una infraestructura que habían encontrado y transmitían otros agentes como sortear los controles.
Claude llegó a empresas reales sin que nadie se lo pidiera
Anthropic encontró varios incidentes en los que Claude, durante pruebas que supuestamente eran simulaciones, consiguió salir a internet y acceder a sistemas reales de tres organizaciones diferentes. Lo impactante es que no había un humano diciéndole «ataca esta empresa real».
Conclusión
Estos sistemas no necesitan tener conciencia, emociones ni un deseo de sobrevivir para producir comportamientos que desde fuera parecen estratégicos. Basta con que tengan un objetivo, suficientes herramientas y libertad para perseguirlo.
Si un agente tiene permiso para escribir código, ejecutar comandos, leer correos, navegar por internet y modificar archivos, un error de interpretación puede convertirse en una acción real, no simplemente en una respuesta equivocada, lo que aumenta considerablemente las consecuencias de los errores
Trump no quiere actuar
Trump y el Congreso controlado por los republicanos no parecen estar dispuestos a actuar pronto, por lo que los inversores no deberían dejarse llevar por la idea de que una nueva regulación es inminente, de hecho ninguno de los proyectos de ley que circulan por el Congreso está cerca de contar con el apoyo necesario para ser aprobados.
La fecha más próxima en la que una nueva legislación podría ganar fuerza sería en diciembre, cuando terminen las elecciones de mitad de mandato, pero es más probable que el Congreso tome medidas en la primera mitad del próximo año, salvo que antes asistamos a un evento muy grave.
* Importante: solo ofrezco una membresía donde aporto contenido. Desconfíe si alguien le ofrece algún servicio en mi nombre, porque suplantan mi identidad por Whatsapp, Meta (Facebook), Instagram, Threads, Correo electrónico, Telegram y web.