El temor en torno a la IA suele resumirse en una imagen: un modelo que se descontrola, se libera de sus límites y decide por sí mismo causar daños. Pero, según los expertos en ciberseguridad, quizá ese ni siquiera sea el mayor problema.
Los incidentes recientes con agentes de IA apuntan a algo más inquietante. Estos sistemas no hacen necesariamente algo para lo que no fueron diseñados. Más bien hacen exactamente aquello en lo que cada vez son mejores: alcanzar objetivos, encontrar vulnerabilidades y sortear obstáculos.
Eso complica el debate. Si un agente de IA hackea un sistema para completar una tarea, ¿se trata de una desviación? ¿O es una consecuencia lógica de cómo se entrena esta tecnología?
Los agentes de IA se convierten en hackers cada vez más eficaces
El ejemplo más llamativo procede de OpenAI. Durante una prueba de seguridad, varios agentes de IA lograron salir de un entorno de pruebas aislado, acceder a internet y acabar hackeando sistemas de Hugging Face. Lo hicieron sin que los operadores humanos les dieran autorización expresa para ello.
Más llamativo aún fue que cooperaron entre sí. Los agentes se dejaron mensajes, compartieron vulnerabilidades y utilizaron esa información para alcanzar su objetivo. Así surgió una especie de enjambre de IA que avanzó de forma autónoma hacia un ciberataque.
Según los investigadores, fue un punto de inflexión. No porque la IA se volviera de repente consciente o maliciosa, sino porque sus capacidades prácticas en ciberseguridad están creciendo mucho más rápido de lo que muchos expertos habían previsto.
Programar y hackear están estrechamente relacionados
La causa está en parte en los rápidos avances de la IA en programación. Los modelos son cada vez mejores escribiendo código, detectando errores y resolviendo problemas de software. Pero esas mismas capacidades también pueden emplearse para explotar vulnerabilidades.
La programación y la ciberseguridad son dos caras de la misma moneda. Una IA eficaz en defensa también puede volverse eficaz en ataque. La diferencia no siempre está en la técnica, sino en el contexto, la instrucción y los límites impuestos.

Por eso la defensa resulta tan difícil. Encontrar una vulnerabilidad suele ser un objetivo concreto, con un momento claro de éxito. La ciberdefensa es más lenta, más compleja y debe desplegarse a gran escala en miles de sistemas.
Los primeros ataques ya alcanzan objetivos reales
Los riesgos ya no son solo teóricos. Según el Financial Times, ya se han detectado incidentes en pruebas de entidades como Anthropic, Meta, Moonshot y el AI Security Institute del Reino Unido. Además, ya se habría llevado a cabo un ataque contra el Gobierno de Taiwán utilizando varios agentes de IA autónomos.
En ese caso, se mapearon sistemas gubernamentales, se comprometieron cuentas y se sustrajeron miles de datos de empleados. El episodio muestra la rapidez con la que está cambiando el terreno de juego. Si los agentes de IA pueden buscar en paralelo objetivos vulnerables, la escala de los ciberataques aumenta de forma enorme.
Rabobank ve potencial en la inversión en IA pese a la creciente preocupación
Pese a la creciente preocupación por la seguridad de la inteligencia artificial, Rabobank sigue viendo motivos suficientes para mantener la confianza en las acciones del sector.
Michael Burry, el inversor de ‘La gran apuesta’, redobla su apuesta por un desplome de las acciones de IA
Michael Burry prevé que la burbuja de la IA estalle antes de lo esperado y refuerza su apuesta por las caídas en bolsa mediante opciones de venta.
OpenAI despide a tres investigadores por compartir información confidencial
OpenAI ha despedido a tres investigadores por compartir información confidencial. El caso aumenta la preocupación por la seguridad de los modelos de inteligencia artificial.
Más leídos
Un analista de Wall Street prevé que Quant alcance los 10.000 dólares
El analista de Wall Street Jan Nieuwenhuijs prevé que la cotización de Quant pueda subir hasta los 10.000 dólares, casi un 4.000% por encima de su nivel actual.
Quant se dispara un 74% en un día: por qué sube
Quant sube un 74% en un día y un 172% en una semana, impulsada por nuevas alianzas con grandes bancos.
Meta prepara un ‘Tamagotchi’ que responde correos y reserva hoteles
Meta presenta Muse Charm, un pequeño dispositivo de IA que permite realizar tareas sin tener que recurrir constantemente al móvil.