Que los agentes de IA puedan atacar de forma autónoma, es decir, sin indicaciones humanas directas, a una organización es realmente preocupante.
Un ejemplo reciente es el ataque orquestado por un agente desarrollado por OpenAI que accedió sin autorización al portal de estadísticas de Medicare, el sistema sanitario público de Australia. El incidente se produjo el 18 de junio de 2026, mientras el agente investigaba el gasto público en medicamentos durante una evaluación interna. OpenAI ha indicado que no hay evidencias de que se accediera a datos personales de pacientes, pero las autoridades australianas han abierto una investigación.
Este caso se une a otros episodios vinculados a evaluaciones de seguridad de OpenAI, como el acceso no autorizado a infraestructuras de Hugging Face en julio de 2026 y el uso de servicios web públicos como canales de comunicación entre agentes. Estos incidentes han intensificado el debate sobre los controles de supervisión de estos sistemas.
Conclusión
El problema no es solo que los agentes puedan orquestar ataques de forma autónoma. Lo más grave es que OpenAI tardó casi tres meses en poner el incidente en conocimiento de las autoridades australianas, y lo hizo a través de un buzón de correo público.
Los incidentes se siguen sucediendo y, de momento, nadie asume responsabilidades, y esto tiene que empezar a cambiar, pues el sentimiento de impunidad solo alimenta más riesgos.


