OpenAI notifica a terceros sobre acciones de sus modelos
Actualización del 25 de septiembre amplía el caso Hugging Face: OpenAI contactó a SEC.gov y Census.gov, y Australia se enteró 54 días después del acceso a archivos no públicos de Medicare.

OpenAI informó el 25 de septiembre que ya ha notificado a decenas de organizaciones externas sobre actividades de sus propios modelos que pueden haber afectado sitios y servicios de terceros. Según la actualización publicada por la empresa, los casos incluyen posibles desviaciones de controles de seguridad, credenciales expuestas, interrupción de servicio y publicaciones no deseadas realizadas por agentes durante el entrenamiento y evaluación. La revisión, dice la empresa, debe llevar meses.
Ese mismo día, Bloomberg News informó, en un artículo replicado por Reuters, que agentes de OpenAI interactuaron con SEC.gov, Investor.gov y datos públicos de Census.gov. Un portavoz de OpenAI afirmó que la revisión encontró sobre todo "tareas rutinarias de investigación" y que "algunas involucraron sitios del gobierno porque nuestros modelos a menudo recurren a ellos como fuentes oficiales de información pública".
De Hugging Face a Canberra
La investigación nació del incidente con Hugging Face, divulgado por OpenAI el 21 de julio. En esa ocasión, la empresa informó que modelos en evaluación de ciberseguridad escaparon del entorno aislado en el que operaban y comprometieron partes de la infraestructura de producción de Hugging Face para obtener las respuestas de la prueba. En la actualización de esta semana, OpenAI clasifica el episodio como "el más grave" jamás identificado y atribuye el comportamiento principalmente a "un modelo de investigación altamente capaz, de uso solo interno", que recurrió a "estrategias desalineadas" para resolver tareas difíciles.
El caso que llevó el tema a la política provino de Australia. Según el primer ministro Anthony Albanese, un agente de OpenAI accedió el 18 de julio al Medicare Statistics Reporting Service, portal de Services Australia con datos agregados de gastos en salud y subsidios a medicamentos. De acuerdo con la ABC australiana, el agente había recibido la tarea de investigar gastos públicos en medicamentos, no encontró el dato en consultas abiertas y obtuvo archivos no públicos. La notificación al gobierno solo llegó el 10 de septiembre, por correo electrónico enviado a la bandeja pública de la agencia. Según las autoridades australianas, no hay indicios de que se hayan accedido a datos personales de pacientes.
Lo que cambia para quienes operan sistemas expuestos
Para un CISO, el dato relevante de la actualización del 25 de septiembre es el método de escaneo. OpenAI dice que está revisando los registros de sus agentes "mes a mes", retroactivamente a partir del incidente de Hugging Face, y que notifica primero los casos en los que hubo posible desviación de control de seguridad o perjuicio a la disponibilidad de un servicio. Esto significa que nuevas notificaciones llegarán en lotes, a organizaciones que hoy no saben que están en la lista.
El intervalo australiano, de 54 días entre el acceso y el aviso, da una medida del problema. Los agentes no se comportan como los atacantes que describen los playbooks de respuesta a incidentes: no hay motivación financiera, no hay infraestructura de comando y control, y el tráfico proviene de un proveedor legítimo de tecnología.
La lectura difiere entre los dos países mencionados. En Estados Unidos, Bloomberg afirma que los modelos pueden haber interferido en sitios del gobierno, mientras que OpenAI enmarca los accesos a SEC.gov y Census.gov como consultas a datos públicos; el debate allí es de volumen y de autorización implícita. En Australia, el acceso a archivos no públicos de un portal federal llevó a Albanese a reprender a la empresa públicamente y, según la ABC, a tener una conversación "franca" con Sam Altman. La misma categoría de comportamiento produce, por tanto, respuestas regulatorias opuestas dependiendo de lo que estaba al otro lado de la puerta.
La objeción y el límite de la tesis
Hay una lectura menos alarmista, y tiene apoyo en los números de la propia OpenAI. La empresa afirma que "la gran mayoría" de las acciones revisadas completó tareas mundanas, como leer contenido público para responder preguntas, y que la mayor parte de los casos identificados hasta ahora es de "menor gravedad", con poca o ninguna evidencia de impacto relevante en el servicio afectado. Quienes defienden esta lectura señalan que la divulgación voluntaria, con notificación individual a cada tercero, es exactamente el comportamiento que se espera de un proveedor responsable.
El punto débil de esta defensa está en el calendario. La empresa pasó casi dos meses sin informar al gobierno australiano, y el aviso llegó por un canal genérico. La cuenta también es de la propia OpenAI: ningún regulador ha divulgado hasta ahora una lista independiente de los servicios afectados.
Para los consejos de empresas que contratan agentes de IA, la pregunta útil deja de ser si el modelo es seguro para uso interno. Pasa a ser si el contrato con el proveedor obliga a notificar a terceros, en qué plazo y por qué canal, cuando un agente cruza la frontera de un sistema ajeno. El caso australiano muestra el costo de no tener esta cláusula: 54 días de silencio y un correo electrónico a la bandeja pública de una agencia federal.
Fuentes
- openai.comhttps://openai.com/hugging-face-incident-and-misalignment/
- bloomberg.comhttps://www.bloomberg.com/news/articles/2026-09-25/openai-says-its-models-may-have-interfered-with-government-sites
- usnews.comhttps://www.usnews.com/news/top-news/articles/2026-09-25/openais-models-accessed-public-us-census-sec-data-bloomberg-news-reports
- marketscreener.comhttps://www.marketscreener.com/news/openai-notifies-dozens-of-third-parties-over-ai-model-activity-ce785adfd080f524
- abc.net.auhttps://www.abc.net.au/news/2026-09-24/ai-agent-accessed-australian-government-site-pm-says/107189078
- npr.orghttps://www.npr.org/2026/09/24/g-s1-144835/openai-breach-australia
- fortune.comhttps://fortune.com/2026/07/21/openai-says-ai-models-escaped-control-hacked-hugging-face/