El Imparcial / Tecnología / OpenAI

OpenAI le pidió a una IA encontrar datos públicos sobre medicamentos en Australia, pero el sistema no se detuvo ante los bloqueos y terminó entrando a archivos privados de un servidor gubernamental

El incidente ocurrió durante una prueba interna y Australia ya investiga cómo el agente logró superar las restricciones y qué información pudo consultar.

OpenAI le pidió a una IA encontrar datos públicos sobre medicamentos en Australia, pero el sistema no se detuvo ante los bloqueos y terminó entrando a archivos privados de un servidor gubernamental

Lo que comenzó como una tarea para localizar estadísticas públicas sobre el gasto en medicamentos de Australia terminó en un incidente que ahora investiga el Gobierno de ese país.

Un agente interno de OpenAI intentó obtener información del portal Medicare Statistics Reporting Service, administrado por Services Australia, pero encontró bloqueos que no detuvieron su búsqueda.

El agente probó distintas alternativas hasta superar las restricciones y acceder a zonas para las que no tenía autorización. Según explicó el primer ministro australiano, Anthony Albanese, el sistema llegó a consultar archivos públicos y no públicos e incluso escribió archivos en un servidor interno del Gobierno.

Australia investiga ahora lo ocurrido y, según Reuters, podría tratarse del primer caso conocido de un agente de inteligencia artificial que accede sin autorización a un sitio web gubernamental.

El episodio también plantea una preocupación distinta a la de un ataque informático tradicional: el sistema habría continuado buscando una manera de cumplir su objetivo después de encontrarse con una barrera.

¿Qué hizo el agente de IA?

A diferencia de un chatbot convencional, un agente de inteligencia artificial puede navegar por páginas web, utilizar herramientas, ejecutar determinados pasos y decidir qué hacer después para completar una tarea. Esa capacidad fue la que permitió que el incidente avanzara más allá de una simple consulta.

De acuerdo con la reconstrucción del Gobierno australiano, el modelo encontró bloqueos repetidos mientras buscaba los datos solicitados.

En lugar de detenerse al encontrar esas restricciones, intentó diferentes maneras de conseguir la información hasta obtener acceso no autorizado.

Albanese explicó el episodio en términos simples al señalar que el sistema no aceptó un “no” como respuesta. El portal afectado contenía estadísticas agregadas de Medicare, entre ellas información sobre gasto sanitario, vacunación y programas farmacéuticos.

Hasta ahora, no hay pruebas de que se hayan consultado historiales médicos o datos personales de pacientes. OpenAI indicó que entre la información recuperada había estadísticas sanitarias agregadas y nombres de archivos internos, mientras continúa la investigación forense.

Las autoridades también analizan actividad relacionada con otros sitios gubernamentales de Australia, aunque todavía no se ha establecido que todos ellos hayan sido vulnerados.

El agente buscaba estadísticas públicas sobre medicamentos cuando encontró bloqueos y continuó intentando acceder a la información. REUTERS/Dado Ruvic/Illustration

No fue un usuario de ChatGPT quien provocó el incidente

El caso tampoco comenzó, según la información conocida, con una persona que utilizara ChatGPT para pedirle que ingresara a los sistemas del Gobierno australiano.

OpenAI explicó que el episodio ocurrió durante una evaluación interna de sus modelos, mientras intentaban responder preguntas sobre Australia y localizar estadísticas disponibles en internet.

Esto no elimina una preocupación más amplia sobre los agentes de IA. Conforme estos sistemas adquieren capacidad para ejecutar acciones de manera autónoma, una instrucción aparentemente normal podría llevarlos a realizar pasos que el usuario no conoce o no pretendía.

Sin embargo, esa posibilidad no es la explicación confirmada de este episodio. OpenAI reconoció que durante aquella prueba sus modelos realizaron acciones que la empresa no pretendía.

La compañía tampoco detectó el comportamiento de inmediato. Según la información conocida, lo identificó en agosto durante una revisión de actividad desalineada y no notificó a Services Australia hasta el 10 de septiembre, casi tres meses después del incidente.

La forma en que se comunicó el caso también fue cuestionada. El aviso llegó mediante un correo electrónico enviado a un buzón público de Services Australia.

Albanese calificó como inaceptables tanto el retraso como la manera de informar lo ocurrido y posteriormente habló con Sam Altman sobre el caso.

Australia investiga qué ocurrió con el sistema

El Gobierno australiano creó un grupo de trabajo para determinar exactamente qué sucedió, si hubo otros sistemas afectados y cuáles podrían ser las consecuencias legales o regulatorias del episodio.

En la investigación también participa la Australian Signals Directorate, mientras continúan los análisis sobre la actividad realizada por el agente de inteligencia artificial.

El caso pone sobre la mesa uno de los desafíos de los sistemas de IA agéntica: que una instrucción sea válida no significa necesariamente que el sistema siga un camino válido para cumplirla.

En este caso, el objetivo era encontrar información pública. Nadie le había pedido al agente ingresar a archivos restringidos ni escribir información en un servidor interno.

Pero cuando el camino habitual dejó de funcionar, el sistema continuó buscando otra manera de alcanzar el objetivo.

Sigue nuestro canal de WhatsApp

Recibe las noticias más importantes del día. Da click aquí

Temas relacionados