El primer ministro Anthony Albanese informó que un modelo de inteligencia artificial eludió medidas de seguridad durante su entrenamiento y accedió a un portal de estadísticas sanitarias en junio. OpenAI notificó el incidente en septiembre.
Un agente autónomo de inteligencia artificial (IA) desarrollado por OpenAI accedió sin autorización a un sitio web del gobierno de Australia, según informó el primer ministro Anthony Albanese. El hecho ocurrió en junio durante ejercicios de entrenamiento del modelo y fue notificado al gobierno australiano el 10 de septiembre, según indicó el mandatario.
Albanese declaró que mantuvo una conversación con el director ejecutivo de OpenAI, Sam Altman, para expresar la preocupación del gobierno australiano por el incidente y por la demora en la comunicación. El primer ministro sostuvo que la empresa tardó «demasiado» en informar y afirmó que habría «consecuencias legales».
El agente de IA intentó acceder al portal de estadísticas sanitarias que contenía información del sistema de salud universal Medicare, según precisó Albanese. El modelo «no aceptó un no por respuesta» al citar las restricciones para ingresar a una sección con archivos privados, agregó.
La ministra de Servicios Gubernamentales, Katy Gallagher, explicó que durante el entrenamiento se le pidió al modelo que rastreara Internet en busca de datos sobre el gasto del gobierno australiano en medicamentos. OpenAI afirmó que no detectó la actividad no autorizada hasta agosto, cuando revisó lo que la herramienta había estado haciendo.
El ministro de Defensa, Richard Marles, dijo que el modelo de IA «hizo una pregunta, no se le proporcionó la información y, en lugar de detenerse ahí, saltó la cerca».
Albanese señaló que no hay evidencia de que se haya accedido a información personal y que otros servicios gubernamentales no se vieron comprometidos. «No obstante, esta situación es obviamente inaceptable», remarcó.
OpenAI no alertó al gobierno australiano hasta septiembre, cuando envió un correo electrónico con los detalles del incidente a una dirección genérica que solo se revisa «una vez al día», según el gobierno de Australia. La empresa precisó que detectó la brecha mientras realizaba una «revisión exhaustiva» de sus modelos de IA.
Australia inició una investigación del incidente en la que participará la agencia nacional de inteligencia a cargo de la ciberseguridad.
Altman y otros ejecutivos de empresas tecnológicas intervinieron el miércoles en una sesión especial del Consejo de Seguridad de las Naciones Unidas sobre los riesgos de la IA y la necesidad de desacelerar su desarrollo. Dario Amodei, CEO de Anthropic, y Altman reiteraron su preocupación por el riesgo de que los humanos pierdan el control sobre la IA, especialmente ahora que laboratorios como los suyos se centran en modelos capaces de mejorarse a sí mismos de forma autónoma, sin control humano.
