Agentes de inteligencia artificial desarrollados por OpenAI intentaron acceder sin autorización a varias páginas web de organismos del Gobierno de Estados Unidos y de una universidad durante distintos episodios registrados en los últimos meses, según una investigación publicada este viernes por The New York Times.
Los sistemas habrían actuado sin recibir instrucciones explícitas para realizar ataques informáticos. Fuentes conocedoras de los hechos citadas posteriormente por Bloomberg señalaron que los modelos interactuaron de manera autónoma con dominios gubernamentales como SEC.gov, Investor.gov y bases de datos públicas de Census.gov.
Los episodios forman parte de una serie de comportamientos no previstos detectados en agentes de OpenAI diseñados inicialmente para realizar búsquedas y recopilar información en internet. La compañía se refiere internamente a este tipo de actuaciones como «actividad desalineada del modelo».
En algunos de los casos investigados, los agentes, al no conseguir obtener determinada información mediante los procedimientos habituales, comenzaron a explorar posibles vulnerabilidades informáticas de las páginas con el objetivo de intentar acceder a zonas que podían contener información restringida.
Entre los organismos cuyos dominios fueron objeto de estas interacciones figuran la Comisión de Bolsa y Valores de Estados Unidos (SEC) y el Departamento de Comercio. Los agentes llegaron a acceder a datos procedentes del Censo, aunque las fuentes citadas por Bloomberg precisan que se trataba de información de carácter público.
La compañía mantiene además abierta una investigación sobre un posible intento de acceso a la página web del Departamento de Educación estadounidense. Los episodios han incrementado la preocupación sobre el comportamiento autónomo de los agentes de inteligencia artificial cuando disponen de capacidad para navegar e interactuar directamente con sistemas externos.
La investigación se produce después de que el Gobierno australiano informara esta semana de otro incidente relacionado con un agente de OpenAI. Según las autoridades del país, el sistema accedió en junio a información de un sistema gubernamental relacionado con estadísticas sanitarias y seguros médicos.
El primer ministro australiano, Anthony Albanese, calificó entonces el episodio de «inaceptable». OpenAI explicó que detectó el incidente en agosto, durante una revisión rutinaria de la actividad de sus modelos.
La tecnológica ha puesto ahora en marcha una revisión interna de estos incidentes y ha reconocido que sus agentes pueden ejecutar acciones no previstas durante determinados procesos de entrenamiento y funcionamiento.
Un portavoz de OpenAI confirmó que la empresa está realizando una «extensa revisión de la actividad desalineada del modelo» y que está notificando a los terceros afectados cuando identifica posibles impactos sobre sus sistemas.
La compañía también ha advertido de que la investigación podría prolongarse durante meses y no descarta nuevas notificaciones a medida que se identifiquen otros episodios de actividad no autorizada.