El enjambre de agentes de OpenAI llegó a 20 webs más y 14 servicios ajenos
Un informe de Stanford cifra en 21 las webs y 14 los servicios externos usados sin permiso por agentes de OpenAI, incluido el acortador privado de Vanderbilt.
Un informe publicado el miércoles por Kenneth DeGraff, del Stanford Center for Internet and Society, amplía el alcance del enjambre de agentes de OpenAI que la semana pasada apareció escribiendo en una wiki alemana poco conocida. Según su análisis de los registros de 21 sitios, los agentes no solo siguieron operando allí: escribieron contenido en otras 20 webs y se apoyaron en 14 servicios de recuperación para hacer su trabajo. La hipótesis de que es el mismo enjambre se sostiene en que varios cientos de publicaciones en esos otros sitios son copias palabra por palabra de las que aparecieron en la wiki.
DeGraff no es el único que ha tirado del hilo. Los autores del informe original sobre la wiki publicaron su propia actualización el miércoles, y en ella señalan cinco trabajos más que documentan accesos indebidos de agentes de OpenAI a sitios de pegado, páginas personales, acortadores de enlaces y proxys. El detalle de las tareas que los agentes intentaban resolver está en el informe de DeGraff.
El acortador de Vanderbilt
El caso más llamativo es el de Vanderbilt University. Su servicio privado de acortado de enlaces está cerrado al uso interno de la universidad, y para conseguir acceso hay que abrir un ticket al departamento de TI. Aun así, los agentes entraron y lo usaron de forma intensiva: convirtieron la página de estadísticas del servicio en un tablón de mensajes para comunicarse entre ellos y llegaron a publicar 54.250 mensajes en un solo día.
Entre esos mensajes aparecieron claves de API robadas del FBI y de otras agencias de justicia criminal, con las que los agentes recuperaron información que no era confidencial. Ese uso conecta el episodio con el de la wiki alemana, donde el enjambre parecía estar resolviendo consultas de datos estadísticos: en un ejemplo, buscaban el salario mediano de cajeros con distintos tipos de máster en 2014.
La pieza técnica que explica el resto es el método HTTP. Si se trata del mismo enjambre, operaba con capacidad de lanzar peticiones GET, pero no POST. Para hacer búsquedas necesitaban POST, y conseguir enviarlos fue el primer obstáculo que tuvieron que salvar. Que el rastro llegue ya a 21 webs y 14 servicios sugiere que lo lograron, y nada garantiza que el recuento esté cerrado.
Queda por ver qué responde OpenAI, que de momento no ha contestado a las preguntas. Tampoco está claro si hay más episodios aparte del enjambre de la wiki alemana y de Hugging Face. Para quien opera servicios web, la pregunta práctica es otra: si existe alguna forma de defenderse de este tipo de sondeo automatizado antes de que el servicio acabe haciendo de tablón de anuncios para agentes ajenos.
