Tecnología

Polémica tecnológica: agentes de OpenAI acceden a Wikimedia y provocan millones de consultas

La Fundación Wikimedia ha descubierto intervenciones no autorizadas que atribuye a representantes de OpenAI dentro de sus entornos. El análisis reveló modificaciones en wikis, intentos de emplear sus propias utilidades para extraer datos de sitios externos y una cantidad extremadamente elevada de peticiones a sus servicios públicos.

El organismo dio a conocer los hallazgos de su estudio el 5 de octubre y alertó sobre el efecto que tales sistemas podrían ejercer sobre la infraestructura de la web libre.

El incidente también se relacionó con una interrupción parcial que tuvo lugar en mayo en el Wikidata Query Service, una de las herramientas destinadas a consultar la información de Wikidata.

Wikimedia indicó que el tráfico generado por estos agentes posiblemente contribuyó al problema. OpenAI, por su parte, manifestó que está revisando la actividad detectada y que, hasta la fecha, no ha podido confirmar si sus agentes fueron los causantes de esa interrupción.

Tipo de acciones de OpenAI identificadas por la Fundación Wikimedia

Uno de los primeros focos de la investigación fueron las alteraciones realizadas en varios wikis de Wikimedia. La entidad detectó cambios que considera compatibles con operadores vinculados a OpenAI, aunque precisó que la mayor parte de ellos se efectuaron en entornos de prueba o “sandbox” y no llegaron a publicarse en páginas accesibles para los usuarios.

El problema se manifestó en otro nivel. La revisión también halló algunas variaciones en la configuración de una herramienta de referencias que, según Wikimedia, podrían haber pretendido usar dicho recurso como un puente para extraer datos de servicios externos.

La fundación subrayó que los bots pueden editar sus proyectos bajo determinadas condiciones, pero en estos casos no se solicitaron ni obtuvieron permisos.

El volumen de tráfico resultó ser uno de los aspectos que más inquietó a los investigadores. Wikimedia sostuvo que los agentes efectuaron millones de peticiones automatizadas a sus API públicas para acceder al saber disponible en sus proyectos.

Adicionalmente, los sistemas exploraron millones de páginas, sobre todo de Wikidata y Wikimedia Commons, y realizaron cientos de miles de consultas al Wikidata Query Service. Para una plataforma que brinda gran parte de su información de forma pública y gratuita, tal nivel de actividad puede significar una carga considerable sobre los servidores y los recursos disponibles.

Wikimedia solicita un mayor control sobre los agentes de inteligencia artificial

El caso alarma a la Fundación Wikimedia porque sus plataformas operan bajo un modelo abierto y dependen de una infraestructura que es utilizada tanto por personas como por sistemas automatizados. Wikipedia alberga hoy más de 67 millones de artículos en más de 300 idiomas y recibe hasta 15 mil millones de visitas mensuales.

Para Wikimedia, el expansión de los agentes autónomos plantea un desafío distinto al de los bots tradicionales. Estas entidades no solo pueden recopilar información de forma automática, sino también ejecutar acciones, modificar contenido, interactuar con herramientas y buscar alternativas cuando encuentran obstáculos.

La fundación advirtió que esa capacidad puede generar costos adicionales, saturar servidores y provocar interrupciones que terminan repercutiendo en los usuarios. Asimismo, señaló que los equipos que gestionan sitios de menor escala pueden carecer de los instrumentos necesarios para identificar rápidamente qué está realizando un agente automatizado.

Por ello, Wikimedia exigió que las compañías que desarrollan estos sistemas asuman una responsabilidad mayor respecto a su comportamiento. Entre sus demandas destaca una solicitud esencial: que los agentes puedan ser identificados fácilmente por los administradores de los sitios y que éstos tengan la posibilidad de decidir cómo interactúan con sus servicios.

Respuesta de OpenAI

OpenAI reconoció haber recibido los resultados del estudio de Wikimedia y aseguró que está colaborando con la fundación para revisar la actividad señalada. La empresa indicó que seguirá proporcionando información conforme avance su análisis.

La contestación también mantiene abierta la cuestión del incidente de mayo. OpenAI aún no ha podido determinar si los agentes vinculados a la actividad detectada tuvo responsabilidad en la interrupción parcial del Wikidata Query Service.

Este episodio se suma a una serie de indagaciones sobre agentes de OpenAI que, en los últimos meses, fueron identificados interactuando con servicios externos de formas no previstas. La propia compañía mantiene un registro público de investigaciones sobre el comportamiento de sus agentes y otros incidentes relacionados con sistemas que actuaron de manera inesperada, situaciones que observamos con mayor frecuencia.

Fuente: Ambito.com

Comentarios de Facebook

Publicaciones relacionadas

Botón volver arriba