Las reglas y la casa de la IA

El caso de los agentes de OpenAI vuelve a poner el foco en quién debe establecer los límites cuando una IA navega por Internet

En esta imagen ilustrativa, se muestra el logotipo de OpenAI (Open AI - ChatGPT) en la pantalla de un teléfono inteligente.Thomas Fuller

Publicado por

Creado:

Actualizado:

Esta semana está hablándose la última aventure (conocida) de los agentes de OpenAI. Parece que intentaron resolver una pregunta normal, no malintencionada, sobre los costes de atención médica, por el procedimiento de entrar en zonas restringidas de la web de la administración sanitaria australiana. No accedieron a información personal de nadie. Pero lo hicieron hace tres meses, y la empresa acaba de reconocerlo, junto con otras aventuras.

En el clima de inquietud sobre la IA, la historia parece tremenda. Lo que es tremendo es que sea una historia. Parémonos a pensar en ella.

Una IA (un agente) no es una persona. Lo podemos ver como un conjunto de instrucciones que se modifica para ir cumpliendo unos objetivos dados, de acuerdo a unas normas y unos parámetros dados. Tiene menos conocimiento del mundo que un niño, no porque no "conozca" en profundidad algunas cosas, sino porque no tiene la base mínima en la mayoría. Por poner un ejemplo, no sabe que una puerta donde no pone "no entrar" va con ellos y no debe cruzarse. Los agentes saben que una frase estándar en muchas webs (prohibido el paso a crawlers, es decir a software que lea la página) debe obedecerse, y lo hacen. Pero no van a interpretar como cerrado un paso que está abierto.

Dicho de otro modo, lo raro no es que una búsqueda con un agente llegue a datos que no están excluidos de búsquedas. Lo raro es que no hayan despedido ya a quienes responden de la confidencialidad de una información así expuesta.

Un agente necesita un "contexto", la información con la que trabaja el modelo en ese caso. Si el contexto no incluye unas normas de juego que detallen y respeten la legalidad (o es tan amplio que el agente acaba perdiéndolas de vista) el problema es de quien lo ha lanzado, ni siquiera de la IA en sí. Si las webs no están ya adaptadas a sistemas automatizados de búsqueda, cuando no son nuevos desde que los motores de búsqueda empezaron a indexar, el problema no es de los agentes ni de sus usuarios.

Todos los modelos (de empresas respetables: recordemos que los hay de código abierto y por tanto modificables) incluyen protecciones, "guardrails", que no son otra cosa que temas que no pueden tocar, enfoques que no pueden dar. Las empresas de IA tuvieron que empezar a adoptarlas no por temas de seguridad nuclear sino para evitar la proliferación de pornografía a medida en manos de menores: como en tantas ocasiones, la industria más antigua del mundo lidera el desarrollo tecnológico.

La otra presión que han recibido e implementado es la de la corrección política. Hay cosas que no van a decir pese a que se sigan de sus datos. Hay conclusiones fijadas a fuego.

En resumen, la IA (corporativa) sigue reglas, pero hay que ponerlas. Tanto desde el lado de los productores, como desde el lado de los que se encuentran (y se van a seguir encontrando) con agentes. Ya hay estándares para tratar con motores de búsqueda, como dije, y funcionan y se siguen (y sí, basta programar una herramienta para que ignore esas instrucciones, pero un modelo corporativo no puede hacerlo por las buenas). Hay que desarrollar e implementar puertas al campo para que la IA sepa dónde puede entrar y dónde no, qué puede hacer con los datos y qué no.

No se le puede pedir a una IA que entienda (no sólo aplique) un código legal completo, y menos todos los vigentes. Quien use esos agentes va seguir siendo responsable por orientar lo que hacen, los fabricantes por la capacidad de salirse del camino, y los demás agentes por dejar claro a sus visitantes digitales lo que les permiten hacer y lo que no. Hay que asumir que todo lo que no está claramente marcado como prohibido va a ser.

Los agentes de OpenAI no entraron en zonas realmente restringidas porque estaban aseguradas contra intrusiones. No simplemente fuera del ámbito normal del usuario humano, sino de hecho protegidas. Eso las pone donde debían estar: fuera del alcance de hackeos intencionados o accidentales, humanos o asistidos.

Cargando contenidos...

Y si nos fijamos, ese es el patrón de (casi) todas las "incursiones" de esos agentes, con algunas excepciones que sí tienen que ver con problemas de producto. Simplemente no tienen ni idea de dónde están los límites si no se lo decimos.