BookinglyTech News
Inteligencia artificial

Stack Overflow for Agents añade plugin de ChatGPT y Playbooks

La plataforma de intercambio de conocimiento para agentes cumple tres meses y estrena un cuarto tipo de publicación, más control del usuario sobre lo que sus agentes comparten.

2 min de lecturaStack Overflow Blog0 vistas

Stack Overflow ha añadido un plugin de ChatGPT a Stack Overflow for Agents, su intercambio de conocimiento pensado para agentes de IA, y ha estrenado un cuarto tipo de publicación llamado Playbooks. La plataforma cumple tres meses y la compañía admite que sigue sin pruebas cuantitativas de que esto sirva para algo.

Qué hay nuevo

El plugin empaqueta las capacidades que ya existían en un único componente instalable de OpenAI. Hasta ahora había que ejecutar o instalar la skill a mano; con esto el usuario lo mete una vez y desaparece el tiempo de puesta en marcha. Es el enlace de instalación que la compañía ha publicado junto al anuncio.

Playbooks se suma a Questions, TIL y Blueprint, los tres tipos que había desde el lanzamiento. La diferencia es de granularidad: un Blueprint es un patrón de especificación reutilizable para una clase general de problemas; un TIL, un arreglo puntual para el caso concreto de un usuario; un Playbook es memoria procedural estructurada y con límites de aplicabilidad explícitos. El motivo es que en estos tres meses vieron que los agentes publicaban descubrimientos que no encajaban limpiamente en ninguna de las tres categorías anteriores.

También hay cambios en el control de lo que se publica. El usuario decide cuándo se le mete en el bucle: en local, como borrador, justo antes de publicar o nunca, dejando que el agente actúe de forma autónoma. Para quien trabaja con código propietario se añadió un modo de solo lectura, de manera que sus agentes aprenden de lo que hay publicado sin aportar nada. Las protecciones automáticas de datos personales van dentro de las guías de contexto y de la moderación.

Confianza y validación

La plataforma arrastra puntuaciones de confianza y pasarelas de validación desde el diseño inicial. La reputación del usuario se conecta a las publicaciones de su agente, y cuando un agente aplica el hallazgo de otro, lo verifica y propone correcciones. La compañía describe el resultado como un ciclo virtuoso y dice haberlo visto ocurrir de forma anecdótica en buena parte de las publicaciones.

El argumento de fondo es lo que ellos llaman la brecha de inteligencia efímera: un agente quema cómputo y tokens resolviendo un cambio de API roto, y en cuanto se limpia la ventana de contexto el resultado desaparece, así que el siguiente agente que se topa con lo mismo repite el trabajo desde cero. Es el problema que Stack Overflow resolvió para los desarrolladores hace casi veinte años, aplicado ahora a procesos.

Lo que no hay en el anuncio son cifras. Ni número de agentes registrados, ni de publicaciones, ni precio, ni detalles de licencia del servicio. Los propios responsables escriben que solo tienen evidencia anecdótica y que quieren prueba cuantificable del valor de un intercambio de conocimiento entre agentes, y que para conseguirla van a seguir construyendo. Para un equipo que esté evaluando esto ahora mismo: el valor depende de que otros agentes publiquen y verifiquen, y eso todavía está por demostrar.