BookinglyTech News
Software

Revisar la ruta de los prompts: cómo evitar fugas de secretos

Cada solicitud a un modelo remoto expone datos; la clave es clasificar y empaquetar antes del envío.

2 min de lecturaDev.to0 vistas

El problema de la fuga de datos

Cada prompt que envías a un modelo en la nube es un evento de egreso. Una vez que el paquete sale de tu máquina, la información ya no está bajo tu control. Si el contenido incluye secretos, credenciales o rutas internas, esos datos se exponen al servidor del modelo. Para los equipos que dependen de compiladores remotos o generadores de código, esto representa un riesgo real.

¿Qué debe contener la revisión?

El proceso comienza con una política local que decide qué archivos se incluyen en el pack. Se definen listas de allow y deny, con un límite de tamaño por archivo y de número total de archivos. Los archivos que coincidan con los patrones de la lista deny se excluyen, y cualquier coincidencia con expresiones regulares que busquen patrones típicos de secretos provoca un abortado del envío.

El flujo típico es:

  1. Editor local lee el árbol de trabajo.
  2. Gate local clasifica cada ruta: allow, deny, unlisted, too_large, secret.
  3. Se crea el pack con los archivos ok.
  4. Se envía a la capa remota de generación.
  5. Se recibe un patch artifact que se revisa antes de aplicar.

Esta cadena mantiene cuatro dominios de seguridad: el árbol de trabajo, el pack exportado, el servicio remoto y el patch revisado. No compartir credenciales entre estos dominios evita que una fuga en un dominio se convierta en un ataque.

Ejemplo práctico: egress_policy.yml

Un archivo típico de política luce así:

allow:
  - "src/**/*.py"
  - "tests/**/*.py"
  - "README.md"
deny:
  - "**/.env*"
  - "**/*secret*"
  - "**/credentials*"
  - "**/*.pem"
  - "ops/**"
max_file_bytes: 65536
max_pack_files: 40

El script de Python que acompaña a la política actúa como inspector de la dock. Se ejecuta en un clon descartable y verifica cada archivo contra las reglas, abortando si se detecta un secreto.

Por qué importa

Los equipos que usan generación remota de código deben adoptar este enfoque antes de desplegar un modelo. Ignorar el control de egreso equivale a enviar un paquete completo del repositorio a un tercero sin inspección; la consecuencia puede ser la exposición de credenciales o la propagación de vulnerabilidades internas.

El siguiente enlace muestra la publicación original en Dev.to, donde se detalla la política y el script.

Revisión de la ruta de los prompts