Un solo enunciado como "system prompt" provocó respuestas inventadas en un bot de facturación
El autor descubrió que su bot de soporte usaba un prompt de una sola frase, lo que llevaba a generar cifras de reembolso falsas hasta que añadió reglas explícitas.
Un ingeniero de soporte compartió que su bot de facturación respondía con montos de reembolso inventados porque el system prompt consistía en una sola oración: "You are a helpful assistant for our billing platform, answer questions politely and accurately." Sin directrices sobre cómo actuar ante datos ausentes, el modelo rellenaba el vacío con cifras plausibles en vez de admitir desconocimiento.
Al añadir una regla explícita –"no declarar un importe en dólares a menos que se haya proporcionado en la conversación; si no lo tienes, dilo directamente"– el comportamiento erróneo desapareció de inmediato. Lo mismo ocurrió con la longitud de las respuestas: al no definir un formato, el modelo variaba entre respuestas breves y extensas según la formulación de la pregunta.
El autor revisó todo el system prompt, incorporando un rol claro, un objetivo concreto, restricciones explícitas, un formato nombrado y tono definido, además de una sección para casos límite que solo aparecen tras fallos. El desglose completo está disponible en Medium.
Esta experiencia subraya que, aunque los LLM son potentes, dependen de instrucciones precisas. Un prompt pobre puede generar datos falsos, lo que impacta la confianza del usuario y la fiabilidad del servicio. La lección para equipos de IA es revisar y estructurar los system prompts con reglas claras y manejo de excepciones antes de lanzar cualquier asistente al cliente.

