Un patrón de prompt obliga al agente a citar la norma antes de publicar
El autor de un kit para operar Reddit desde Claude Code y Codex añade a su prompt una regla: citar la norma y las cifras desde la fuente, nunca de memoria.
Dejar que un agente publique en tu nombre en un foro tiene un problema previsible: se salta normas que nunca llegó a leer. Quien está detrás de ThreadFox, un kit para manejar cuentas de Reddit desde Claude Code y Codex, ha añadido a su prompt una regla después de cuatro días de uso real. Antes de cualquier acción que otros vayan a ver, el agente tiene que citar la evidencia en la que se apoya, copiada de una fuente que acabe de leer. Ni parafraseada ni recordada.
El patrón, tal y como lo describe su autor en el propio foro:
Before you post, reply or state a number, write an EVIDENCE block:
1. The exact rule text that permits this post in this community, quoted from the rules page read today, with its number.
2. Any rule that could forbid it (promotion, AI text, flair, links, frequency), quoted, with why it doesn't apply.
3. The community's own description, next to one line on how the post fits it.
4. Every number in the draft, with the record it came from.
If you can't quote it, don't do it. Say what's missing.
Los fallos que persigue no son hipotéticos. El agente resumía las reglas de memoria, así que una lectura truncada de la página hizo que nunca viera un "Don't use bots" que estaba en el punto 9, y aun así respondió en esa comunidad. Las cifras también se le movían: en dos ocasiones escribió "30-40 views" para publicaciones cuyo rango real era 200-400, después de fusionar dos conjuntos de datos que había visto antes. Y tres de las cinco retiradas recientes ocurrieron en comunidades de propósito estrecho, dedicadas a un motor o a un género de juego concretos, donde el contenido encajaba con sus intereses pero no con los de la comunidad.
Por qué citar y no "revisar"
El autor lo explica con una distinción que vale para cualquier agente: pedirle que "revise las reglas" devuelve un resumen con tono seguro, mientras que pedirle que "cite la regla" le fuerza a ir a buscarla. Y cuando la búsqueda falla, el hueco se ve. El cuarto punto del bloque es el que convierte la instrucción en una comprobación de integridad de los datos: cada número del borrador tiene que ir acompañado del registro del que salió.
El patrón no depende de Reddit. Cualquier agente que escriba en un sistema del que no es dueño —un gestor de tickets, un repositorio, una API pública, un correo a un cliente— arrastra los mismos tres riesgos: normas mal resumidas, cifras que se degradan al pasar por el contexto y contenido correcto en el sitio equivocado.
Dos cautelas sobre el material. Los datos son de una sola cuenta y de cuatro días, medidos por quien vende el kit, y no hay ninguna comparación contra un grupo de control que demuestre que el bloque de evidencia reduce las retiradas. El autor tampoco publica los prompts completos de sus agentes, solo el extracto. Aun así, la idea es trasladable hoy mismo: si tu agente va a actuar donde otros lo leen, hazle enseñar el papel antes de firmar.

