
Tres niveles de caché para dejar de pagar dos veces la misma respuesta de un LLM
El patrón es el de toda la vida: huella de las entradas, comparar y saltarse el trabajo si nada cambió. Aplicado a las llamadas a modelos, evita pagar tokens por respuestas que ya tienes.





