Cache de prompt

Reutilização de respostas já processadas para prompts idênticos, economizando tokens e tempo de processamento.