Ese historial se reenvía completo en cada turno junto con el system prompt y las tools — con Gemini como proveedor principal, sin acceso fácil a caching de contexto (su API de caching no pasa por la capa de compatibilidad OpenAI que usamos), la forma más directa de bajar el costo por mensaje en charlas largas es mandar menos historial repetido. Co-Authored-By: Claude Sonnet 5 <noreply@anthropic.com>