Tech Insights FinOps de IA: latência, tokens e alertas Controlar custo de LLM sem matar a qualidade da resposta. 11 de agosto de 2026