Quando uma LLM chega à produção, não basta criar bons prompts: também precisamos entender quanto cada requisição consome.