Custos de IA: como estimamos gasto a partir de tokens reais
Por equipe PowerVizion · · 5 min de leitura · Engenharia · Disponível
Resumo: O painel Uso & Custos da PowerVizion, sistema operacional cognitivo para empresas, registra os tokens reais que o provedor reporta em cada chamada de IA, por usuário, workspace e agente. O custo em dólar é uma estimativa feita por tabela de preços públicos por milhão de tokens. Se um modelo não tem preço cadastrado, o custo fica em branco em vez de ser chutado.
O que é um token e por que medir consumo por ele?
Token é a unidade em que os modelos de linguagem leem e escrevem texto: pedaços de palavras, números e sinais. Provedores de modelos cobram, em geral, por milhão de tokens, com preços diferentes para a entrada (o que se envia ao modelo) e para a saída (o que ele devolve).
Medir por token é a forma mais honesta de enxergar o consumo, porque ele reflete o trabalho real da chamada, e não o número de mensagens. Uma pergunta curta e uma análise longa com documentos anexos têm custos muito diferentes.
O que é medido e o que é estimado
A distinção central do painel é entre medir e estimar. Os tokens vêm do campo de uso que o próprio provedor devolve em cada resposta. Eles não são calculados pela PowerVizion nem inferidos do tamanho do texto. Já o custo em dólar é uma estimativa: multiplica os tokens de entrada e de saída pelos preços públicos por milhão de tokens cadastrados em uma tabela.
A interface repete essa diferença. O cabeçalho diz que os tokens são reais e que os custos são estimados, e o gasto do ciclo aparece como "gasto estimado". Uma conversão para reais usa uma taxa de câmbio configurável, e também é uma estimativa.
Exemplo ilustrativo, com preços inventados só para mostrar a conta: uma chamada com 10.000 tokens de entrada a US$ 1,00 por milhão e 2.000 tokens de saída a US$ 4,00 por milhão custaria US$ 0,01 mais US$ 0,008, ou US$ 0,018 no total. A PowerVizion faz essa mesma multiplicação, com os preços reais cadastrados para cada modelo.
O que cada evento de uso registra
Cada chamada de IA gera um evento com o workspace, o usuário, o agente (Victor, DAISY, ELISA, fluxos, o chatbot do site e outros), a funcionalidade de origem, o provedor, o modelo, os tokens de entrada e saída, o custo estimado e a data. O registro é feito em segundo plano e nunca derruba a chamada: se o rastreamento falhar, o agente continua respondendo, e a falha fica no log do servidor.
Eventos sem tokens, como respostas que o provedor não reporta, não são gravados. É uma escolha deliberada: um evento com zero não ajudaria em nada e poderia poluir as médias.
Registrar a funcionalidade de origem, e não só o agente, permite perguntas mais úteis. Dá para separar o custo de uma conversa com o Victor do custo de um fluxo agendado ou do chatbot embutido em um site, e entender qual parte do consumo é de uso interativo e qual é automação.
Como a PowerVizion lida com modelo sem preço
A regra é simples: modelo sem preço cadastrado resulta em custo nulo, nunca em um valor inventado. Na tabela por modelo, esses casos aparecem com o aviso "sem preço", com a explicação de que o custo não foi estimado.
Há um mecanismo de correção. Um recálculo idempotente varre os eventos que ficaram sem custo porque o modelo ainda não tinha preço na época, e aplica o preço agora cadastrado sobre os tokens reais já gravados. Nada é fabricado, e só as linhas com custo nulo e modelo conhecido são tocadas. Quando um modelo novo não tem preço próprio publicado, o código usa como referência conservadora o preço da versão imediatamente anterior, e deixa isso anotado.
Esse cuidado vale especialmente para custo, porque um número errado parece tão convincente quanto um número certo. Um campo em branco convida a perguntar por que falta preço. Um valor inventado encerraria a pergunta com uma resposta falsa.
As visões do painel Uso & Custos
O resumo reúne totais do período, a série diária (com os dias contados no fuso de São Paulo), o consumo por agente, o consumo por modelo com o custo estimado e a franquia de tokens do plano. O consumo do ciclo é contado desde o início do período, e o ciclo rola sozinho a cada mês. Os eventos individuais ficam disponíveis como trilha de auditoria.
O limite de tokens e o orçamento do plano são definidos pela plataforma, e a edição pelo próprio cliente está desativada. A aplicação de bloqueio ao atingir o limite é controlada por uma chave global da plataforma, de modo que o painel serve primeiro para enxergar o consumo. A visibilidade vem antes do bloqueio.
Limites atuais
A tabela de preços é mantida manualmente a partir de preços públicos e precisa ser conferida periodicamente. Se um provedor mudar o preço, a estimativa fica defasada até a atualização. O valor também pode diferir de uma fatura real por impostos, descontos negociados, arredondamentos e câmbio.
Por isso, use o painel para comparar agentes, modelos e dias, identificar picos e planejar a franquia. Para conciliação financeira, a fonte final continua sendo a fatura do provedor. O painel não promete centavos exatos.
Perguntas frequentes
Os tokens do painel são estimados ou reais?
São reais: vêm do campo de uso retornado pelo provedor em cada chamada. O que é estimado é o custo em dólar, calculado por tabela de preços.
O que acontece se um modelo não tem preço na tabela?
O custo daquele evento fica em branco e a tabela exibe o aviso de que não foi estimado. A PowerVizion não inventa preços.
O painel mostra consumo por agente?
Sim. Há visões por agente, por modelo e por dia, além da lista de eventos individuais para auditoria.
O custo estimado é o mesmo da fatura do provedor?
Não necessariamente. É uma estimativa por preços públicos e pode divergir por descontos, impostos, arredondamentos e câmbio.
#CustosDeIA #Tokens #UsoECustos #GovernancaDeIA #FinOpsDeIA
Guardrails e custos na PowerVizion · Soluções para TI · Segurança e governança
Quer ver o consumo de IA da sua empresa por agente e por dia? Teste a PowerVizion grátis por 7 dias, sem cartão de crédito. contato@powervizion.com