Visão geral
Toda vez que a plataforma usa um modelo de IA — o Robô respondendo um cliente, um painel sendo gerado, o briefing do onboarding, o juiz de qualidade, o copiloto, uma chamada de voz — isso tem um custo em dólares, medido no momento da chamada. A aba Consumo do Cérebro reúne esses custos e responde a pergunta que aparece toda vez que chega a fatura: quanto ESTA conta gastou, e com o quê.
O número não é uma estimativa. É a soma das medições feitas em cada chamada: quantas chamadas, quantos tokens entraram, quantos saíram, quantos vieram do cache do provedor (que são cobrados mais barato) e quanto custou.
Pré-requisitos
- O módulo Cérebro precisa estar habilitado na conta.
- Você precisa ser administrador. Essa é a única leitura do Cérebro restrita a administradores, e o motivo é simples: informação de fatura é diferente de informação de atendimento. Um agente que lê a caixa de entrada não precisa ler a conta a pagar.
- O serviço de IA precisa estar acessível. Se não estiver, a tela mostra um erro — nunca zero.
Passo a passo
- Abra Cérebro no menu lateral.
- Vá até a aba Consumo.
- Escolha o período no canto superior direito: 7, 30 ou 90 dias. A janela é a pergunta: trocar o período recarrega os números.
- Leia de cima para baixo:
- os quatro cartões resumem o período inteiro — custo, chamadas, tokens e tokens em cache — e cada um traz embaixo a média que costuma ser a próxima pergunta: custo por dia, chamadas por dia, tokens por chamada e quanto da entrada veio do cache (é o desconto do provedor: quando essa porcentagem cai, a fatura sobe sem o volume mudar);
- o gráfico mostra o gasto dia a dia, com a escala à esquerda, as datas embaixo, o dia de pico destacado e, no rodapé, em quantos dias do período houve gasto — uma linha quase reta com "3 de 90 dias com gasto" é uma informação, não um gráfico vazio;
- as listas abaixo quebram o mesmo total por superfície, por modelo e por Robô, cada linha com a sua fatia do total, o número de chamadas e o custo por chamada;
- a seção Por conversa lista as conversas mais caras do período, com link para abrir a conversa, o custo dela, quantos turnos teve e o custo por turno.
- Use a barra de filtros no topo para cruzar as perguntas: superfície, modelo, Robô e conversa. Os filtros combinam entre si e refazem a leitura — não escondem linhas na tela, eles mudam a consulta. Filtrar por um Robô e ver o total cair é a confirmação de que aquele Robô responde por aquela fatia.
Valores abaixo de um centavo aparecem com as casas decimais necessárias (por exemplo US$ 0,004933).
Uma chamada de modelo custa frações de centavo: arredondar para duas casas mostraria US$ 0,00, que
se lê como "nada foi medido".
Por conversa
Até aqui a tela respondia "quanto a conta gastou". Por conversa responde "quanto ESTA conversa custou" — que é a pergunta que aparece quando uma conversa específica se arrasta, ou quando alguém quer saber se um atendimento saiu caro.
O custo de uma conversa inclui o que ela gastou fora do turno de resposta: a transcrição do áudio que o cliente mandou, o áudio que o Robô respondeu, a chamada de voz. Antes essas coisas ficavam numa linha que não conseguia ser ligada de volta à conversa que as causou.
Sub-agente e delegação. Quando um Robô delega para um sub-agente, os tokens do sub-agente já são contados no turno de quem chamou. A tela mostra a delegação para você saber que ela aconteceu, mas o custo dela não é somado de novo — somar seria contar os mesmos tokens duas vezes e inflar justamente o número que esta tela existe para ser confiável.
Superfícies sem preço
Nem tudo que consome IA tem tabela de preço. Transcrição de áudio é cobrada por segundo, síntese de
voz por caractere, imagem e vídeo por unidade — e a plataforma não tem a tabela de preços dessas
cobranças. Então elas aparecem contadas e etiquetadas, com a medição na unidade delas ("3.412
caracteres sintetizados"), e nunca como US$ 0,00.
A distinção é o ponto: US$ 0,00 se lê como "isso foi de graça". Uma superfície etiquetada como sem
preço se lê como "isso consumiu, e a plataforma não sabe quanto custou" — que é a verdade. O total
com preço continua sendo um total confiável; ele apenas não é a fatura inteira, e a tela diz isso em
vez de deixar você somar errado.
Configurações & opções
Não há o que configurar aqui: a aba é somente leitura. O que muda os números é o uso — quantas conversas o Robô atende, quantos painéis são gerados, se o juiz de qualidade está amostrando turnos, e qual modelo cada Robô usa.
Para mudar o modelo (e portanto o custo por chamada) de um Robô, use a tela de Robôs. Para mudar quem grada a qualidade, use a atribuição de superfície do Cérebro.
Casos de uso
- Fechar o mês. Você recebe a fatura do provedor e quer saber quanto dela é desta conta.
- Descobrir onde está o gasto. Quase sempre a resposta é "respostas ao cliente" — é a superfície que roda mais vezes. Quando não é, vale olhar: um painel gerado repetidamente ou um juiz apontado para um modelo caro aparecem imediatamente na lista por superfície.
- Comparar Robôs. A quebra por Robô mostra qual deles consome mais, o que costuma refletir volume de conversa, não desperdício — mas às vezes reflete um modelo caro escolhido sem necessidade.
- Ver o efeito do cache. Tokens em cache são cobrados com desconto. Um número alto ali significa que o prompt do sistema está estável e sendo reaproveitado; uma queda brusca costuma indicar que algo no prompt mudou.
- Investigar uma conversa cara. A seção Por conversa ordena pelo custo. Abrir a mais cara e olhar quantos turnos ela teve separa duas causas diferentes: uma conversa longa (muitos turnos baratos) e uma conversa pesada (poucos turnos caros, normalmente modelo grande ou muito contexto).
- Descobrir o custo de voz. Filtre pelas superfícies de áudio para ver quanto de transcrição e de síntese a conta consumiu — em segundos e caracteres, já que preço em dólar não existe para elas.
Dicas, limites e boas práticas
- Os valores são em dólar (US$). É a moeda em que o provedor cobra e em que a medição foi feita. Converter aqui para real inventaria uma taxa de câmbio que a plataforma nunca observou.
- A quebra por modelo é parcial, e a tela diz isso. As respostas ao cliente são medidas sem guardar qual modelo respondeu, então o custo delas entra no total, na quebra por superfície e no gráfico diário, mas não na lista por modelo. Quando isso acontece, aparece uma linha dizendo quanto daquele total a lista cobre. Somar só a lista por modelo e achar que é a conta toda é o erro que essa linha existe para evitar.
- Sem gasto no período não é erro. Se a conta realmente não usou IA, a tela explica isso. Se o serviço estiver fora do ar, ela mostra um erro com botão de tentar de novo. As duas situações são diferentes e a tela nunca troca uma pela outra.
- A janela máxima é de 365 dias. Períodos maiores são recortados, não recusados.
- Um dia sem gasto aparece no gráfico como um dia sem gasto — não como um buraco na linha.
Solução de problemas
A aba não aparece. O módulo Cérebro está desabilitado na conta, ou você não é administrador.
Aparece um erro em vez dos números. O serviço de IA não respondeu. Nada é mostrado como zero de propósito: um valor inventado aqui seria pior que a ausência dele. Use Tentar de novo; se persistir, é caso para o responsável pela instalação.
O total não bate com a fatura do provedor. Duas causas comuns: a fatura cobre a instalação inteira (todas as contas) e esta tela cobre uma conta; e a tabela de preços usada na medição pode estar desatualizada em relação ao provedor. Fale com o responsável pela instalação.
A lista por modelo soma menos que o total. É esperado, e a tela avisa — veja "Dicas, limites e boas práticas" acima.
Uma superfície aparece com chamadas e sem valor em dólar. É de propósito: transcrição, síntese de voz, imagem e vídeo não têm tabela de preço na plataforma. A medição delas está na unidade própria (segundos, caracteres, unidades). Isso é diferente de custo zero, e a etiqueta existe exatamente para você não confundir as duas coisas.
As somas por superfície e por conversa não fecham exatamente. Uma conversa só aparece em "Por conversa" se o gasto dela pôde ser ligado a ela. Trabalho da conta que não pertence a nenhuma conversa — um painel gerado, o briefing do onboarding, o ciclo diário de melhoria — entra no total e nas superfícies, e corretamente não entra em nenhuma conversa.