Consultoria e otimização de custo de IA
Duas coisas drenam operação de IA em silêncio: gasto de token que ninguém mede, e a mudança de preço do WhatsApp que passou a cobrar resposta que antes era de graça. A gente reconstrói o passado antes de projetar o futuro.
O que mudou e por que a conta não fecha mais
Desde novembro de 2024 responder cliente dentro da janela de 24 horas no WhatsApp era de graça. Isso acabou. No exemplo publicado pela própria Meta, uma interação de cinco mensagens que custava uma cobrança em julho custa três hoje e cinco a partir de 1º de outubro, porque a mensagem de serviço e o template de utilidade enviado em resposta deixaram de vir junto.
Do lado do modelo, o problema é outro e é pior de enxergar: modelo de raciocínio gera tokens de pensamento que você não vê mas paga, de três a dez vezes o preço de tabela. Quem não separa o gasto por funcionalidade descobre isso na fatura.
Como o trabalho é feito
Reconciliação antes de qualquer projeção
A gente reconstrói suas últimas três faturas a partir dos seus próprios dados. Se a nossa conta não reproduzir o que você pagou de verdade, a gente te avisa e não projeta. Só depois que o passado bate é que o futuro vale alguma coisa.
Custo atual por categoria
Onde o dinheiro está indo: por tipo de mensagem, por funcionalidade, por modelo e por cliente, quando o seu produto tem clientes.
Projeção no seu volume real
O cenário pós-outubro calculado em cima do seu volume, não em cima de média de mercado. Três cenários comparados lado a lado.
As ações ranqueadas por economia
O que cortar primeiro, com quanto cada mudança economiza por mês. Se a resposta for que você mesmo consegue fazer as três primeiras, é isso que a gente vai dizer.
O que você recebe
- Relatório com o custo atual detalhado por categoria e por funcionalidade.
- Projeção pós-outubro no seu volume real, com três cenários comparados.
- Lista de ações ranqueada por economia mensal, com o esforço de cada uma.
- A planilha aberta por trás do número, para o seu financeiro conferir linha a linha.
- Tabela de preços versionada com hash, para que o número tenha procedência e não seja palpite.
- Uma hora de call para percorrer o documento. Sem discurso de venda: cerca de um terço dos clientes implementa sozinho.
Uma janela de conversa devolve um número plausível na hora. Ela não diz qual versão da tabela de preços usou, se o seu país tem faixa de volume naquela categoria, nem se aquilo bate com o que você pagou mês passado. Quando estar errado é caro, plausível não serve. O que a gente entrega é um número que você leva ao financeiro e defende, com a reconciliação das suas faturas atrás.
Regras deste serviço
Não precisamos de acesso aos seus sistemas: exportação de relatório e as faturas bastam.
Se você ainda não está na API oficial, a gente audita o que existe e diz quanto a migração custaria e economizaria. Achados diferentes, mesmo preço.
O simulador de outubro expira em 01/10/2026. Depois disso o serviço continua como otimização de custo de IA, sem o gancho do prazo.