Um agente que responde lead, escuta áudio, consulta o catálogo e lê o documento que o cliente fotografa não tem um preço — tem cinco. Cada fornecedor cobra em uma unidade diferente, e nenhum deles soma a conta para você. Aqui ela está somada, com a fórmula à mostra.
O preço que o fornecedor publica responde “quanto custa mil tokens”. A pergunta do dono é outra: quanto custa atender mil conversas. Entre as duas há cinco linhas de custo, cobradas em unidades que não se comparam entre si até serem normalizadas.
A conversa em si: instrução do agente, histórico e resposta. É onde o preço do modelo pesa.
US$ por milhão de tokensO cliente manda áudio. Alguém transcreve — o próprio modelo ou um serviço dedicado, 9 vezes mais barato.
US$ por hora de áudioCada resposta sobre produto carrega o trecho recuperado do catálogo. Ele entra como token de entrada, toda vez.
US$ por milhão de tokensNota, comprovante, ficha. Cobrado por página no serviço dedicado e por token no modelo de visão.
US$ por mil páginasA mensagem que sai e entra pela API Oficial do WhatsApp. Não é IA, e costuma ser a maior das cinco.
US$ por mensagemA base de transporte usada aqui é a mesma do nosso material sobre a mudança de cobrança da API Oficial: US$ 0,0068 por mensagem fora de template, valendo a partir de 1 de outubro de 2026. A conta está aberta em calculadora-whatsapp.ibusiness.ia.br.
Três trilhas, três unidades. Filtre por coluna, ordene clicando no cabeçalho. Cada linha carrega a página oficial de onde o preço saiu, e o que não estava publicado está marcado como tal.
Em agosto de 2026 medimos três leitores de documento sobre fotos reais de ticket de pesagem de uma transportadora nossa cliente: 3 fotos, 2 passadas por foto, 12 campos que entram no cálculo, gabarito lido a olho. O placar deu praticamente empate. O que separou os leitores foi o jeito de errar.
Dá para concluir: em documento que vira dinheiro, o erro que se anuncia é barato e o erro que se disfarça é caro. Um para o processo e pede olho humano; o outro vira número errado com cara de certo, e chega ao ERP.
Não dá para concluir — e por isso está escrito aqui em vez de escondido no rodapé:
Conversa de WhatsApp com cliente carrega nome, telefone, CPF e, quando entra documento, muito mais. Isso é dado pessoal sob a LGPD, e o critério elimina fornecedor antes de qualquer comparação de preço.
O que esta coleta verificou: os quatro fornecedores comparados aqui publicam preço, e nenhum deles publica, na página de preço, residência de processamento no Brasil. Existem mecanismos de controle de região — a Anthropic expõe um parâmetro de região de inferência por requisição, e o Google permite fixar a região no Vertex AI —, mas não confirmamos residência brasileira para nenhum dos quatro nesta coleta. Quem afirmar o contrário sem o contrato na mão está chutando.
Enquanto essas cinco não estiverem respondidas por escrito, o comparativo de preço abaixo é exercício, não decisão.
Mesma fórmula da calculadora, aplicada a três perfis. Todos os valores em reais, câmbio de 3 de setembro de 2026. Cada total é a soma exata das cinco contas — se não fechasse, não estaria publicado.
Os perfis usam 6 mensagens por conversa, 2 consultas ao catálogo por conversa e as premissas de token declaradas no fim da página. Quem tem operação diferente muda os números na calculadora.
Este é o ponto em que quase todo comparativo mente por conveniência. Na conta pura, o modelo barato único ganha de todo mundo. O roteador multi-modelo custa mais que ele — e ainda assim é o que recomendamos, porque o que ele compra não é preço, é o comportamento certo em cada tipo de tarefa.
Se o critério for exclusivamente custo, use um modelo barato único e pare de ler aqui — a tabela acima mostra que ele ganha. O roteador se justifica quando a operação tem casos que o modelo pequeno atende mal e a conta de errar é alta: proposta comercial, negociação de preço, leitura de documento que vira lançamento. A diferença mensal entre as duas arquiteturas costuma ser menor que uma hora de retrabalho humano.
Preencha o volume e veja o custo mensal em reais, decomposto nas cinco contas. A conta roda no seu navegador, com os preços coletados em 3 de setembro de 2026.
Cotação de 3 de setembro de 2026. Edite se quiser trabalhar com outra.
Nenhum comparativo de custo de IA é neutro: o resultado depende de quantos tokens você assume por mensagem. As nossas premissas estão aqui, e é por isso que a calculadora deixa você mudar o volume mas não esconde a fórmula.
Estas premissas são da ibusiness, não dos fornecedores. Uma operação com prompt de sistema maior, histórico mais longo ou trecho de catálogo mais gordo terá custo de texto proporcionalmente maior — a ordem entre os modelos, porém, não muda.
Preço marcado como fonte secundária é aquele cuja página oficial não exibia o valor no dia da coleta, ou retornou erro. Nesses casos usamos publicação de terceiro que cita a mesma página, e sinalizamos. Nada nesta página é estimado.