Atendimento
1.000 conversas por mês, com GPT-5.6 Luna
R$ 84.662
- Modelo, 12 meses
- R$ 62
- Infraestrutura, 12 meses
- R$ 3.600
- Implementação
- R$ 45.000
- Operação, 12 meses
- R$ 36.000
Peso do modelo: 0,1% (com infraestrutura, 4,3%)
Relatório da Waxi, edição de setembro de 2026
Um guia de orçamento com preços em reais e data na capa. A tarifa da API é só uma parte da conta: nos três cenários do relatório, o modelo vai de menos de 1% a cerca de 12% do custo. É no resto que os projetos costumam morrer.
Preencha os três campos e enviamos o arquivo para o seu e-mail.
Quanto custacolocar agentes de IAem operação
Guia de orçamento para empresas. 21 modelos comparados em reais, três cenários completos, e a conta de equipe interna, consultoria e ferramenta pronta.
Este é um dos orçamentos que a Waxi enviou em 2026, com os valores arredondados e sem identificar o cliente: um agente de atendimento integrado ao CRM, com 3.000 conversas por mês. Serve de referência para empresas de 50 a 500 pessoas. Cobre a implementação e os 12 primeiros meses de operação, e o relatório abre essa conta em seis linhas.
Tokens consumidos na API do provedor
R$ 2.400 (R$ 200 por mês), na operação
Hospedagem do agente, banco vetorial, filas, monitoramento e logs
R$ 4.800 (R$ 400 por mês), na operação
Conectar ao CRM, ao WhatsApp e ao sistema de suporte; tratar o que não tem API
R$ 30.000, semanas 2 a 10
Levantar, limpar e estruturar a base de conhecimento; adequação à LGPD
R$ 18.000, semanas 1 a 8, e a cada mudança
Treinar quem opera, quem revisa e quem decide; redesenhar o processo
R$ 12.000, antes de ir ao ar e nos 3 meses seguintes
Revisão humana de amostra, ajuste, migração quando o provedor troca de modelo, suporte
R$ 48.000 (R$ 4.000 por mês), do dia em que vai ao ar, para sempre
Modelo e infraestrutura são as únicas linhas com tabela de preço pública, e por isso são as únicas que todo mundo calcula. A maior linha é quase sempre a última, que quase nunca aparece em proposta: um agente em produção erra, o provedor troca de modelo a cada dois ou três meses, o processo da empresa muda. Cada uma dessas coisas é hora de gente.
Valores que a Waxi pratica para esse escopo, não média de mercado. Em outro escopo os números mudam; o formato, não.
Faixa solta não dá para somar. O relatório fecha três cenários com a mesma régua: implementação mais os 12 primeiros meses de operação. A largura de cada barra é o total; as cores, o que compõe a conta.
1.000 conversas por mês, com GPT-5.6 Luna
R$ 84.662
Peso do modelo: 0,1% (com infraestrutura, 4,3%)
2.000 leads por mês, com Claude Sonnet 5
R$ 135.913
Peso do modelo: 0,8% (com infraestrutura, 4,4%)
20.000 documentos por mês, com Claude Opus 5
R$ 235.821
Peso do modelo: 11,8% (com infraestrutura, 16,9%)
Nos dois primeiros cenários, que são a maioria dos projetos, modelo e infraestrutura juntos não chegam a 5%. No terceiro, com 20 mil documentos por mês num modelo da faixa alta, o modelo sobe para quase 12%: é o caso em que a escolha importa de verdade, e onde batch e cache podem cortar essa linha pela metade. O relatório mostra a conta de cada um, token por token.
Receber o relatório completo42% das empresas abandonaram a maior parte das iniciativas de IA. Um ano antes, eram 17%.
Um orçamento real de R$ 115.200 aberto linha a linha, e a regra de 4% a 8% ao mês para operação.
11 modelos de OpenAI, Anthropic e Google, de R$ 1 a R$ 52 por milhão de tokens, com batch, cache e contexto longo.
10 modelos, três rotas de acesso e a conta de quando GPU própria fecha (quase nunca pelo preço).
Atendimento, SDR, análise documental e back-office: implementação de R$ 30 mil a 120 mil.
O que S&P, Gartner, MIT e McKinsey medem de verdade, e o que os 6% de alto desempenho fazem de diferente.
Sete parcelas que aparecem depois da aprovação. Cada sistema sem API soma R$ 10 mil a 40 mil.
O mesmo escopo custa de R$ 25 mil a R$ 1,07 milhão conforme a rota. A conta está aberta.
Payback em 6,3 meses e ROI de 42,9% no exemplo, ou 23,3% quando se conta desde a contratação.
13 perguntas para levar à reunião. Mais de três respostas "não sei" pedem diagnóstico antes de aprovar.
Cada um chega com uma pergunta diferente. Não precisa saber o que é um token para ler: o relatório explica quando aparece, sempre com exemplo em reais.
“O investimento se paga? Em quanto tempo, e com que chance de chegar ao resultado?”
“O que muda no processo, e quem cuida do agente depois que ele vai ao ar?”
“Qual é o total, quando cada parcela aparece e o que ficou de fora da proposta?”
“Qual modelo, por qual rota de acesso, e onde o dado do cliente é processado?”
Agentes sob medida para a operação da empresa
Os preços dos modelos foram consultados nas páginas oficiais dos provedores em 18 de setembro de 2026 e convertidos pela PTAX de venda do dia anterior, R$ 5,1521 por dólar. Os benchmarks internacionais foram lidos na fonte, e o relatório explica o que cada pesquisa mede de verdade, inclusive o tão citado 95% do MIT.
As faixas de implementação e operação são referências da Waxi para o escopo descrito em cada exemplo, com base em propostas e projetos de 2025 e 2026. Não são média do mercado brasileiro. Onde o número é estimativa nossa, está escrito que é.
Os preços mudam a cada trimestre. Por isso o relatório tem data na capa e é atualizado a cada corte de preço relevante ou a cada trimestre, o que vier antes.
Quem chega só com o preço do token descobre o resto na fatura. O relatório traz os preços em reais, os cenários fechados e o checklist de 13 perguntas para aprovar o número certo.