Synthor

Synthor · Pricing Calculator

Veja exatamente quanto seu agente vai custar.

Simulação real baseada nos templates do Synthor. Escolha um template, ajuste turnos, modelo e canal — descubra qual plano cabe na sua operação.

Comece com um template real

Estes são os mesmos templates de agente usados em produção no Synthor. Clique em um pra simular ao vivo embaixo — você pode trocar de template a qualquer momento.

Glossário rápido

Os termos que aparecem nos cálculos, em uma linha cada — com exemplo.

Token

Pedaço de palavra. Em português, ~3–4 letras viram 1 token.

Modelos de IA não trabalham com letras nem palavras inteiras — cortam o texto em tokens. Tudo que entra e sai do modelo é contado em tokens, e o preço é por token.

"Olá, tudo bem?" → [Olá] [,] [ tudo] [ bem] [?]

≈ 5 tokens

Turno

1 mensagem do usuário + 1 resposta do agente.

A cada turno, o agente recebe de novo tudo que foi conversado antes — não só a mensagem nova.

"Vocês atendem no WhatsApp?"
"Atendemos sim, no mesmo número."

↑ turno 1

FAQ ~3 turnos · Atendimento ~12 · Caso longo ~25.

Histórico

Cresce a cada turno. Por isso conversa longa custa mais.

O modelo precisa "lembrar" do que foi dito antes. A cada turno, tudo é reenviado. Por isso o turno 10 custa muito mais que o turno 1.

Turno 1 input: ~480 tokens

Turno 5 input: ~2.000 tokens

Turno 10 input: ~4.000 tokens

Tool call

Quando o agente busca info externa (CRM, banco, web).

Cada tool call adiciona ~150 tokens de input (do retorno da tool) e uma chamada extra ao modelo pra interpretar o resultado.

Sem tool: 1 chamada ao modelo

Com tool: 2 chamadas (decidir + responder)

Limite do checkpointer

Depois de ~15 mensagens, as antigas são descartadas.

Conversa não cresce pra sempre. O Synthor mantém no máximo ~15 mensagens (~8.000 tokens) em memória. Quando passa, mensagens antigas saem automaticamente.

Por isso conversas longas têm custo crescente até esse ponto e depois estabilizam.

System prompt

As instruções fixas do agente — vão junto em toda mensagem.

É o "manual" do agente: como ele deve se comportar, qual o tom, quais regras seguir. Esse texto é enviado em todo turno junto com a conversa.

Cortar 200 tokens do system prompt economiza 200 tokens × N turnos. Vale a pena enxugar.

Agente vs Supervisor

Agente faz 1 chamada por turno; Supervisor delega pra outros.

Agente é um único responsável que responde direto ao usuário (1 chamada ao modelo por turno).

Supervisor coordena uma equipe de agentes especializados. Cada turno tem múltiplas chamadas: delegação → cada agente responde → consolidação. Custa K vezes mais que um agente simples.

Canal e multiplicador

Voz e Gmail têm overhead de +50%; outros canais não.

Cada canal aplica um multiplicador no custo final por causa de overhead extra de processamento (transcrição, parsing, formatação).

WhatsApp · Telegram · Instagram · Chat Widget: (sem overhead)

Voz · Gmail: 1.5× (+50%)

Tier do modelo

Economy = barato pra alto volume. Premium = raciocínio complexo.

Os modelos são agrupados em tiers pelo custo médio por 1M tokens:

Economy — bons pra alto volume, atendimento simples, FAQ

Standard — uso geral, atendimento mais elaborado

Premium — raciocínio complexo, casos críticos

A maioria dos atendimentos cabe em economy/standard. Use premium só onde precisa.

Max tokens (output)

Tamanho máximo da resposta que o modelo pode gerar.

Cada template tem um limite de tokens que o modelo pode usar pra responder em um turno. Default geralmente é 2.048 — suficiente pra umas 6–8 frases longas.

Você paga por quanto o modelo realmente gerou, não pelo limite. O limite só evita respostas absurdamente grandes.

Como economizar

Cinco alavancas práticas pra reduzir o custo de operação do seu agente.

© 2026 Synthor Tecnologia em Inteligência Artificial LTDATodos os direitos reservados.

CNPJ 62.147.365/0001-09

Avenida Brig. Faria Lima 1811, Sala 1119 — Jardim Paulistano — São Paulo, SP — CEP 01452-001