Tokens para advogados: quanto custa gerar um documento com IA
Um advogado abre a tela de geração de documentos, vê "R$ 2,32 por 1 milhão de tokens de entrada" e não faz a menor ideia do que fazer com essa informação. É justo: ninguém contrata serviço em token. A pergunta é quanto vai custar este contrato.
Este é um artigo vivo. A tabela de custos é refeita a cada rodada de medição: os preços dos modelos caem, o câmbio oscila e entram modelos novos. A medição atual é de agosto de 2026. O número que o sistema mostra na sua tela é sempre o vigente; esta tabela é a fotografia da última medição.
Quanto custa gerar um contrato com IA
Gerar um contrato completo de prestação de serviços, 24 meses, com cláusulas de confidencialidade, LGPD e não-aliciamento, custa no ProcStudio:
- R$ 0,02 no modelo mais econômico
- R$ 0,71 no modelo que a maioria dos escritórios usa como padrão
- R$ 4,21 no modelo mais caro do catálogo
São 221 vezes de diferença entre a ponta barata e a cara, e as duas entregam um contrato utilizável. A distância está no acabamento, na fidelidade às instruções difíceis e no tanto de revisão que sobra para você.
Documentos gerados por IA custam centavos. Um escritório que gera 200 por mês num modelo intermediário fecha o mês abaixo de R$ 150, ou abaixo de R$ 5 se ficar na faixa econômica.
O que é um token
Token é a unidade em que os modelos de linguagem cobram: um pedaço de palavra, menor que a palavra e maior que o caractere. Em português, a regra de bolso é 1 token ≈ 4 caracteres, ou aproximadamente ¾ de uma palavra.
"Contrato de prestação de serviços" tem 33 caracteres e vira algo em torno de 8 tokens. Uma lauda de petição, com seus 2.000 caracteres, dá uns 500 tokens.
Só que o token tem dois preços diferentes:
| O que é | Preço | |
|---|---|---|
| Entrada (input) | Tudo que a IA lê: suas instruções, o modelo do documento, os dados do cliente, os arquivos que você anexou | O mais barato |
| Saída (output) | Tudo que a IA escreve: o documento gerado | Tipicamente 5× mais caro |
Anexar documentos é barato; fazer a IA escrever muito é caro.
Por que contrato custa mais que petição
Na medição, o mesmo modelo gerou três documentos diferentes. Os números do Claude Sonnet 5:
- Petição de juntada de substabelecimento: R$ 0,47
- Petição inicial trabalhista completa: R$ 0,72
- Contrato de prestação de serviços: R$ 0,71
A entrada é parecida nos três: o prompt, o modelo e os dados do cliente têm tamanho semelhante. A diferença de preço vem do tamanho do que a IA escreve. Um contrato com quinze cláusulas, parágrafos e incisos ocupa três vezes mais saída que uma petição de juntada.
Peças longas custam mais, e não há truque de prompt que contorne isso.
O que é um modelo de raciocínio
Alguns modelos "pensam antes de escrever": geram internamente um rascunho de raciocínio, revisam e só então produzem o texto final. Esse pensamento é cobrado como saída, mesmo que você nunca o veja.
O MiniMax M3 gerou 16,4 mil tokens de saída para entregar um contrato, quatro vezes mais que um modelo comum, e ainda assim o documento saiu por R$ 0,17, porque a tarifa dele por token é baixa. Levou quatro minutos.
- Modelos de raciocínio demoram. Dois minutos numa peça longa é o tempo esperado, e não sinal de travamento. Você pode continuar usando o ProcStudio em outra aba, desde que mantenha aberta a aba da geração.
- Tarifa baixa não garante documento barato, se o modelo for verborrágico, e tarifa alta não condena: o Gemini 3.1 Pro tem tarifa de saída alta e ficou em R$ 0,59 porque escreve enxuto.
Comparar "preço por 1 milhão de tokens" entre modelos leva a conclusões erradas; só medir o documento inteiro diz quanto ele custa.
Janela de contexto: quanto cabe de uma vez
Todo modelo tem uma janela de contexto: o máximo de tokens que ele segura de uma vez, somando o que leu e o que escreveu. Passou desse teto, o modelo perde conteúdo ou a geração falha.
O teto aperta quando você anexa documentos de apoio. Um PDF de 40 páginas tem cerca de 20 mil tokens, e dois ou três deles num modelo de janela pequena não deixam espaço para a IA escrever.
O ProcStudio avisa quando os anexos passam de 60% da janela do modelo escolhido, em vermelho a partir de 90%. Quando o aviso aparecer, remova os anexos pouco relevantes ou troque por um modelo de janela maior.
Anonimização (ZDR) custa cerca de 30% a mais
Com a anonimização ligada, os dados do cliente são substituídos por marcadores antes de saírem do ProcStudio e devolvidos ao lugar depois, de modo que a IA nunca vê nome, CPF ou endereço reais. Isso exige uma chamada extra a um modelo: o contrato que sai por R$ 0,71 no Sonnet 5 vai para R$ 0,93, vinte e dois centavos a mais pelo sigilo dos dados do cliente.
A medição: o custo do contrato nos 17 modelos
Data da medição: 24 e 25 de agosto de 2026. Câmbio do dia: US$ 1 = R$ 5,1572.
Não são números de tabela de fornecedor. Cada modelo do catálogo gerou os mesmos três documentos, pelo mesmo caminho que o wizard do ProcStudio usa, com persona de especialista e modelo de documento: 66 chamadas reais, R$ 24,92 de custo no experimento inteiro.
A tabela abaixo é o contrato completo, o mais pesado dos três, do mais barato ao mais caro. "Entrada", "saída" e "tempo" são o que cada modelo consumiu e levou nesse documento; peças curtas saem bem mais rápido.
| Modelo | Provedor | Custo do contrato | Entrada | Saída | Tempo |
|---|---|---|---|---|---|
| GPT-OSS 120B | Groq | R$ 0,02 | 3,7k | 2,9k | 8s |
| Gemini 3.1 Flash Lite | R$ 0,02 | 3,9k | 1,3k | 5s | |
| Sabiazinho 4 | Maritaca | R$ 0,04 | 4,3k | 5,2k | 35s |
| GPT-5.6 Luna | OpenAI | R$ 0,07 | 4,3k | 6,1k | 58s |
| DeepSeek V4 Flash | DeepSeek | R$ 0,15 | 4,3k | 12,8k | 1min34s |
| MiniMax M3 (raciocínio) | MiniMax | R$ 0,17 | 3,7k | 16,5k | 4min03s |
| GPT-5.4 Mini | OpenAI | R$ 0,19 | 3,6k | 4,5k | 26s |
| Sabiá 4 | Maritaca | R$ 0,26 | 4,3k | 6,9k | 1min00s |
| DeepSeek V4 Pro | DeepSeek | R$ 0,37 | 4,3k | 9,9k | 2min09s |
| Claude Haiku 4.5 | Anthropic | R$ 0,39 | 4,6k | 8,6k | 1min18s |
| Gemini 3.1 Pro | R$ 0,59 | 3,9k | 5,3k | 43s | |
| Gemini 3.5 Flash | R$ 0,64 | 3,9k | 7,9k | 45s | |
| Claude Sonnet 5 | Anthropic | R$ 0,71 | 6,2k | 7,4k | 1min16s |
| GPT-5.6 Terra | OpenAI | R$ 0,85 | 4,3k | 7,8k | 1min31s |
| GPT-5.6 Sol | OpenAI | R$ 1,63 | 4,3k | 9,0k | 2min00s |
| Claude Opus 4.8 | Anthropic | R$ 1,68 | 6,2k | 6,9k | 1min35s |
| Claude Fable 5 | Anthropic | R$ 4,21 | 6,2k | 9,0k | 1min45s |
Nos três GPT-5.6, a coluna "entrada" é imputada pela mediana dos demais modelos: a API da OpenAI reportou 3 tokens de entrada nessas chamadas, número impossível para este prompt e sinal de telemetria quebrada. O custo desses três é calculado com a entrada imputada, para não sair subestimado; saída e tempo são medidos como nos demais.
Os valores são o que você paga, sem pegadinha de "a partir de".
- Velocidade não acompanha preço. O Gemini 3.1 Flash Lite entrega o contrato em 5 segundos por R$ 0,02, o Claude Fable 5 leva 1min45s por R$ 4,21, e o MiniMax M3, dos mais baratos, é o mais demorado de todos.
- Os modelos brasileiros competem. O Sabiazinho 4, da Maritaca, treinado em português e em direito brasileiro, faz o contrato por R$ 0,04.
- A faixa dos centavos cobre quase tudo. Treze dos dezessete modelos entregam o contrato por menos de R$ 0,72.
Como escolher o modelo
Documentos repetitivos, de estrutura conhecida (declaração, notificação, petição de juntada, contrato padrão do escritório) pedem a faixa econômica: Gemini 3.1 Flash Lite ou GPT-OSS 120B resolvem por dois centavos, em segundos. Gastar R$ 4,21 numa declaração de residência é desperdício.
Peças que precisam de fundamentação e cuidado de redação (inicial complexa, contrato negociado, parecer) pedem a faixa intermediária: Claude Sonnet 5, Gemini 3.1 Pro ou Claude Haiku 4.5, entre R$ 0,39 e R$ 0,71.
Para caso difícil, tese nova ou documento que vai a cliente exigente, a faixa premium se justifica, e R$ 4,21 continua sendo uma fração de um minuto do seu honorário.
Comece barato: na maior parte dos documentos de rotina o resultado já sai bom, e o teste custa dois centavos.
Onde ver isso dentro do ProcStudio
O sistema mostra o custo antes de você gastar:
- Na escolha do modelo, cada card traz "~R$ 0,71 / contrato", o número desta medição recalculado com o preço vigente do modelo e o câmbio do dia.
- Ao anexar um documento, aparece quantos tokens ele ocupa e quanto custa incluí-lo na geração.
- Na revisão, antes de gerar, a estimativa completa do documento, entrada mais saída.
Depois de gerar, o custo real fica registrado, e é ele que entra na sua conta.
Perguntas frequentes
Sou cobrado se a geração falhar? Não. A cobrança é sobre consumo real, e uma geração que falha não entra na conta.
Refazer um documento cobra de novo? Sim: é uma nova geração, com nova leitura e nova escrita. Ajuste as instruções antes de gerar, em vez de gerar cinco vezes até acertar. No modelo econômico a diferença é irrelevante; no premium, não.
Por que o mesmo modelo às vezes custa valores diferentes no mesmo tipo de documento? Porque o tamanho da saída varia: mais partes, mais cláusulas e mais instruções significam mais texto escrito, pelo mesmo motivo que duas petições iniciais não têm o mesmo número de laudas.
Medição de 24–25 de agosto de 2026: 66 gerações reais, 17 modelos, três tipos de documento. Câmbio US$ 1 = R$ 5,1572. Valores já com a margem do ProcStudio, como aparecem na sua conta.