Blog

Tokens para advogados: quanto custa gerar um documento com IA

ProcStudio • • 10 min de leitura
Tokens para advogados: quanto custa gerar um documento com IA

Um advogado abre a tela de geração de documentos, vê "R$ 2,32 por 1 milhão de tokens de entrada" e não faz a menor ideia do que fazer com essa informação. É justo: ninguém contrata serviço em token. A pergunta é quanto vai custar este contrato.

Este é um artigo vivo. A tabela de custos é refeita a cada rodada de medição: os preços dos modelos caem, o câmbio oscila e entram modelos novos. A medição atual é de agosto de 2026. O número que o sistema mostra na sua tela é sempre o vigente; esta tabela é a fotografia da última medição.

Quanto custa gerar um contrato com IA

Gerar um contrato completo de prestação de serviços, 24 meses, com cláusulas de confidencialidade, LGPD e não-aliciamento, custa no ProcStudio:

  • R$ 0,02 no modelo mais econômico
  • R$ 0,71 no modelo que a maioria dos escritórios usa como padrão
  • R$ 4,21 no modelo mais caro do catálogo

São 221 vezes de diferença entre a ponta barata e a cara, e as duas entregam um contrato utilizável. A distância está no acabamento, na fidelidade às instruções difíceis e no tanto de revisão que sobra para você.

Documentos gerados por IA custam centavos. Um escritório que gera 200 por mês num modelo intermediário fecha o mês abaixo de R$ 150, ou abaixo de R$ 5 se ficar na faixa econômica.

O que é um token

Token é a unidade em que os modelos de linguagem cobram: um pedaço de palavra, menor que a palavra e maior que o caractere. Em português, a regra de bolso é 1 token ≈ 4 caracteres, ou aproximadamente ¾ de uma palavra.

"Contrato de prestação de serviços" tem 33 caracteres e vira algo em torno de 8 tokens. Uma lauda de petição, com seus 2.000 caracteres, dá uns 500 tokens.

Só que o token tem dois preços diferentes:

O que é Preço
Entrada (input) Tudo que a IA lê: suas instruções, o modelo do documento, os dados do cliente, os arquivos que você anexou O mais barato
Saída (output) Tudo que a IA escreve: o documento gerado Tipicamente 5× mais caro

Anexar documentos é barato; fazer a IA escrever muito é caro.

Por que contrato custa mais que petição

Na medição, o mesmo modelo gerou três documentos diferentes. Os números do Claude Sonnet 5:

  • Petição de juntada de substabelecimento: R$ 0,47
  • Petição inicial trabalhista completa: R$ 0,72
  • Contrato de prestação de serviços: R$ 0,71

A entrada é parecida nos três: o prompt, o modelo e os dados do cliente têm tamanho semelhante. A diferença de preço vem do tamanho do que a IA escreve. Um contrato com quinze cláusulas, parágrafos e incisos ocupa três vezes mais saída que uma petição de juntada.

Peças longas custam mais, e não há truque de prompt que contorne isso.

O que é um modelo de raciocínio

Alguns modelos "pensam antes de escrever": geram internamente um rascunho de raciocínio, revisam e só então produzem o texto final. Esse pensamento é cobrado como saída, mesmo que você nunca o veja.

O MiniMax M3 gerou 16,4 mil tokens de saída para entregar um contrato, quatro vezes mais que um modelo comum, e ainda assim o documento saiu por R$ 0,17, porque a tarifa dele por token é baixa. Levou quatro minutos.

  • Modelos de raciocínio demoram. Dois minutos numa peça longa é o tempo esperado, e não sinal de travamento. Você pode continuar usando o ProcStudio em outra aba, desde que mantenha aberta a aba da geração.
  • Tarifa baixa não garante documento barato, se o modelo for verborrágico, e tarifa alta não condena: o Gemini 3.1 Pro tem tarifa de saída alta e ficou em R$ 0,59 porque escreve enxuto.

Comparar "preço por 1 milhão de tokens" entre modelos leva a conclusões erradas; só medir o documento inteiro diz quanto ele custa.

Janela de contexto: quanto cabe de uma vez

Todo modelo tem uma janela de contexto: o máximo de tokens que ele segura de uma vez, somando o que leu e o que escreveu. Passou desse teto, o modelo perde conteúdo ou a geração falha.

O teto aperta quando você anexa documentos de apoio. Um PDF de 40 páginas tem cerca de 20 mil tokens, e dois ou três deles num modelo de janela pequena não deixam espaço para a IA escrever.

O ProcStudio avisa quando os anexos passam de 60% da janela do modelo escolhido, em vermelho a partir de 90%. Quando o aviso aparecer, remova os anexos pouco relevantes ou troque por um modelo de janela maior.

Anonimização (ZDR) custa cerca de 30% a mais

Com a anonimização ligada, os dados do cliente são substituídos por marcadores antes de saírem do ProcStudio e devolvidos ao lugar depois, de modo que a IA nunca vê nome, CPF ou endereço reais. Isso exige uma chamada extra a um modelo: o contrato que sai por R$ 0,71 no Sonnet 5 vai para R$ 0,93, vinte e dois centavos a mais pelo sigilo dos dados do cliente.

A medição: o custo do contrato nos 17 modelos

Data da medição: 24 e 25 de agosto de 2026. Câmbio do dia: US$ 1 = R$ 5,1572.

Não são números de tabela de fornecedor. Cada modelo do catálogo gerou os mesmos três documentos, pelo mesmo caminho que o wizard do ProcStudio usa, com persona de especialista e modelo de documento: 66 chamadas reais, R$ 24,92 de custo no experimento inteiro.

A tabela abaixo é o contrato completo, o mais pesado dos três, do mais barato ao mais caro. "Entrada", "saída" e "tempo" são o que cada modelo consumiu e levou nesse documento; peças curtas saem bem mais rápido.

Modelo Provedor Custo do contrato Entrada Saída Tempo
GPT-OSS 120B Groq R$ 0,02 3,7k 2,9k 8s
Gemini 3.1 Flash Lite Google R$ 0,02 3,9k 1,3k 5s
Sabiazinho 4 Maritaca R$ 0,04 4,3k 5,2k 35s
GPT-5.6 Luna OpenAI R$ 0,07 4,3k 6,1k 58s
DeepSeek V4 Flash DeepSeek R$ 0,15 4,3k 12,8k 1min34s
MiniMax M3 (raciocínio) MiniMax R$ 0,17 3,7k 16,5k 4min03s
GPT-5.4 Mini OpenAI R$ 0,19 3,6k 4,5k 26s
Sabiá 4 Maritaca R$ 0,26 4,3k 6,9k 1min00s
DeepSeek V4 Pro DeepSeek R$ 0,37 4,3k 9,9k 2min09s
Claude Haiku 4.5 Anthropic R$ 0,39 4,6k 8,6k 1min18s
Gemini 3.1 Pro Google R$ 0,59 3,9k 5,3k 43s
Gemini 3.5 Flash Google R$ 0,64 3,9k 7,9k 45s
Claude Sonnet 5 Anthropic R$ 0,71 6,2k 7,4k 1min16s
GPT-5.6 Terra OpenAI R$ 0,85 4,3k 7,8k 1min31s
GPT-5.6 Sol OpenAI R$ 1,63 4,3k 9,0k 2min00s
Claude Opus 4.8 Anthropic R$ 1,68 6,2k 6,9k 1min35s
Claude Fable 5 Anthropic R$ 4,21 6,2k 9,0k 1min45s

Nos três GPT-5.6, a coluna "entrada" é imputada pela mediana dos demais modelos: a API da OpenAI reportou 3 tokens de entrada nessas chamadas, número impossível para este prompt e sinal de telemetria quebrada. O custo desses três é calculado com a entrada imputada, para não sair subestimado; saída e tempo são medidos como nos demais.

Os valores são o que você paga, sem pegadinha de "a partir de".

  • Velocidade não acompanha preço. O Gemini 3.1 Flash Lite entrega o contrato em 5 segundos por R$ 0,02, o Claude Fable 5 leva 1min45s por R$ 4,21, e o MiniMax M3, dos mais baratos, é o mais demorado de todos.
  • Os modelos brasileiros competem. O Sabiazinho 4, da Maritaca, treinado em português e em direito brasileiro, faz o contrato por R$ 0,04.
  • A faixa dos centavos cobre quase tudo. Treze dos dezessete modelos entregam o contrato por menos de R$ 0,72.

Como escolher o modelo

Documentos repetitivos, de estrutura conhecida (declaração, notificação, petição de juntada, contrato padrão do escritório) pedem a faixa econômica: Gemini 3.1 Flash Lite ou GPT-OSS 120B resolvem por dois centavos, em segundos. Gastar R$ 4,21 numa declaração de residência é desperdício.

Peças que precisam de fundamentação e cuidado de redação (inicial complexa, contrato negociado, parecer) pedem a faixa intermediária: Claude Sonnet 5, Gemini 3.1 Pro ou Claude Haiku 4.5, entre R$ 0,39 e R$ 0,71.

Para caso difícil, tese nova ou documento que vai a cliente exigente, a faixa premium se justifica, e R$ 4,21 continua sendo uma fração de um minuto do seu honorário.

Comece barato: na maior parte dos documentos de rotina o resultado já sai bom, e o teste custa dois centavos.

Onde ver isso dentro do ProcStudio

O sistema mostra o custo antes de você gastar:

  1. Na escolha do modelo, cada card traz "~R$ 0,71 / contrato", o número desta medição recalculado com o preço vigente do modelo e o câmbio do dia.
  2. Ao anexar um documento, aparece quantos tokens ele ocupa e quanto custa incluí-lo na geração.
  3. Na revisão, antes de gerar, a estimativa completa do documento, entrada mais saída.

Depois de gerar, o custo real fica registrado, e é ele que entra na sua conta.

Perguntas frequentes

Sou cobrado se a geração falhar? Não. A cobrança é sobre consumo real, e uma geração que falha não entra na conta.

Refazer um documento cobra de novo? Sim: é uma nova geração, com nova leitura e nova escrita. Ajuste as instruções antes de gerar, em vez de gerar cinco vezes até acertar. No modelo econômico a diferença é irrelevante; no premium, não.

Por que o mesmo modelo às vezes custa valores diferentes no mesmo tipo de documento? Porque o tamanho da saída varia: mais partes, mais cláusulas e mais instruções significam mais texto escrito, pelo mesmo motivo que duas petições iniciais não têm o mesmo número de laudas.


Medição de 24–25 de agosto de 2026: 66 gerações reais, 17 modelos, três tipos de documento. Câmbio US$ 1 = R$ 5,1572. Valores já com a margem do ProcStudio, como aparecem na sua conta.

IA na advocaciatokenscusto de IAmodelos de linguagemProcStudio IA Docsgeração de documentos