Claude com 1 milhão de tokens: o processo inteiro cabe numa conversa. A leitura continua sendo sua
Desde o dia 24 de julho de 2026, quando a Anthropic lançou o Claude Opus 5, uma promessa começou a circular nos grupos de advogados: agora dá pra jogar o processo inteiro na IA de uma vez. E dessa vez a promessa é verdadeira. A janela de contexto do modelo saltou pra 1 milhão de tokens por conversa, o suficiente pra colocar milhares de páginas de autos numa única sessão de trabalho.
Só que existe uma diferença enorme entre o processo caber na conversa e o processo estar lido e conferido. E é exatamente nessa diferença que mora o risco novo pra quem advoga.
Este artigo é o guia completo do Claude com 1 milhão de tokens pra advocacia: o que mudou de fato (com os números oficiais, não os de corrente de WhatsApp), o que a própria Anthropic escreve na documentação sobre os limites do contexto longo, e o método passo a passo pra você usar a janela nova num processo grande sem entregar sua reputação pra um resumo que ninguém conferiu.
Resposta direta: o Claude Opus 5 tem janela de contexto de 1 milhão de tokens por padrão, disponível em todos os planos pagos do claude.ai e na API, sem custo extra. Isso permite analisar processos e contratos inteiros numa conversa só. O que não mudou: a IA continua errando de forma confiante, e a validação do advogado continua obrigatória. Janela maior é mais material pra revisar, não menos.
O que mudou de verdade: os números oficiais
Primeiro, o fato limpo, direto da documentação da Anthropic e da Central de Ajuda do Claude.
Antes de tudo, uma tradução rápida: token é a unidade que a IA usa pra medir texto, um pedaço de palavra. E janela de contexto é a memória de trabalho da conversa, tudo que o modelo consegue enxergar ao mesmo tempo: o que você enviou, os documentos anexados e as respostas dele. É como a mesa do seu escritório: o que está sobre a mesa, você consulta na hora; o que não está, não existe pra aquela conversa.
| O QUE | COMO FICOU NO OPUS 5 |
|---|---|
| Janela de contexto | 1 milhão de tokens, e esse é o padrão, não uma opção escondida. Não existe versão menor do Opus 5 |
| Limite de resposta | 128 mil tokens por resposta. A janela gigante é de leitura; a escrita continua limitada |
| Onde funciona | Em todos os planos pagos do claude.ai (com Opus 5 e Sonnet 5) e na API. Nos outros modelos, o padrão segue 200 mil tokens |
| Custo extra | Nenhum. O preço do Opus 5 não mudou e não existe sobretaxa de contexto longo |
| Ativação | Automática na conversa com o Claude. Você não precisa configurar nada |
Pra dar escala: a régua que o mercado usa desde os primeiros modelos com essa janela é de cerca de 750 mil palavras em inglês por milhão de tokens. Texto em português consome mais tokens por palavra, então a conta prática aqui é um pouco menor. Mesmo assim, estamos falando de milhares de páginas de autos numa conversa só, a depender da densidade do texto e da qualidade da digitalização.
Pra quem acompanha o mercado: o salto quintuplica a janela em relação aos 200 mil tokens que eram o padrão do Claude até aqui. Um processo trabalhista de 800 páginas, que antes você precisava fatiar em quatro ou cinco blocos, agora entra inteiro, com espaço de sobra pra contratos, atas e a sua conversa em cima deles.
Se você ainda não conhece o modelo por trás disso, o guia completo está em Claude Opus 5 para advogados.
O que não mudou: por que janela maior não é leitura verificada
Aqui começa a parte do artigo que quase ninguém vai te contar, porque atrapalha a manchete.
O aviso está na documentação da própria Anthropic
A documentação técnica oficial do Claude, na página sobre janelas de contexto, faz uma ressalva que deveria estar em toda propaganda de contexto longo. Em resumo: mais contexto não é automaticamente melhor. Conforme a quantidade de tokens cresce, a precisão e a capacidade de recuperar informação tendem a degradar, um fenômeno que a própria empresa chama pelo nome técnico de context rot (algo como “apodrecimento de contexto”). A conclusão deles: escolher bem o que entra na conversa importa tanto quanto o tamanho do espaço disponível.
Em bom português: a fabricante do modelo escreveu, na documentação oficial, que encher a janela até a boca sem critério piora o resultado.
A mesma Anthropic afirma que o Opus 5 melhorou muito nesse ponto, com raciocínio e obediência a instruções mais consistentes ao longo de toda a janela. As duas coisas são verdade ao mesmo tempo: o modelo novo é o melhor que já existiu em contexto longo, e ainda assim a orientação oficial de quem o construiu é curadoria, não despejo.
Os dois números que definem o seu risco
Existe um teste independente feito sob medida pra nossa profissão: o Legal Research Bench, da Vals AI, que avalia modelos de IA em tarefas reais de pesquisa jurídica com uma rubrica de checagens por resposta.
O Claude Opus 5 é o líder do ranking. E é justamente por isso que os números dele importam tanto:
Opus 5 no Legal Research Bench (Vals AI)
90,58%
de acerto com crédito parcial
a resposta vale mesmo faltando um pedaço. É o número da manchete.
55,29%
de respostas 100% corretas
só conta se passar em TODAS as checagens. É o número que interessa a quem assina.
A distância entre os dois é onde vive a resposta quase certa: a que parece pronta e não está.
Leia a distância entre os dois números com calma, porque ela é o retrato do risco. Em quase metade das tarefas, o melhor modelo jurídico do mercado entrega uma resposta que parece completa e não passa em todas as checagens. Não é uma resposta absurda, que você pegaria de longe. É uma resposta boa faltando um pedaço, e esse é o tipo de erro mais perigoso da advocacia, porque ele se veste de trabalho pronto.
Agora faça a conta com a janela nova. Esse mesmo comportamento, aplicado não mais a um bloco de 100 páginas que você fatiou e conhece, mas a 3 mil páginas que você nunca leu. O erro não ficou mais provável por causa da janela. Ele ficou mais difícil de achar.
A armadilha do “resume aí”
Com 200 mil tokens de janela, o advogado era obrigado a fatiar o processo. E fatiar, sem perceber, era uma proteção: cada bloco passava pelos seus olhos, você sabia o que tinha mandado e notava quando a resposta não batia.
Com 1 milhão de tokens, a tentação é outra: subir tudo e pedir “resume aí”. O fluxo abaixo mostra o que acontece em cada caminho.
O atalho que cobra caro
3.000 páginas
sobem de uma vez
“Resume aí”
pedido genérico
Resumo confiante
de autos que você não leu
Erro invisível
e assinado por você
O caminho profissional
As mesmas páginas
sobem de uma vez
Perguntas específicas
uma por vez
Resposta com página de origem
em cada afirmação
Você confere
por amostragem
O ponto central: quem joga 3 mil páginas e pede resumo recebe um resumo confiante de um processo que não leu. Se dentro dele houver uma testemunha trocada, uma data errada ou um pedido que o modelo deduziu em vez de encontrar, nada na resposta vai denunciar isso. A responsabilidade por essa peça continua tendo um único endereço: o seu registro na OAB.
Como usar a janela de 1 milhão de tokens num processo grande: o método em 4 passos
A janela nova é uma vantagem real. O que muda o jogo é usar com método. Este é o que aplico e ensino:
Passo 1: pergunta específica no lugar de pedido genérico
“Resume aí” convida o modelo a decidir sozinho o que importa. Inverta: você decide o que importa e pergunta uma coisa de cada vez. “Liste todas as testemunhas ouvidas e o que cada uma afirmou sobre a data do acidente” extrai muito mais valor do mesmo material do que qualquer resumo genérico, porque a resposta é conferível.
Passo 2: exija a origem de cada afirmação
Esta é a regra que transforma a janela grande de risco em vantagem. Toda afirmação deve vir com a página, a folha ou o ID do documento de onde saiu. Um prompt real pra começar:
Prompt pra copiar: “Leia os autos anexados. Liste todas as testemunhas ouvidas e, para cada uma, o que afirmou sobre [o ponto controvertido]. Para cada afirmação, cite a página ou o documento de origem no formato (fls. X). Se a informação não estiver nos autos, escreva ‘não localizado’. Não deduza nada que não esteja escrito.”
Sem a citação de origem, a afirmação não existe. Com ela, conferir vira tarefa de minutos: você abre a página apontada e bate o texto.
Passo 3: confira por amostragem, e por inteiro o que sustenta pedido
Não dá pra reler 3 mil páginas, e não precisa. O padrão profissional é o mesmo de auditoria: escolha uma amostra das citações e confira na fonte. Se a amostra passa limpa, o nível de confiança sobe. Se uma única citação falha, você desconfia do lote inteiro e aumenta a conferência. E toda afirmação que vai sustentar um pedido, uma tese ou um número na peça se confere uma a uma, sem exceção.
Passo 4: o que nunca se delega
A tese, a estratégia e a assinatura. O modelo é um leitor incansável de autos e um ótimo apontador de contradições. Quem decide o que fazer com isso continua sendo você. Se você já usa o Claude Cowork no escritório, o mesmo princípio vale lá: a IA executa, o advogado valida.
Onde a janela grande brilha de verdade
Usada com o método acima, a janela de 1 milhão de tokens destrava tarefas que antes eram inviáveis numa conversa só:
- Caça a contradições em depoimentos espalhados. “Compare o depoimento da fl. 214 com o da fl. 1.890 sobre o horário do acidente e transcreva os trechos divergentes.” Antes, com o processo fatiado, os dois depoimentos raramente estavam na mesma conversa.
- Linha do tempo dos autos. “Monte a cronologia de todos os atos processuais com a data e a folha de cada um.” O modelo enxerga o processo inteiro de uma vez, então a linha do tempo sai completa, e cada item vem com endereço pra conferir.
- Contrato principal cruzado com aditivos e e-mails. Due diligence e revisão contratual ganham muito: o contrato de 80 páginas, os 6 aditivos e a troca de e-mails entram juntos, e você pergunta “onde os aditivos alteram a cláusula de rescisão do contrato original?”.
- Preparação de audiência. Todos os depoimentos e documentos na mesma conversa, e você monta o roteiro de perguntas apontando o que cada testemunha já afirmou e onde.
| USO DA JANELA DE 1 MILHÃO | VEREDITO |
|---|---|
| Localizar informação nos autos com citação de origem, montar cronologia, cruzar documentos | Pode, é o melhor uso |
| Resumo geral do processo como ponto de partida do seu estudo | Cuidado: só com origem citada e conferência |
| Assinar peça baseada em resumo de autos que você nunca abriu | Nunca |
Limites práticos que valem saber antes de subir o processo
Quatro avisos que evitam frustração:
- A janela gigante é de leitura, não de escrita. A resposta continua limitada a 128 mil tokens. “Reescreva o processo inteiro” não sai de uma vez, e nem deveria: peça a análise em blocos.
- Processo escaneado consome muito mais. Página digitalizada como imagem gasta muito mais tokens que texto puro, e OCR ruim (a conversão de imagem em texto) degrada a leitura. PDF pesquisável sempre que existir.
- Existem limites de upload por arquivo e por conversa. Autos gigantes podem precisar entrar em mais de um arquivo. Isso não atrapalha o método: o que importa é caberem na mesma conversa.
- Conversa grande consome seus limites de uso mais rápido. A janela não custa extra, mas cada mensagem numa conversa cheia de documentos processa tudo de novo. Use uma conversa por processo e evite misturar assuntos nela.
Perguntas frequentes
Todos os planos do Claude têm a janela de 1 milhão de tokens?
Todos os planos pagos do claude.ai têm, nas conversas com o Claude Opus 5 e o Sonnet 5, segundo a Central de Ajuda da Anthropic. Nos demais modelos o padrão segue 200 mil tokens. Na API, a janela de 1 milhão é o padrão do Opus 5 pra qualquer cliente.
Usar 1 milhão de tokens custa mais caro?
Não. No claude.ai está dentro da assinatura, e na API o preço do Opus 5 não mudou com o lançamento, sem sobretaxa de contexto longo. O efeito prático é indireto: conversas maiores consomem seus limites de uso mais rápido.
Quantas páginas de processo cabem em 1 milhão de tokens?
A régua de mercado é de cerca de 750 mil palavras em inglês. Em português a conta fica menor, porque nosso texto consome mais tokens por palavra, mas ainda assim são milhares de páginas de autos em texto, a depender da densidade e da qualidade da digitalização.
Posso confiar no resumo de um processo que eu não li?
Não, e esse é o ponto central deste guia. No Legal Research Bench, o teste independente de pesquisa jurídica da Vals AI, o Opus 5 lidera o ranking e ainda assim entrega resposta 100% correta em 55,29% dos casos no critério rigoroso. Resumo de IA é ponto de partida com origem citada e conferência por amostragem, nunca substituto da leitura do que sustenta a peça.
A janela de 1 milhão de tokens funciona no Claude Cowork e no Claude Code?
O contexto longo está disponível no ecossistema do Claude, incluindo o Claude Code nos planos pagos (no plano Pro, o uso do Opus com 1 milhão de tokens no Claude Code exige ativar os créditos de uso adicionais). No dia a dia do advogado, a porta de entrada mais simples continua sendo a conversa no claude.ai com os autos anexados.
Conclusão: a janela cresceu, o método é o mesmo
O que você leva deste guia: o Claude Opus 5 colocou o processo inteiro dentro de uma conversa, de graça e por padrão. Isso destrava análises que antes eram inviáveis, de contradição entre depoimentos a cronologia completa dos autos. E o mesmo lançamento aumenta o tamanho do erro possível pra quem confundir capacidade de leitura com leitura verificada: a distância entre os 90,58% e os 55,29% do Legal Research Bench é exatamente o espaço onde uma resposta quase certa vira problema com o seu nome.
Janela é capacidade. Método é segurança. Os quatro passos deste artigo (pergunta específica, origem citada, amostragem, e o que não se delega) são o jeito de ficar com os ganhos sem herdar os riscos.
Quer dominar o Claude na advocacia com método, do zero à prática?
No Workshop Claude para Advogados eu mostro, na tela, como aplicar isso nos seus processos reais.
Quero conhecer o WorkshopE se você quer implementar tudo isso no seu escritório com acompanhamento, do fluxo de análise de processos à validação antes de protocolar, é exatamente o que eu ensino na Mentoria IA Para Advogado.
Fontes citadas no artigo
- Anthropic: anúncio oficial do Claude Opus 5 (24/07/2026)
- Anthropic: documentação What’s new in Claude Opus 5 (janela de 1M padrão, 128k de saída, preço)
- Anthropic: documentação de janelas de contexto (o aviso oficial sobre context rot)
- Anthropic: Central de Ajuda: tamanho da janela de contexto nos planos pagos
- Vals AI: Legal Research Bench, índice independente de pesquisa jurídica
- The New Stack: a equivalência de 1 milhão de tokens em cerca de 750 mil palavras
Lucas Fernandes
Mentor de IA para advogados. Formado em Direito, já treinou mais de 3.000 profissionais no uso seguro de inteligência artificial na rotina jurídica.
@iaparaadvogado