Resposta curta

O critério que decide é onde o documento é processado, antes de qualquer julgamento sobre a qualidade do resumo. Uma ferramenta pode ler o arquivo inteiro dentro da janela de contexto, ou indexar o arquivo e responder a partir de trechos recuperados. A segunda via aguenta acervo maior e só é confiável se mostrar de onde tirou cada trecho.

Para um único PDF longo que você precisa conferir, procure a via que aponta a página de origem. O Assistente de IA do Acrobat é o exemplo mais direto desse desenho: a página brasileira da Adobe descreve resumos com citações que levam à fonte dentro do documento. Para dezenas de arquivos que voltarão à mesa várias vezes, o desenho de caderno com fontes fixas é o que foi feito para esse volume, e o NotebookLM, cujos limites de uso sobem no Google AI Pro, é o caso mais conhecido. Se o arquivo é médio, um contrato ou um relatório de 60 páginas, os dois desenhos servem, desde que a ferramenta leia a página como imagem e não apenas o texto que conseguiu extrair.

Como isso funciona

A janela de contexto é a memória de curto prazo do modelo: cabe nela apenas o que ele consegue considerar de uma vez. A documentação da API Gemini descreve a evolução — modelos generativos antigos processavam 8 mil tokens, depois vieram 32 mil e 128 mil, e a família Gemini passou a aceitar 1 milhão — e lista o que se faz quando o material não cabe: descartar mensagens antigas, resumir conteúdo, usar recuperação aumentada com banco de dados vetorial ou filtrar o que entra no comando. Com janela grande, a orientação da própria documentação se inverte: em vez de recortar, fornecer tudo o que importa desde o início.

Nenhuma das rotas é barata em esforço. Cada consulta reenvia o contexto, e os tokens de entrada entram na conta; o Google recomenda cache de contexto para quem pergunta muitas vezes sobre o mesmo material. A mesma documentação registra o ponto fraco da janela gigante: em testes de recuperação com várias informações a localizar, o desempenho varia bastante, e comandos mais longos costumam ter mais latência até o primeiro token. A recomendação prática é deixar a pergunta no fim, depois de todo o material.

Na outra rota, a ferramenta divide e indexa os arquivos e recupera os trechos relevantes para cada pergunta, anexando a referência do arquivo de origem. É o que permite responder sobre um acervo que nunca caberia na janela e ainda assim conferir a resposta sem reler tudo. Ferramentas que respondem a partir de um conjunto fechado de fontes, tratadas em Qual IA escolher para estudar?, partem do mesmo princípio de ancoragem; o que muda aqui é o que o arquivo extenso exige para ser analisado. O Assistente de IA do Acrobat segue essa linha dentro do PDF, e a Adobe declara que o conteúdo do usuário nunca é usado para treinar seus modelos de IA.

Como a ferramenta enxerga o PDF também muda o resultado. A documentação da Anthropic informa que cada página é processada como imagem, o que coloca gráfico e tabela no campo de visão do modelo, e avisa que PDFs densos — muitas páginas em fonte pequena, tabelas complexas, muito gráfico — podem estourar a janela antes do limite de páginas. A documentação do Gemini afirma visão nativa para texto, imagens, diagramas, gráficos e tabelas em PDFs de até 1.000 páginas, com uma ressalva importante: arquivo que não é PDF é tratado como texto comum, e o que era diagrama ou formatação se perde. Existem ainda vias em que o processamento recua para extração básica de texto, recuo que a Anthropic documenta quando as citações não estão habilitadas no Amazon Bedrock. Isso explica por que a mesma ferramenta pode falhar com uma página digitalizada e funcionar com um PDF gerado por editor de texto.

O que olhar primeiro

Estes critérios estão em ordem de impacto sobre a decisão.

  • 1. Onde o documento é processado. Janela de contexto e índice cobram de formas diferentes: a janela simplifica o envio, mas encarece cada pergunta repetida; o índice escala para acervo grande, mas depende da qualidade da recuperação. É o critério que define os demais.
  • 2. Se a resposta aponta a origem. Sem página, seção ou trecho de referência, você relê o documento para conferir e o ganho de tempo desaparece. Ferramentas que citam a fonte dentro do arquivo reduzem essa conferência a um clique.
  • 3. Se a página é lida como imagem. Digitalização sem camada de texto, tabela e gráfico só entram na resposta se a ferramenta olhar a página, e não apenas o texto que conseguiu extrair dela.
  • 4. Quanto cabe em uma consulta. São limites documentados, que variam conforme a via. Na documentação da Anthropic, são 32 MB por requisição e 600 páginas, caindo para 100 páginas quando a janela de contexto é menor que 1 milhão de tokens; PDFs densos podem estourar antes disso.
  • 5. O que acontece com o arquivo que você envia. Retenção e uso para treinamento variam por fornecedor e por tipo de plano, e essa diferença pesa mais do que a qualidade do resumo quando o documento é de cliente, de paciente ou de um processo. Leia a política antes de subir o arquivo, não depois.
  • 6. Preço e plano no Brasil. O Google AI Pro custava R$ 96,99 por mês segundo o Canaltech, em maio de 2025, com limite maior de pesquisas no NotebookLM; assinaturas mudam de preço com frequência e o valor vigente precisa ser conferido na página oficial. O Assistente de IA do Acrobat vem dentro da assinatura do Acrobat, com valores por plano nas páginas brasileiras da Adobe.

Os limites que a documentação publica para cada via:

Via Como lê o PDF Limite documentado
Claude, via API Cada página processada como imagem 32 MB por requisição; 600 páginas, ou 100 quando a janela de contexto é menor que 1 milhão de tokens
Gemini, via API Visão nativa de texto, imagens, diagramas, gráficos e tabelas PDFs de até 1.000 páginas
Assistente de IA do Acrobat Dentro do PDF, com resumo que cita a fonte PDF Spaces combinam até 100 arquivos e links

Os números valem para a via indicada, API no caso de Claude e Gemini e fluxo nativo do PDF no caso do Acrobat, e não são promessa de que toda interface de consumidor aceita o mesmo volume.

O que costuma ser irrelevante

  • O tamanho da janela como manchete. Um milhão de tokens só ajuda se a recuperação acertar; com várias informações a localizar, a documentação do Google registra variação de desempenho, e cada consulta é cobrada de novo.
  • A lista de formatos aceitos. Em documento longo, o que decide é o comportamento com a página difícil, digitalizada ou com tabela, e não o número de extensões suportadas.
  • Resumo em áudio ou em tom de conversa. É um formato de saída agradável, que não melhora a fidelidade do que foi extraído do arquivo.
  • Velocidade do primeiro resumo. Resumir é a parte fácil; localizar o trecho que sustenta cada afirmação é o que consome tempo depois.

Erros comuns

  • Concluir que a ferramenta não lê o PDF quando o problema é a digitalização sem camada de texto ou uma via que só faz extração de texto. Repetir o mesmo conteúdo em um PDF pesquisável separa os dois casos.
  • Aceitar o resumo sem abrir a referência indicada, em especial quando a resposta traz número, cláusula ou valor de tabela. É ali que o erro passa despercebido.
  • Repetir perguntas sobre o mesmo arquivo sem verificar se o contexto é reenviado a cada consulta; em janela longa, isso aparece na conta e na demora.
  • Tratar "arquivo enviado" como categoria única. A Anthropic informa que a conversa excluída sai do histórico imediatamente e do armazenamento em até 30 dias, e que dados usados para melhorar o modelo podem ficar em formato desidentificado por até 5 anos, com conversas no modo Incognito fora desse uso. A Adobe declara que o conteúdo nunca é usado para treinar seus modelos de IA. Planos corporativos seguem regras próprias.
  • Assinar sem conferir o preço em reais na página oficial e sem checar o que o plano faz com os limites de uso.

Próximo passo concreto

Antes de pagar, faça um teste de meia hora com o documento mais difícil que você tem à mão. Escolha um PDF de 40 a 80 páginas que você conhece bem, de preferência com uma tabela de números e uma página digitalizada. Faça três perguntas cuja resposta você consegue conferir no original — um valor dentro da tabela, uma data, uma cláusula — e observe se a resposta indica a página ou o trecho de onde saiu. Repita com a versão digitalizada, para ver se ela é lida. Rode o teste no plano gratuito e só assine quando a ferramenta localizar justamente o que você não quer reler.

Se o material é de terceiro ou traz informação sensível, leia antes a política de retenção e de uso para treinamento e verifique se o seu plano tem tratamento próprio. Se a dúvida for quantas assinaturas manter, Vale a pena assinar mais de uma IA ao mesmo tempo? trata da conta do empilhamento. E se a escolha for entre níveis de plano de um mesmo fornecedor, ChatGPT Go ou Plus: qual escolher? organiza os critérios.