Como ler um paper em três passadas (e fichar sem copiar)
Ler um paper em até três passadas, cada uma com um tempo e uma saída, e fichar com as suas palavras e o endereço de cada informação no texto.
Ler um paper em até três passadas, cada uma com um tempo e uma saída, e fichar com as suas palavras e o endereço de cada informação no texto.
Três semanas depois de ler um artigo inteiro, você precisa do número que sustentava o seu argumento. A ficha é o resumo colado do PDF, sem número nem página.
São dois defeitos: ler todo paper do início ao fim com o mesmo cuidado, e fichar copiando. Para o primeiro há o método das três passadas de S. Keshav (2007), escrito porque o pós-graduando aprende a ler por tentativa e erro. Para o segundo, um campo a mais na ficha: onde está.

Passada 1 (5 a 10 minutos). Decidir se vale continuar
O que fazer. Leia título, resumo e introdução com cuidado; os títulos de seção e subseção, sem o texto delas; as conclusões; e passe os olhos nas referências, marcando as já lidas (Keshav, 2007, §2.1). Depois responda aos «cinco Cs»: categoria (que tipo de paper é), contexto (com que trabalhos conversa), correção (as premissas parecem válidas?), contribuições e clareza.
Exemplo. Categoria: estudo empírico com experimentos controlados. Contexto: contexto longo e geração aumentada por recuperação (RAG). Correção: quem usa bem o contexto não piora quando a informação muda de lugar; premissa razoável. Contribuição: a curva em U, com desempenho maior quando essa informação está no início ou no fim do contexto (p. 157, resumo; p. 158, Fig. 1). Clareza: boa. Decisão: seguir; o tema toca RAG.
Erro comum de iniciante. Pular a decisão. Para Keshav, a primeira passada basta para papers fora da sua área. Descartar com o motivo anotado é leitura feita.
Passada 2 (até 1 hora). Entender o conteúdo, sem as provas
O que fazer. Leia com mais cuidado, ignorando demonstrações, e anote os pontos-chave (Keshav, 2007, §2.2). Olhe as figuras: os eixos têm rótulo? Há barras de erro? Marque as referências a ler. No fim, você deve conseguir resumir o paper, com as evidências, para outra pessoa. Se não entendeu, há três saídas: deixar de lado, voltar depois de ler a base ou seguir para a terceira passada.
Exemplo. Os dados estão na p. 159: 2.655 perguntas do NaturalQuestions-Open. A Fig. 5 (p. 161) mostra a curva em U com 10, 20 e 30 documentos; a Tabela 1, na mesma página, dá o acerto sem documento algum: 56,1% para o GPT-3.5-Turbo. O número que eu citaria está nas p. 158 e 162: no pior caso, com a resposta no meio, esse modelo ficou abaixo desses 56,1%. Referência marcada: Ivgi et al. (2023), p. 160. Decisão: seguir para a terceira, porque vou usar o resultado em RAG.
Erro comum de iniciante. Ler a figura só pelo parágrafo que a cita. Legenda e eixos dizem o que foi medido; o parágrafo, o que os autores querem que você veja.
Passada 3 (horas). Refazer o trabalho de cabeça
O que fazer. A chave, para Keshav (2007, §2.3), é tentar reimplementar o paper virtualmente: com as mesmas premissas dos autores, recriar o trabalho e comparar com o que está escrito. Ao fim, você deve reconstruir de memória a estrutura do paper, com pontos fortes e fracos: premissas implícitas, citações que faltam, possíveis problemas de técnica experimental ou analítica. Ele estima quatro a cinco horas para iniciantes e cerca de uma hora para leitores experientes.
Exemplo. Refazendo o §2, anotei duas perguntas. Conta-se acerto quando alguma resposta anotada aparece na saída (p. 160): saída longa tem mais chance de conter o termo? E os modelos testados são de 2023 (p. 160–161): a curva vale para o que eu uso hoje? Código e dados foram liberados (p. 159); por aí a pergunta vira experimento.
Erro comum de iniciante. Fazer a terceira passada em todo paper. Ela é para o que você vai citar ou reproduzir (AI Lab; Keshav pensa sobretudo no parecerista). Os tempos acima são de Keshav; o AI Lab propõe 5 minutos, 1 hora e «várias horas», com as figuras já na primeira passada.
Fichar sem copiar: cada campo com «onde está»
O que fazer. Preencha os campos do modelo do AI Lab, cada um numa frase sua seguida do endereço. Números se copiam como estão; entre aspas, só o trecho que você vai citar literalmente, com a página. No Zotero, a anotação do leitor de PDF levada para uma nota chega com o link para a página e a citação (Zotero, 2026); a nota fica no item, como no fluxo do Zotero em 20 minutos (Pesquisa na prática #2).
Exemplo. A ficha do Lost in the Middle, campo a campo:
- Pergunta: modelos de contexto longo usam a informação de qualquer posição do contexto? (p. 157, §1)
- Método: um documento com a resposta entre k − 1 distratores; muda-se a posição dele e o número de documentos. (p. 159–160, §2.1, Fig. 3 e 4)
- Dataset: 2.655 perguntas do NaturalQuestions-Open; distratores do Contriever. (p. 159)
- Baseline: sem documentos (closed-book) e só com o documento certo (oracle). (p. 161, Tab. 1)
- Métrica: acurácia; acerto se alguma resposta anotada aparece na saída. (p. 160)
- Resultado: curva em U; no pior caso (resposta no meio, 20 documentos), o GPT-3.5-Turbo fica abaixo dos 56,1% sem documento algum; com 30, o mesmo vale para a versão de 16K. (p. 158, 161–162, Fig. 5; Tab. 1)
- Para RAG: o leitor satura antes do recall do recuperador; 50 documentos em vez de 20 rendem cerca de 1,5% no GPT-3.5-Turbo. (p. 159, §1; p. 166, §5, Fig. 11)
- Limitações: não há seção própria; as admitidas estão em notas: só decodificação gulosa (p. 161); GPT-4 só num subconjunto, por custo (p. 161, n. 6; p. 172); alguns distratores podem conter resposta aceitável (p. 159, n. 2).
- Threats to validity (minha leitura): métrica por presença da resposta; modelos de 2023. (p. 160–161)
- Citações a seguir: Ivgi et al. (2023). (p. 160)
Erro comum de iniciante. Colar o resumo no campo «resultado». Ele vem sem número nem página, e na hora de escrever você volta ao PDF.
E quando a IA lê junto
Um caderno de IA como o Gemini Notebook (antes NotebookLM), com o PDF como fonte, faz um rascunho de fichamento guiado. As regras do manual do Laboratório valem aqui: trecho aberto e lido para cada afirmação usada, página anotada, frase sem número de citação tratada como conjectura do modelo. O próprio exemplo dá um motivo para desconfiar: os modelos testados por Liu et al. (2024), de 2023, usaram pior a informação do meio de contextos longos. O «onde está» torna a conferência rápida.
Keshav (2007, §3) sugere levar à primeira passada três a cinco trabalhos recentes de um buscador acadêmico; numa revisão, a lista sai de uma string de busca registrada para o PRISMA (Pesquisa na prática #1).
Onde isso mora: o Laboratório de Pesquisa MirandasTech
A leitura com IA continua no manual Gemini Notebook para pesquisa científica: fichamento guiado de um artigo por vez e matriz de síntese conferida célula a célula, sempre com página. O Plugin Pesquisa guarda as fichas com página na pasta da revisão. Os dois estão entre os dezesseis manuais abertos do Laboratório de Pesquisa MirandasTech, organizados pelo caminho real de uma pesquisa, da pergunta à defesa.
Referências
- KESHAV, S. How to read a paper. ACM SIGCOMM Computer Communication Review, v. 37, n. 3, p. 83–84, 2007. doi.org/10.1145/1273445.1273458.
- LIU, N. F. et al. Lost in the middle: how language models use long contexts. Transactions of the Association for Computational Linguistics, v. 12, p. 157–173, 2024. doi.org/10.1162/tacl_a_00638. Preprint: arXiv:2307.03172 (paper usado como exemplo).
- IVGI, M.; SHAHAM, U.; BERANT, J. Efficient long-text understanding with short-text models. Transactions of the Association for Computational Linguistics, v. 11, p. 284–299, 2023. doi.org/10.1162/tacl_a_00547 (citado como «referência a ler» no exemplo).
- AI LAB. 14 · Papers (roteiro de leitura em três passagens) e modelo de fichamento de paper. Repositório joaopaulomirandamatias/ai-lab, GitHub, 2026. 14-papers/README.md e _templates/fichamento-paper.md. Acesso em 2 out. 2026.
- ZOTERO. PDF Reader (documentação, atualizada em 5 maio 2026). zotero.org/support/pdf_reader. Acesso em 2 out. 2026.
- MIRANDASTECH. Gemini Notebook para pesquisa científica (manual). notebook.mirandastech.com.br. Acesso em 2 out. 2026.
- MIRANDASTECH. Plugin Pesquisa para Claude e Codex (manual). plugin.mirandastech.com.br. Acesso em 2 out. 2026.
