Como traduzir artigo científico e livro em PDF sem perder a formatação
Na tradução acadêmica, o problema quase nunca é a qualidade do texto traduzido — é a estrutura do PDF: quebras de linha, duas colunas e figuras que perdem a referência.
Quem faz TCC, mestrado ou doutorado passa boa parte do tempo lendo artigo em inglês. Traduzir o texto em si já não é o gargalo: DeepL e Google Tradutor devolvem português legível. O tempo se perde antes disso — na hora de tirar o texto de dentro do PDF. Você copia um parágrafo e ele vem picotado, linha por linha. Copia uma página de artigo em duas colunas e o resultado mistura a coluna da esquerda com a da direita. As legendas de figuras entram no meio do texto corrido.
Este guia trata exatamente dessa camada: por que artigos e livros em PDF quebram os tradutores, quais caminhos funcionam para cada situação e como lidar com o caso mais chato de todos — o material digitalizado, sem camada de texto.
Problema 1: o texto copiado vem quebrado
O PDF guarda uma quebra de linha ao fim de cada linha impressa. Quando você copia e cola num tradutor, cada linha vira uma frase separada — e o tradutor traduz pedaço por pedaço, sem enxergar a frase inteira. O resultado é um português truncado, que às vezes muda o sentido. Existem ferramentas que removem essas quebras antes da colagem, mas isso resolve só o texto corrido: figuras, equações e notas de rodapé continuam se perdendo.
Problema 2: duas colunas e a ordem de leitura
A maioria dos periódicos usa duas colunas. Ao extrair o texto, muitas ferramentas leem a primeira linha da coluna esquerda, depois a primeira da direita, e assim por diante. A tradução sai gramaticalmente correta e completamente incompreensível, porque as duas colunas foram intercaladas. Some a isso as legendas, as notas e a lista de referências entrando no meio do corpo do texto, e você tem o clássico "traduzi mas não dá para ler".
As opções para material acadêmico
DeepL — melhor qualidade de tradução, cota gratuita pequena
Para texto acadêmico, o DeepL costuma entregar o português mais natural e lidar melhor com terminologia técnica. O plano gratuito permite traduzir arquivos, mas com limite de quantidade e tamanho por mês, e a reconstrução do layout não é perfeita. É a melhor escolha quando o artigo é um PDF digital e o que importa é a qualidade do texto.
Google Tradutor — grátis e ilimitado, até 10 MB
Sem limite de uso e sem cadastro. Para um artigo solto, o tamanho raramente é problema. Mas a formatação sai aproximada — em páginas de duas colunas com equações, o resultado embaralha — e PDFs digitalizados simplesmente não funcionam.
IA de chat — ótima para entender, ruim para gerar documento
Se o objetivo é saber o que o artigo fez, qual o método e o que há de novo, a IA de chat é imbatível em velocidade — e lê até páginas digitalizadas. Só que devolve texto de conversa: não existe PDF traduzido com as figuras no lugar, e em textos longos ela resume trechos por conta própria. Para leitura atenta, com correspondência linha a linha com o original, não serve.
Ferramenta de documento — mantém a página como ela é
O Reglyph apaga da imagem da página apenas o texto original e compõe a tradução no mesmo lugar. Duas colunas continuam duas colunas; tabelas, gráficos e equações ficam onde estavam, então dá para ler a tradução e consultar a figura ao lado. Funciona também com artigos digitalizados (PDF sem camada de texto) e gera uma exportação bilíngue com original e tradução lado a lado. São 5 páginas grátis por dia, sem cartão.
Um livro em PDF costuma passar de 50 páginas. Divida por capítulos, traduza cada parte e junte no final — cada parte mantém a diagramação, então o resultado fica consistente. Comece testando o capítulo com mais tabelas: se ele sair limpo, o resto sai.
O caso do material digitalizado
Artigos antigos, teses escaneadas da biblioteca, capítulos de livro fotocopiados, apostilas em PDF de imagem — nada disso tem camada de texto, e por isso a tradução de arquivos do DeepL e do Google Tradutor não funciona. O teste leva cinco segundos: se você não consegue selecionar uma frase com o mouse, é imagem. Nesse caso é obrigatório usar uma ferramenta com OCR embutido, que reconhece o texto na própria imagem antes de traduzir — é o que a página de tradução de inglês para português descreve em detalhe.
Cuidados na hora de usar na pesquisa
Não cite a tradução automática como se fosse o texto do autor. Termos técnicos, unidades e descrições estatísticas ainda saem errados com alguma frequência — confira no original todo trecho que você for citar ou usar como base metodológica. É justamente aí que a visão bilíngue ajuda: você lê em português para entender e volta ao inglês só nos pontos críticos. E antes de subir um manuscrito não publicado para qualquer serviço, verifique as regras de sigilo do seu grupo de pesquisa ou do periódico.
Perguntas frequentes
Como traduzir um artigo em PDF mantendo as duas colunas?
Use uma ferramenta que recomponha a página em vez de extrair o texto. O Reglyph apaga o texto original da imagem e coloca a tradução no mesmo lugar, então as duas colunas continuam separadas e as figuras ficam onde estavam.
Por que o texto copiado do PDF fica com quebras de linha?
O PDF guarda uma quebra ao fim de cada linha impressa, e o tradutor interpreta cada linha como uma frase distinta. Traduzir o arquivo inteiro, em vez de copiar e colar, evita o problema.
Dá para traduzir um artigo científico digitalizado?
Sim, com uma ferramenta que tenha OCR. O Reglyph lê o texto direto da imagem da página, traduz e recompõe — funciona com artigos antigos, teses escaneadas e fotocópias. DeepL e Google Tradutor não processam esse tipo de PDF.
Quantas páginas de um livro consigo traduzir de uma vez?
Até 50 páginas por envio no Reglyph. Para um livro inteiro, divida por capítulos, traduza cada parte e junte no final — como cada parte preserva a diagramação, o documento remontado fica coerente.