Você extrai uma tabela de um PDF, os números aparecem exatamente onde deveriam, e então =SOMA(B2:B20) retorna 0. Ou a coluna ordena 1, 10, 100, 2, 20 em vez de numericamente. O Excel está te dizendo, do seu jeito indireto, que o que parece um número naquela célula é na verdade uma string de texto que por acaso é feita de dígitos.
Um PDF armazena texto como caracteres posicionados em uma página — não tem o conceito de “isto é um número” versus “isto é um rótulo”, ambos são apenas glifos em coordenadas. Quando um conversor reconstrói uma tabela a partir disso, ele lê o que visualmente é uma coluna numérica e a coloca nas células como o texto literal que viu, dígito por dígito. Na maioria das vezes, a própria detecção de tipo do Excel percebe isso e converte automaticamente, mas formatações específicas no PDF de origem burlam essa detecção de forma consistente: um símbolo de moeda ou separador de milhares embutido no texto, como R$ 1.240,00 ou 1,240.50 no formato americano, é lido como texto por causa do símbolo e dos caracteres separadores, não porque o número em si esteja errado; um espaço à direita ou à esquerda copiado junto com os dígitos durante a extração fica invisível na célula, mas já é suficiente para o Excel tratar o valor como texto; números entre parênteses para negativos, como a notação contábil (450,00) para negativo 450, formam um padrão de texto que o Excel não reinterpreta automaticamente como valor negativo; e um espaço sem quebra ou outro caractere Unicode invisível, vindo da codificação de fonte do PDF original, pode aparecer posicionado entre dígitos ou como separador.
Selecione a coluna afetada, depois Dados → Texto para Colunas → Delimitado → Concluir (você não precisa realmente dividir nada — passar uma coluna por esse assistente e clicar até Concluir força o Excel a reavaliar o tipo de cada célula do zero, convertendo texto genuinamente numérico em números reais como efeito colateral). Isso corrige a grande maioria dos casos em uma única ação, incluindo o problema do espaço invisível, sem que você precise identificar qual era o problema específico.
Se isso não resolver completamente:
- Multiplique por 1. Em uma célula vazia, digite
=B2*1e arraste para baixo — isso força uma conversão numérica célula por célula, útil quando o Texto para Colunas não resolve completamente. - Remova símbolos de moeda e separadores diretamente com
=VALOR(SUBSTITUIR(SUBSTITUIR(B2;"R$";"");".";"")), que elimina os caracteres específicos que atrapalham a detecção antes de converter. - Verifique negativos em formato contábil manualmente se uma coluna tiver números entre parênteses —
=VALOR(SUBSTITUIR(SUBSTITUIR(B2;"(";"-");")";""))converte(450,00)em um-450real.
PDF para Excel funciona melhor em PDFs onde a tabela tem texto genuíno que você consegue selecionar com o cursor no original — os números existem como caracteres reais, não como uma fotografia deles, o que dá à extração a melhor chance de ler dígitos limpos sem caracteres de formatação estranhos grudados. Uma tabela em PDF digitalizada é lida por OCR em vez de extração direta de texto, o que é mais propenso exatamente ao tipo de ruído de caracteres estranhos que produz números formatados como texto — veja Converter um Extrato Bancário em PDF para Excel para mais sobre como obter um resultado limpo nesse caso específico e muito comum.
Assim que os números se comportam como números — a SOMA retorna um total real, a ordenação se comporta numericamente — o resto da planilha funciona normalmente: fórmulas, formatação condicional e gráficos passam a ler a coluna corretamente a partir daí.
O PDF para Excel não exige cadastro, não deixa marca d’água, e apaga o arquivo no momento em que o download termina.