Extrator de dados PDF

Extraia cada campo e valor de um PDF — faturas, extratos bancários, contratos, formulários fiscais e requerimentos — para dados de chave-valor limpos em segundos. Abra a página de que precisa, deixe a IA detetar cada campo automaticamente ou defina os seus para fixar o mesmo esquema em todos os documentos. Exporte para JSON, CSV (horizontal ou vertical), Excel ou XML. Gratuito, sem registo, sem instalação, 20 idiomas. PNG, JPG, TIFF, WebP, GIF, BMP e SVG também são bem-vindos.

Sem registo
Seguro e privado
Ultrarrápido
PNG JPG PDF TIFF SVG WebP GIF BMP

Arraste e largue o seu PDF

ou clique para procurar

PDF, PNG, JPG, TIFF, WebP, GIF, BMP, SVG

Máx. 50 MB

Funcionalidades poderosas para a extração de PDF

Tudo o que precisa para extrair campos identificados de um PDF — fatura, extrato, contrato ou formulário — e enviar os dados para onde forem necessários.

Extração de PDF página a página

Abra um contrato de duas páginas ou um extrato de 200 páginas, navegue até à página exata na pré-visualização e extraia os seus campos e valores. A ferramenta lê uma página por execução, por isso cada extração mantém-se limpa e previsível.

Deteção de campos e valores com IA

Largue um PDF e a IA associa automaticamente cada etiqueta ao seu valor — linhas de fatura, linhas de extrato, campos de formulário, linhas de identificação, cláusulas de contrato — em dados de chave-valor estruturados, sem modelos nem configuração.

Defina os seus próprios campos

Já conhece o esquema? Indique as chaves exatas que pretende — N.º de fatura, Total a pagar, Número de conta, Data de início de vigência — adicione descrições opcionais para mais precisão e fixe o mesmo formato de saída em todos os PDF.

Funciona em PDF digitais e digitalizados

Exportado diretamente de um software de contabilidade ou ERP, ou digitalizado de um original em papel — o extrator lê a página selecionada da mesma forma, por isso tanto os PDF nativos como os digitalizados se transformam em dados limpos.

Edite os resultados antes de exportar

Reveja os campos extraídos numa tabela editável — corrija um número mal lido, ajuste uma etiqueta, escreva um valor que a IA não captou, adicione um campo ou elimine uma linha — e depois guarde o esquema como um modelo de resultados reutilizável.

Exporte para qualquer formato

Transfira para JSON para APIs e scripts, CSV (horizontal ou vertical) para folhas de cálculo, Excel (.xlsx horizontal ou vertical) para analistas, ou XML para sistemas antigos e de gestão documental.

Como funciona

De uma página PDF a dados de chave-valor limpos e exportáveis em três passos — uma página de cada vez, sem configuração.

1

Carregue e abra a sua página

Arraste o seu PDF ou procure-o, depois use os controlos de página — Anterior/Seguinte, a caixa de página ou o menu pendente — para chegar à página exata que pretende. Confirme-a na pré-visualização antes de executar.

2

Detete ou defina os seus campos

Escolha Automático e a IA extrai cada par etiqueta-valor da página, ou mude para Manual e indique as chaves exatas de que precisa (N.º de fatura, Data de vencimento, Número de conta). Conclua a rápida verificação de segurança para começar.

3

Reveja, edite e exporte

Verifique os resultados na tabela editável, corrija ou adicione valores e depois transfira para JSON, XML, CSV (horizontal ou vertical) ou Excel (horizontal ou vertical). Passe à página seguinte e repita.

Casos de utilização da extração de dados PDF

De faturas e extratos bancários a contratos, formulários fiscais e requerimentos — veja como as equipas transformam documentos PDF identificados em dados de chave-valor limpos e estruturados.

Faturas e ordens de compra

Extraia número de fatura, número de encomenda, fornecedor, destinatário, linhas de itens, subtotal, imposto, total a pagar e data de vencimento de faturas, ordens de compra e documentos de faturação PDF.

Extratos bancários e financeiros

Capture número de conta, período do extrato, saldos inicial e final e cada linha de movimento de extratos bancários, de cartão de crédito e de corretagem PDF.

Contratos e acordos

Extraia nomes das partes, data de início de vigência, prazo, data de renovação, condições de pagamento, lei aplicável e datas de assinatura de contratos, acordos de confidencialidade e contratos de serviços PDF.

Formulários fiscais e recibos de vencimento

Obtenha número de identificação fiscal, entidade empregadora, salário bruto, retenções, deduções e salário líquido de formulários fiscais, documentos do tipo W-2/1099 e recibos de vencimento PDF.

Apólices e sinistros de seguros

Extraia número de apólice, nome do segurado, limites de cobertura, prémio, número de sinistro, datas de prestação e montantes de indemnização de apólices e formulários de sinistro PDF.

Pedidos de empréstimo, visto e emprego

Converta nome do requerente, contactos, percurso profissional ou académico, referências e declarações de formulários PDF de empréstimo, crédito habitação, visto e candidatura em registos estruturados.

Registos médicos e relatórios laboratoriais

Capture nome do doente, data, prestador, nomes dos exames, valores dos resultados, unidades e intervalos de referência de receitas, notas de alta e relatórios laboratoriais PDF.

Documentos de identificação e certidões

Extraia número do documento, nome completo, data de nascimento, datas de emissão e validade e morada de digitalizações PDF de passaportes, cartões de cidadão, cartas de condução e certidões oficiais.

Perguntas frequentes

Tem perguntas? Temos respostas.

O que pode o extrator de dados PDF retirar de um documento?

Retira cada par campo-valor da página — números e linhas de fatura, saldos e movimentos de extrato, campos de formulário, datas e partes de contratos, linhas de identificação e qualquer outro texto identificado — para dados de chave-valor limpos, prontos a exportar como JSON, CSV, Excel ou XML.

Lê o PDF todo de uma vez ou uma página de cada vez?

Uma página de cada vez. Escolhe que página processar e a extração aplica-se apenas a essa página, o que mantém os resultados rigorosos e previsíveis em extratos, relatórios e contratos longos. Para processar um documento inteiro automaticamente, consulte as opções de lote e de todas as páginas abaixo.

Como extraio de uma página específica de um PDF longo de várias páginas?

Depois de carregar, use os controlos de página na pré-visualização — Anterior/Seguinte, a caixa do número da página ou o menu pendente — para navegar até à página que pretende. A página apresentada na pré-visualização é a que é extraída. Processe-a, depois passe à página seguinte e repita.

Posso extrair dados de todas as páginas de um PDF de uma só vez?

A ferramenta web gratuita processa uma página por extração por conceção. Se precisar de extrair automaticamente todas as páginas de um documento — ou milhares de páginas em muitos ficheiros — contacte-nos sobre o processamento em lote e de todas as páginas.

Funciona em PDF digitalizados ou apenas nos criados digitalmente?

Em ambos. Quer o seu PDF tenha sido exportado diretamente de um software de contabilidade, ERP ou processamento de texto, quer digitalizado de um original em papel, a IA lê a página selecionada e retira os seus valores identificados da mesma forma. Digitalizações nítidas e de alta resolução oferecem a melhor precisão.

Como decide a extração automática o que retirar?

O modo Automático analisa o esquema e o texto da página selecionada e associa sozinho cada etiqueta ao seu valor — sem modelos, sem mapeamento de campos, sem configuração. É a forma mais rápida de tratar um PDF pontual ou desconhecido.

Quando devo usar o modo manual e definir os meus campos?

Use o modo manual quando processa repetidamente o mesmo tipo de PDF — faturas recorrentes, um esquema de extrato fixo, um formulário de requerimento padrão — para que cada resultado tenha as chaves exatas que indica, pela mesma ordem. Adicione uma descrição opcional a cada chave para afinar a precisão.

Posso guardar um modelo de campos e reutilizá-lo para o mesmo tipo de PDF?

Sim. No modo manual, defina as suas chaves e transfira-as como modelo (JSON ou CSV). Carregue esse modelo para qualquer PDF futuro do mesmo tipo para reproduzir um conjunto de campos idêntico, ou transfira os campos atuais a qualquer momento para manter os seus modelos sincronizados.

Posso editar os dados extraídos antes de os transferir?

Sim. Os resultados surgem numa tabela editável — corrija um número mal lido, ajuste uma etiqueta, adicione um campo que a IA não captou ou elimine uma linha de que não precisa. As suas edições são incorporadas no ficheiro exportado, por isso a transferência reflete exatamente o que confirmou.

Posso transferir um modelo do esquema dos resultados?

Sim. A partir dos resultados pode guardar o conjunto de campos atual como modelo e reutilizá-lo no documento seguinte — útil quando está a trabalhar numa pilha de PDF semelhantes e quer uma saída consistente de cada vez.

Que formatos de exportação posso transferir e qual se adequa a cada fluxo de trabalho?

JSON para APIs, scripts e pipelines; CSV em formato horizontal (uma linha por documento) para resumos em folha de cálculo, ou vertical (chave/valor por linha) para revisões detalhadas; Excel em .xlsx horizontal ou vertical para analistas; e XML para sistemas antigos e de gestão documental.

Que outros tipos de ficheiro posso carregar além de PDF?

PNG, JPG, TIFF, WebP, GIF, BMP e SVG. Assim, se um documento chegar como digitalização, foto de telemóvel ou TIFF de vários fotogramas, pode processá-lo com o mesmo fluxo de trabalho sem mudar de ferramenta.

O extrator de dados PDF é mesmo gratuito, sem registo nem instalação?

Sim. A extração principal é totalmente gratuita — sem conta, sem cartão de crédito, sem software para transferir e sem extensão de navegador. Abra a página, largue o seu PDF e exporte os seus dados.

Existe um limite de tamanho de ficheiro para os PDF?

Sim — são suportados carregamentos até 50 MB por ficheiro. Para PDF muito grandes ou com muitas páginas, divida o documento ou extraia apenas as páginas de que precisa; para grande volume contínuo, pergunte-nos sobre as opções de escalabilidade.

E os PDF protegidos por palavra-passe?

Remova a palavra-passe ou guarde uma cópia desbloqueada antes de carregar — os PDF encriptados não podem ser lidos enquanto estão bloqueados. Depois de removida a proteção, a página é extraída normalmente.

Os meus dados PDF são privados e seguros?

Sim. Os ficheiros são processados para o seu pedido de extração e não são armazenados, conservados nem partilhados depois. Para organizações com requisitos de conformidade — finanças, saúde, jurídico, administração pública — contacte-nos sobre uma implementação local ou nas suas instalações, para que os PDF nunca saiam da sua infraestrutura.

Posso usar a ferramenta noutros idiomas?

Sim. O extrator de dados PDF está disponível em 20 idiomas, para que você e a sua equipa possam trabalhar na interface com que se sentem mais à vontade.

DESBLOQUEIE MAIS

Pronto para escalar?

Ler uma página PDF de cada vez é suficiente para alguns documentos. Quando precisa de todas as páginas, centenas de ficheiros ou da extração integrada nos seus sistemas, escolha a opção que corresponde ao seu volume.

Executar localmente

Extração local e de todas as páginas

Processe todas as páginas de um PDF numa só passagem e mantenha os ficheiros na sua própria infraestrutura — ideal quando extratos, contratos ou registos não podem sair da sua rede. Sem navegador, sem fila, sem limite por ficheiro.

Contacte-nos
Grande volume

Centenas de PDF numa única execução

Uma pasta de faturas, um mês de extratos, um lote de formulários de sinistro — extraia a pilha inteira numa única execução em vez de carregar um PDF de cada vez.

Contacte-nos
B2B / B2C

API para os seus fluxos documentais

Integre a extração de PDF diretamente no seu produto — contas a pagar, integração KYC, receção de sinistros, revisão de contratos — com acesso à API e sem CAPTCHA.

Fale connosco

Tem outro caso de utilização? Conte-nos →