Extrair Imagens
O plugin Documentize PDF Extractor for .NET permite que você extraia facilmente imagens de documentos PDF. Ele analisa seus arquivos PDF, identifica imagens incorporadas e as extrai mantendo sua qualidade e formato originais. Esta ferramenta melhora a acessibilidade do conteúdo visual e simplifica o processo de recuperação de imagens de PDFs.
Como Extrair Imagens de um PDF
Para extrair imagens de um arquivo PDF, siga estas etapas:
- Crie uma instância da classe
ExtractImagesOptions
. - Adicione o caminho do arquivo de entrada às opções usando o método
AddInput
. - Defina o caminho do diretório de saída para as imagens usando o método
AddOutput
. - Processar a extração de imagens utilizando o plugin.
- Recupere as imagens extraídas do contêiner de resultados.
1// Criar ExtractImagesOptions para definir instruções
2var options = new ExtractImagesOptions();
3// Adicionar caminho do arquivo de entrada
4options.AddInput(new FileDataSource("caminho_para_seu_arquivo_pdf.pdf"));
5// Definir caminho do diretório de saída
6options.AddOutput(new DirectoryDataSource("caminho_para_diretorio_de_resultados"));
7// Realizar o processo
8var results = PdfExtractor.ExtractImages(options);
9// Obter caminho do resultado da imagem
10var imageExtracted = results.ResultCollection[0].ToFile();
Extraindo Imagens de Arquivo PDF para Streams sem pasta
O plugin PdfExtractor suporta salvar em streams, o que permite que você extraia imagens de arquivos PDF em streams sem usar pastas temporárias.
1// Criar ExtractImagesOptions para definir instruções
2var options = new ExtractImagesOptions();
3// Adicionar caminho do arquivo de entrada
4options.AddInput(new FileDataSource("caminho_para_seu_arquivo_pdf.pdf"));
5// Não defina saída - ele gravará resultados em streams
6// Realizar o processo
7var results = PdfExtractor.ExtractImages(options);
8// Obter Stream
9var ms = results.ResultCollection[0].ToStream();
10// Copiar dados para arquivo para demonstração
11ms.Seek(0, SeekOrigin.Begin);
12using (var fs = File.Create("arquivo_teste.png"))
13{
14 ms.CopyTo(fs);
15}
Principais Características:
- Extrair Imagens Incorporadas: Identificar e extrair imagens de documentos PDF.
- Preservar a Qualidade da Imagem: Garante que as imagens extraídas mantenham sua qualidade original.
- Saída Flexível: Salve as imagens extraídas no seu formato ou local preferido.