C#讀取PDF文件的文本內容

本文轉載自查看原文 2017-05-25 15:37 10165 C#（.Net）

  public static string ReadPdfContent(string filepath)
        {
            try
            {
                string pdffilename = filepath;
                PdfReader pdfReader = new PdfReader(pdffilename);
                int numberOfPages = pdfReader.NumberOfPages;
                StringBuilder text = new StringBuilder();
                for (int i = 1; i <= numberOfPages; ++i)
                {
                    text.Append(iTextSharp.text.pdf.parser.PdfTextExtractor.GetTextFromPage(pdfReader, i));
                }
                pdfReader.Close();
                return text.ToString();
            }
            catch (Exception ex)
            {
                return "原因：" + ex.ToString();
            }
        }

注：此方法需要引用iTextSharp

免責聲明！

本站轉載的文章為個人學習借鑒使用，本站對版權不負任何法律責任。如果侵犯了您的隱私權益，請聯系本站郵箱yoyou2525@163.com刪除。

猜您在找 C#讀取PDF文件 C#讀取PDF文檔文字內容 C# 讀取txt文本的內容 C# winfrom 讀取txt文本內容 C# 讀取文件內容 python 讀取pdf文本內容 C#對文件下文本文件內容的讀取 c# 打開文件和讀取文件內容 C#異步將文本內容寫入文件 C#讀取大文本文件