擷取文字
當從文件中提取大量文字時,處理過程可能效率低下且耗時,特別是在處理表格和大量段落時。然而,IronWord的ExtractText方法是一種節省時間的解決方案。 它使開發者能夠輕鬆提取文件中特定數量的所有文字,消除了需要額外迴圈的需求,並簡化了對Text屬性的存取。 此方法確保開發者可以高效工作並節省寶貴的時間。
在此範例中,我們將展示多種使用ExtractText方法的方式,並提高您從文件中檢索文字的效率。
從Docx中提取文字的實用方法
using IronWord;WordDocument doc = new WordDocument("multi-paragraph.docx");Console.WriteLine(doc.ExtractText());Console.WriteLine(doc.Paragraphs[0].ExtractText());Console.WriteLine(doc.Paragraphs.Last().ExtractText());
提取文字
使用IronWord程式庫,從Word文件中提取文字是一個簡單的過程。 我們首先導入程式庫並初始化WordDocument類。 此步驟使我們能夠載入帶有段落的現有文件。我們隨後調用ExtractText方法,並將文件的整個文字列印到控制台。
提取特定文字
上面的範例提取了整個文件的文字,但使用IronWord程式庫,您可以完全控制提取過程。 如果您只想要特定部分或段落,可以在Paragraphs的陣列。 作為一個通用列表,該陣列可以根據您的需求進行操作,可以通過如上所示的doc.Paragraphs[0]調用索引,或使用C#集合的內建陣列方法。
當存取Paragraphs的索引時,我們僅返回並提取文件的第一段文字,並將其列印到控制台。 隨後,我們還在Last,僅返回並提取文件的最後一段文字。

