Wyodrębnij tekst
Podczas wydobywania dużej ilości tekstu z dokumentów proces ten może być nieefektywny i czasochłonny, zwłaszcza przy pracy z tabelami i dużymi ilościami akapitów. Jednak metoda ExtractText IronWord to oszczędzające czas rozwiązanie. Umożliwia programistom łatwe wyodrębnianie całego określonego numeru tekstu w dokumencie, eliminując potrzebę dodatkowych pętli i upraszczając dostęp do właściwości Text. Ta metoda gwarantuje, że programiści mogą pracować wydajnie i oszczędzać cenny czas.
W tym przykładzie zaprezentujemy kilka sposobów użycia metody ExtractText i zwiększenia wydajności przy pobieraniu tekstu z dokumentów.
Przydatne sposoby na wyciąganie tekstu z pliku Docx
using IronWord;WordDocument doc = new WordDocument("multi-paragraph.docx");Console.WriteLine(doc.ExtractText());Console.WriteLine(doc.Paragraphs[0].ExtractText());Console.WriteLine(doc.Paragraphs.Last().ExtractText());
Wyodrębnij tekst
Dzięki bibliotece IronWord wyodrębnianie tekstu z dokumentu Worda jest prostym procesem. Zaczynamy od zaimportowania biblioteki i zainicjowania klasy WordDocument. Ten krok pozwala nam wczytać istniejący dokument zawierający akapity. Następnie wywołujemy metodę ExtractText i drukujemy cały tekst dokumentu na konsolę.
Wyodrębnij określony tekst
W powyższym przykładzie wyodrębniono cały tekst dokumentu, ale dzięki bibliotece IronWord masz pełną kontrolę nad procesem wyodrębniania. Jeśli chcesz tylko konkretne fragmenty lub akapity, możesz użyć właściwości Paragraphs w WordDocument, aby zwrócić tablicę Paragraphs. Jako ogólną listę, tę tablicę można manipulować zgodnie z wymaganiami, albo poprzez wywołanie indeksu, jak pokazano powyżej za pomocą doc.Paragraphs[0] lub korzystając z wbudowanych metod tablicowych dla kolekcji C#.
Podczas uzyskiwania dostępu do indeksu Paragraphs zwracamy i wyodrębniamy tylko tekst z pierwszego akapitu dokumentu i drukujemy go na konsolę. Następnie wywołujemy go również Last na tablicy Paragraphs, aby zwrócić i wyodrębnić tylko tekst ostatniego akapitu z dokumentu.

