IRONSOFTWAREHOME

Jak czytać zdjęcia w C# z IronOCR

Curtis Chau
Curtis Chau
Updated: 9 maja 2026

Metoda ReadPhoto IronOCR wyodrębnia tekst z złożonych formatów zdjęć takich jak TIFF i GIF, dostarczając uporządkowane wyniki z regionami tekstu i poziomami zaufania, zoptymalizowanymi dla wysokiej jakości dokumentów skanowanych wymagających dokładnego przetwarzania OCR.

Przy obróbce dużych ilości dokumentów, zwłaszcza zeskanowanych obrazów jak pliki TIFF, ręczne wyodrębnianie tekstu staje się czasochłonne i podatne na błędy. Optical Character Recognition (OCR) automatyzuje ten proces, konwertując tekst z obrazów na dane cyfrowe. Technologia OCR obsługuje złożone obrazy jak zeskanowane dokumenty i fotografie, zamieniając je w przeszukiwalny, edytowalny tekst. To przyspiesza przetwarzanie dokumentów i zapewnia dokładne wyodrębnianie danych.

Użycie OCR na formatach takich jak TIFF i GIF umożliwia szybkie cyfrowe przetwarzanie ogromnych ilości danych, pomimo ich rozmiaru, głębi kolorów czy problemów z kompresją. Dzięki funkcji ReadPhoto IronOCR programiści mogą wyodrębniać tekst z obrazów i wykonywać zaawansowane operacje, takie jak wyszukiwanie słów kluczowych lub konwertowanie skanowanych danych do przeszukiwalnych PDF. Technologia ta przynosi korzyści branżom zajmującym się dokumentami prawnymi, archiwami lub paragonami, gdzie efektywne wyszukiwanie danych jest kluczowe.

Ten samouczek demonstruje użycie ReadPhoto i manipulację obiektem results. Omówimy, kiedy używać ReadPhoto zamiast standardowego Read z IronOCR. W przypadku ogólnego przetwarzania obrazów warto zapoznać się z różnymi formatami obrazów.

Aby użyć tej funkcji, zainstaluj IronOcr.Extension.AdvancedScan pakiet.

Szybki start: Użyj ReadPhoto do wyodrębniania tekstu ze złożonych obrazów

Szybki start: użyj metody ReadPhoto IronOCR na OcrInput załadowanym z ramką obrazu, aby wyodrębnić cały tekst i regiony. Jest zoptymalizowany do TIFFów, GIFów i podobnych formatów zdjęć.

  1. 1Install IronOCR with NuGet Package Manager

    PM > Install-Package IronOcr

  2. 2Skopiuj i uruchom ten fragment kodu.

    var result = new IronTesseract().ReadPhoto(new OcrInput().LoadImageFrame("photo.tiff", 0));
    C#
  3. 3Wdrożenie do testowania w środowisku produkcyjnym

    Rozpocznij używanie IronOCR w swoim projekcie już dziś z darmową wersją próbną
    arrow pointer

Jak wyodrębnić tekst z obrazów TIFF używając ReadPhoto?

Odczytywanie wysokiej jakości formatów zdjęć, takich jak TIFF i GIF, jest proste dzięki IronOCR. Najpierw, utwórz zmienną OcrInput i załaduj obraz, korzystając z LoadImageFrame. Następnie użyj metody ReadPhoto, aby uzyskać wyniki. Wielostronicowy samouczek dotyczący OCR plików TIFF zawiera dodatkowe przykłady dokumentów wielostronicowych.

Zwróć uwagę:
  • Plik TIFF zawiera wiele klatek; parametr PageNumber jest wymagany z indeksowaniem od zera.
  • Metoda obsługuje obecnie język angielski, chiński, japoński, koreański oraz alfabet łaciński.
  • Korzystanie z zaawansowanego skanowania w środowisku .NET Framework wymaga architektury x64.

)]

Jakiego formatu pliku użyć?

Ponieważ przeglądarki nie obsługują natywnie formatu TIFF, pobierz plik wejściowy TIFF tutaj. Poniższa wersja została przekonwertowana do formatu WEBP.

Dane wejściowe

Jak zaimplementować metodę ReadPhoto?

Ta implementacja pokazuje, jak wyodrębnić tekst i informacje o regionie z obrazu TIFF. Więcej przykładów można znaleźć w naszym przykładzie kodu odczytu zdjęć.

using IronOcr;
using IronSoftware.Drawing;
using System;

// Instantiate OCR engine
var ocr = new IronTesseract();

using var inputPhoto = new OcrInput();
inputPhoto.LoadImageFrame("ocr.tiff", 0);

// Read photo
OcrPhotoResult result = ocr.ReadPhoto(inputPhoto);

// Index number refer to region order in the page
int number = result.TextRegions[0].PageNumber;

// Extract the text in the first region
string textinregion = result.TextRegions[0].TextInRegion;

//Extract the co_ordinates of the first text region
Rectangle region = result.TextRegions[0].Region;

var output = $"Text in First Region: {textinregion}\n"
             + $"Text Region:\n"
             + $"Starting X: {region.X}\n"
             + $"Starting Y: {region.Y}\n"
             + $"Region Width: {region.Width}\n"
             + $"Region Height: {region.Height}\n"
             + $"Result Confidence: {result.Confidence}\n\n"
             + $"Full Scnned Photo Text: {result.Text}";

Console.WriteLine(output);

Jakie właściwości dostarcza OcrPhotoResult?

Wyjście debugowania pokazujące wyodrębnienie tekstu OCR z numerem telefonu, współrzędnymi i poziomem zaufania z przetworzonego obrazu

Klasa OcrPhotoResult dostarcza kluczowych właściwości do analizy wyodrębnionego tekstu. Szczegółowe informacje na temat pracy z wynikami OCR można znaleźć w naszym przewodniku dotyczącym eksportu danych i przetwarzania wyników.

Text: Wyodrębniony tekst z wejścia OCR.
Confidence: Statystyczna precyzja (skala 0-1, gdzie 1 to najwyżej). Dowiedz się więcej o wskaźnikach pewności wyników.
TextRegions: Lista regionów tekstu z danymi o lokalizacji. Podobnie jak w przypadku definiowania obszarów OCR do ukierunkowanego wyodrębniania.


Kiedy powinienem użyć ReadPhoto zamiast Read?

Główna różnica między ReadPhoto a standardowym Read to obiekt result i obsługiwane formaty plików. LoadImageFrame specyficznie akceptuje TIFF i GIF, nie formaty takie jak JPEG. ReadPhoto jest zoptymalizowany dla złożonych formatów obrazów, podczas gdy standardowy Read jest odpowiedni dla prostszych obrazów i ogólnych zadań wyodrębniania tekstu.

Dlaczego ReadPhoto obsługuje tylko formaty TIFF i GIF?

TIFF to bezstratny format służący do kompresji wielu stron i klatek w jeden plik. Jest on wykorzystywany do przechowywania wielu obrazów o wysokiej jakości, takich jak dokumenty prawne i obrazy medyczne. Ponieważ jest bardziej złożony niż JPEG, wymaga innych metod wyodrębniania tekstu. Specjalistyczne podejście zapewnia optymalne wyniki dzięki profesjonalnym formatom obrazów.

Obrazy TIFF wykorzystują różne metody kompresji, dlatego IronOCR stosuje specjalistyczne algorytmy do rozszyfrowywania tekstu. Zaawansowane algorytmy w ReadPhoto obsługują charakterystyki kompresji TIFF, zapewniając dokładne wyodrębnienie z złożonych dokumentów wielowarstwowych.

Oto porównanie formatów TIFF i JPEG:

FunkcjaTIFF (Tagowany Format Pliku Obrazu)JPG/JPEG (Grupa Ekspertów Fotograficznych Joint Photographic Experts Group)
KompresjaBezstratny lub nieskompresowany (zachowuje jakość)Kompresja stratna (obniża jakość w celu zmniejszenia rozmiaru pliku)
Rozmiar plikuDuży (ze względu na wysoką jakość i opcjonalny brak kompresji)Mniejszy, zoptymalizowany do użytku w sieci i szybkiego ładowania
Jakość obrazuWysoka (idealna do użytku profesjonalnego, zachowuje wszystkie szczegóły)Niższa (z powodu kompresji stratnej, pewna utrata jakości)
Głębia kolorówObsługuje wysoką głębię kolorów (do 16 bitów lub 32 bitów na kanał)Kolory 24-bitowe (16,7 mln kolorów)
Przykład zastosowaniaProfesjonalna fotografia, publikowanie, skanowanie, archiwizacjaObrazy internetowe, media społecznościowe, codzienne zdjęcia
PrzejrzystośćObsługuje przezroczystość i kanały alfaNie obsługuje przezroczystości
RedakcjaNadaje się do wielokrotnej edycji (bez utraty jakości przy ponownym zapisywaniu)Jakość pogarsza się wraz z wielokrotnymi edycjami i zapisywaniem
KompatybilnośćSzeroko obsługiwane w profesjonalnym oprogramowaniuObsługiwane na wszystkich platformach i urządzeniach
AnimacjaNie obsługuje animacjiNie obsługuje animacji
MetadanePrzechowuje obszerne metadane (EXIF, warstwy itp.)Zapisuje metadane EXIF, ale ma większe ograniczenia

Jak wybrać między ReadPhoto a Read dla mojej aplikacji?

Należy rozważyć każdy przypadek użycia w środowisku produkcyjnym, aby zoptymalizować wydajność aplikacji. Podczas gdy ReadPhoto jest odpowiedni dla złożonych obrazów TIFF, przetwarza je wolniej. Format JPEG zapewnia szybsze przetwarzanie, ale niższą jakość, co może skutkować niskim wskaźnikiem pewności OCR. W razie potrzeby użyj filtrów poprawiających jakość obrazu, aby uzyskać lepsze wyniki.

Właściwość confidence w OcrPhotoResults lub jakakolwiek klasa interfejsu IOcrResult wskazuje na dokładność wyników, pozwalając programistom testować i optymalizować. Dla najwyższych wymagań precyzji, ReadPhoto z obrazami TIFF wysokiej jakości daje najlepsze wyniki, zwłaszcza przy przetwarzaniu dokumentów archiwalnych lub prawnych, gdzie precyzja ma znaczenie.

Należy znaleźć równowagę między wydajnością a dokładnością, upewniając się, że obrazy spełniają określone progi jakości. Dla mieszanych typów dokumentów wdroż hybrydowe podejście: używaj ReadPhoto dla krytycznych dokumentów wymagających wysokiej dokładności i standardowy Read dla rutynowych zadań z priorytetem na szybkość.

Często Zadawane Pytania

Jakie formaty obrazow obsługuje metoda ReadPhoto?

Metoda ReadPhoto w IronOCR jest zoptymalizowana dla zlozonych formatow zdjec jak TIFF i GIF. Jest specjalnie zaprojektowana do ekstrakcji tekstu z wysokiej jakosci zeskanowanych dokumentow i fotografii, zapewniajac zorganizowane wyniki z regionami tekstowymi i ocenami pewnosci.

Jak wyodrebnic tekst z obrazu TIFF?

Aby wyodrebnic tekst z obrazow TIFF za pomoca IronOCR, utworz zmienna OcrInput, zaladuj obraz uzywajac LoadImageFrame, a nastepnie zastosuj metode ReadPhoto. Proces jest prosty: var result = new IronTesseract().ReadPhoto(new OcrInput().LoadImageFrame("photo.tiff", 0));

Jaki dodatkowy pakiet jest wymagany do uzycia funkcji ReadPhoto?

Aby uzyc funkcji ReadPhoto w IronOCR, nalezy zainstalować pakiet IronOcr.Extension.AdvancedScan z NuGet. To rozszerzenie zapewnia zaawansowane mozliwosci skanowania wymagane dla metody ReadPhoto.

Kiedy nalezy uzyc ReadPhoto zamiast standardowej metody Read?

Uzyj metody ReadPhoto w IronOCR przy pracy ze zlozonymi formatami zdjec jak TIFF i GIF, szczegolnie dla wysokiej jakosci zeskanowanych dokumentow wymagajacych dokladnego przetwarzania OCR. Standardowa metoda Read jest lepsza do ogolnych zadan przetwarzania obrazow.

Jakiego rodzaju wyniki dostarcza ReadPhoto?

Metoda ReadPhoto w IronOCR dostarcza zorganizowane wyniki OCR, ktore zawieraja wyekstraktowane regiony tekstu z ocenami pewnosci. Mozna uzyskac do nich dostep poprzez wlasciwosc OcrPhotoResult, aby przegladac i manipulowac wyekstrakowanymi danymi.

Czy ReadPhoto moze przetwarzac dokumenty wielostronicowe?

Tak, metoda ReadPhoto w IronOCR moze przetwarzac dokumenty wielostronicowe, zwlaszcza pliki TIFF, ktore czesto zawieraja wiele ramek. Metoda LoadImageFrame umożliwia okreslenie, która ramke przetworzyc w dokumentach wielostronicowych.

Jakie branze korzystaja z technologii OCR do zdjec?

IronOCR przynosi korzysci branzom zajmujacym sie dokumentami prawnymi, archiwami, paragonami i wszelkimi firmami obslugujacymi duze ilosci zeskanowanych dokumentow, gdzie efektywne odzyskiwanie danych jest kluczowe. Metoda ReadPhoto automatyzuje ekstrakcje tekstu z tych zlozonych formatow obrazow.

What additional tools does IronOCR provide to improve OCR results?

IronOCR offers image quality correction filters to enhance OCR results, allowing for better accuracy even with lower-quality images.

Is there support for multiple languages with the ReadPhoto method?

Yes, IronOCR's ReadPhoto method supports multiple languages, including English, Chinese, Japanese, Korean, and Latin Alphabet, enhancing its usability across different languages.

How can developers view and manipulate extracted data using IronOCR?

Developers can use the OcrPhotoResult property in IronOCR to view and manipulate extracted data, allowing for detailed analysis and handling of OCR results.

Curtis Chau
Autor tekstów technicznych

Curtis Chau posiada tytuł licencjata z informatyki (Uniwersytet Carleton) i specjalizuje się w front-endowym rozwoju, z ekspertką w Node.js, TypeScript, JavaScript i React. Pasjonuje się tworzeniem intuicyjnych i estetycznie przyjemnych interfejsów użytkownika, Curtis cieszy się pracą z nowoczesnymi frameworkami i tworzeniem dobrze zorganizowanych, atrakcyjnych wizualnie podręczników.

...
Czytaj więcej

Gotowy, aby rozpocząć?

Nuget Downloads 6,236,385Wersja:2026.9właśnie wydany

Otrzymaj swój darmowy Klucz Próbny na 30 dni natychmiast.
Nie wymaga karty kredytowej ani tworzenia konta
Biblioteka C# NuGet dla plików PDF
Zainstaluj za pomocą NuGet

Wersja: 2026.9

PM > Install-Package IronOcr
nuget.org/packages/IronOcr/
  1. W Eksploratorze Rozwiązań, kliknij prawym przyciskiem Myszy na Odwołania, Zarządzaj pakietami NuGet
  2. Wybierz Przeglądaj i szukaj „IronOCR”
  3. Wybierz pakiet i zainstaluj
DLL PDF dla C#
Pobierz DLL

Wersja: 2026.9

lub pobierz Instalator Windows tutaj.

  1. Pobierz i rozpakuj IronOCR do lokalizacji, takiej jak ~/Libs w katalogu Solution
  2. W Eksploratorze rozwiązań Visual Studio kliknij prawym przyciskiem myszy Odwołania. Wybierz Przeglądaj, „IronOCR.dll”

Licencje od 749 USD

Key in blue circle

Uzyskaj natychmiast swój darmowy 30-dniowy Klucz Testowy.

Your trial license will be sent to your email address

Brak ograniczeń. 100% dostępności. Bez karty kredytowej.

bullet_checkedNie wymaga karty kredytowej ani tworzenia kontaBrak ograniczeń. 100% dostępności. Bez karty kredytowej.
  • Logo Aetna
  • Logo NASA
  • Logo GE
  • Logo Porsche
  • Logo USDA
  • Logo Qatar
Join Millions of Engineers who’ve tried IronPDF
Otrzymaj swoją Konsultację Bez Zobowiązań
Wypełnij poniższy formularz lub wyślij e-mail na sales@ironsoftware.com
Twoje dane zawsze będą utrzymywane w tajemnicy.
Zaufane przez miliony inżynierów na całym świecie
Logotypy klientów Iron Software
Otrzymaj swój darmowy Klucz Próbny na 30 dni natychmiast.
Nie wymaga karty kredytowej ani tworzenia konta