跳至頁尾內容
OCR 工具

OCR Foto(初學者教學)

光學字元識別(OCR)技術已經徹底改變了我們在數位世界中與文字互動的方式。 OCR照片工具使得能夠將圖像轉換為文字,更容易地將印刷筆記數位化。

在本文中,我們將探討四種在線OCR工具——包括免費和付費的——並以介紹IronOCR作結,展示如何在C#中以程式化方式實現OCR。

1. Google Vision API

Google Vision API 提供由Google提供的強大OCR解決方案,用於建立圖像到文字轉換器。 它支持圖像和PDF文字提取,並可識別多種語言的文字。

OCR Foto (初學者教程):圖1

優點

  • 高準確度
  • 語言支持
  • 可與其他Google雲服務整合。

缺點

  • 需要API金鑰
  • 超過某一使用限度後並非完全免費。

步驟1:獲取API金鑰

  • 存取 Google雲控制台
  • 建立一個新專案或選擇現有專案。
  • 啟用Cloud Vision API並生成API金鑰。

步驟2:發送API請求

  • 使用像cURL這樣的工具或您選擇的編程語言發送HTTP POST請求。
  • 在請求有效負載中包括圖像文件或URL。
curl -s -X POST -H "Content-Type: application/json" \
    -H "Authorization: Bearer YOUR_API_KEY" \
    --data-binary @path/to/your/image.jpg \
    "https://vision.googleapis.com/v1/images:annotate?key=YOUR_API_KEY"
curl -s -X POST -H "Content-Type: application/json" \
    -H "Authorization: Bearer YOUR_API_KEY" \
    --data-binary @path/to/your/image.jpg \
    "https://vision.googleapis.com/v1/images:annotate?key=YOUR_API_KEY"
SHELL

步驟3:解析結果

  • 從API回應中提取識別到的文字。
{
  "responses": [
    {
      "textAnnotations": [
        {
          "description": "Hello World!",
          "boundingPoly": { /* bounding box coordinates */ }
        }
      ]
    }
  ]
}

2. Tesseract OCR

Tesseract 是一款Google開發的開源OCR引擎。 它支持100多種語言,並因其準確性和靈活性而廣泛使用。 它有助於從多種文件格式轉換圖像,甚至將掃描的圖像轉換為可編輯文字。

OCR Foto (初學者教程):圖2

優點

  • 開源
  • 高準確度
  • 社群支持

缺點

  • 可能需要額外的工具來進行整合
  • 可能需要圖像預處理以達到最佳效果。

步驟1:安裝Tesseract

  • 官方GitHub儲存庫下載並安裝Tesseract OCR。
  • 將Tesseract文件夾新增到PATH環境變數中,以便從終端存取它。

步驟2:在圖像上運行OCR

  • 打開終端並導航到包含圖像的文件夾。
  • 執行以下命令:
tesseract path/to/your/image.jpg output.txt
tesseract path/to/your/image.jpg output.txt
SHELL

步驟3:查看結果

  • 打開生成的文字文件(output.txt)以查看提取的文字。

3. ABBYY FineReader Online

ABBYY FineReader 在線是一種基於雲的OCR服務,允許使用者將掃描文件和圖像轉換為可編輯格式。

這個在線工具提供免費使用的基於OCR的文字轉換器,用於從圖像中提取文字,毫不費力。

OCR Foto (初學者教程):圖3

優點

  • 友好的圖像OCR工具
  • 支持不同的輸入格式
  • 保持文件格式

缺點

  • 免費使用的限制
  • 需要網路連接

步驟1:存取ABBYY FineReader Online

  • 前往ABBYY FineReader Online網站。
  • 下載Windows或Mac的免費試用版。
  • 安裝軟體並按照給定步驟操作。

步驟2:上傳圖像

  • 點擊"選擇文件"按鈕並上傳您的圖像。

步驟3:處理圖像

  • 等待圖像被處理。 工具將自動提取文字。

步驟4:編輯文字

  • 保存提取的文字或使用編輯器進行必要的更正。
  • 以Word、Excel和文字格式保存。

4. Online OCR

Online OCR 是一種基於網頁的OCR服務,支持線上圖像轉文字轉換的多種語言。 使用者可以直接從他們的裝置上傳圖像或提供URL。

優點

  • 簡單的使用者介面
  • 支持不同的輸入格式
  • 免費使用但有限制

缺點

  • 限制的免費功能
  • 依賴於網路連接

步驟1:存取Online OCR

前往Online OCR網站。

步驟2:上傳圖像

點擊"選擇文件"按鈕並上傳您的圖像。

OCR Foto (初學者教程):圖4

步驟3:選擇語言和輸出格式

選擇圖像中文字的語言和輸出格式。

OCR Foto (初學者教程):圖5

步驟4:開始OCR

點擊"轉換"按鈕以開始OCR過程。

步驟5:下載文字

一旦過程完成,從提供的連結下載提取的文字。

OCR Foto (初學者教程):圖6

Introduction to IronOCR in C

現在,讓我們深入了解IronOCR,一款為C#提供強大OCR功能的程式庫,為開發者提供無縫實現OCR功能的工具。 IronOCR是由Iron Software團隊開發的領先C# OCR程式庫。

IronOCR脫穎而出,是專為C#開發者設計的穩健的光學字元識別(OCR)程式庫,提供強大的功能套件用於從圖像中準確和無縫地提取文字。

以其可靠性和效率著稱,IronOCR在尋找圖像和文件文字提取的完整解決方案的C#開發者中獲得了廣泛的關注。

憑藉對準確性和多功能性的關注,IronOCR已成為從文件管理系統到資料提取應用等專案的首選之一。

利用先進的OCR演算法,IronOCR在準確解讀各種圖像格式的文字方面表現出色,包括JPEG、PNG和TIFF。 其多功能性擴展至多語言支持,使其成為滿足多樣語言需求應用的寶貴工具。

該程式庫與流行的.NET架構無縫整合,簡化了C#應用中OCR功能的實現。

無論您是用掃描文件還是圖像,IronOCR的綜合功能都能讓開發者輕鬆地將OCR能力引入他們的專案。

IronOCR功能詳細介紹

  1. 先進的OCR演算法:IronOCR使用複雜的OCR演算法,超越基本的字元識別,確保即使在複雜情況下也能獲得高準確度。
  2. 圖像格式支持:開發者可以利用IronOCR支持多種圖像格式的優勢,如JPEG、PNG和TIFF,提供靈活性來處理多樣的視覺內容。
  3. 多語言支持:鑑於應用的全球特性,IronOCR配備多語言支持,使能夠精確地提取不同語言的文字。
  4. PDF文字提取:除了圖像外,IronOCR還擴展其能力以從PDF文件中提取文字,提升其在以數位格式保存文件情況下的應用。
  5. 與.NET架構的整合:IronOCR與流行的.NET架構無縫整合,使C#開發者可以毫不費力地將OCR功能整合到他們的專案中,而不需進行廣泛配置。

Implementing OCR with IronOCR in C

以下是一個在C#中使用IronOCR 從圖像中提取文字的簡單範例:

using IronOcr; // Import the IronOcr namespace

// Create an instance of IronTesseract
var ocr = new IronTesseract();

// Read text from the specified image file
string imageText = ocr.Read(@"images\image.png").Text;

// Output the extracted text
Console.WriteLine(imageText);
using IronOcr; // Import the IronOcr namespace

// Create an instance of IronTesseract
var ocr = new IronTesseract();

// Read text from the specified image file
string imageText = ocr.Read(@"images\image.png").Text;

// Output the extracted text
Console.WriteLine(imageText);
Imports IronOcr ' Import the IronOcr namespace

' Create an instance of IronTesseract
Private ocr = New IronTesseract()

' Read text from the specified image file
Private imageText As String = ocr.Read("images\image.png").Text

' Output the extracted text
Console.WriteLine(imageText)
$vbLabelText   $csharpLabel

這段簡單的C#程式碼片段展示了如何使用IronOCR從圖像文件中讀取文字。開發者可以根據他們的具體需求進一步定制OCR過程。

有關IronOCR高級功能的詳細資訊,請存取文件頁面。

結論

OCR照片工具在從圖像數位化文字內容方面起著關鍵作用。 雖然各種在線工具提供了便利,但IronOCR為開發者提供了一個強大且靈活的解決方案,將OCR功能整合到他們的C#應用中。

在選擇在線工具和程式化實現的程式庫之間,這取決於如準確性要求、定制需求以及開發者對OCR過程控制程度等因素。

IronOCR確實提供免費試用是必要的。 從這裡下載軟體。

Kannaopat Udonpant
軟體工程師
在成為軟體工程師之前,Kannapat在日本北海道大學完成了環境資源博士學位。在攻讀學位期間,Kannapat還成為車輛機器人實驗室的一員,該實驗室隸屬於生產工程系。在2022年,他憑藉C#技能加入了Iron Software的工程團隊,專注於IronPDF。Kannapat珍視他的工作,因為他能直接向撰寫大部分IronPDF程式碼的開發者學習。除了同儕學習,Kannapat還喜歡在Iron Software工作的社交方面。不寫程式碼或文件時,Kannapat通常在他的PS5上玩遊戲或重看The Last of Us。

Iron 支援團隊

我們線上24小時,每週5天。
聊天
電子郵件
給我打電話