대형 PDF에서 ReadPdf를 호출할 때 높은 사용 메모리

This article was translated from English: Does it need improvement?
Translated
View the article in English

거대한 PDF 전체에 대해 BarcodeReader.ReadPdf()를 한 번 호출하면 요청된 모든 페이지를 구성된 DPI로 스캔하도록 렌더링하므로 최대 메모리는 페이지 수와 해상도에 따라 조정되고 평평하게 유지되지 않습니다. 248페이지, 80MB 파일에서 300 DPI에서 메모리는 3GB에서 8GB 사이로 동작하며 12GB까지 급증하여 메모리 제한 환경에서는 실패하기에 충분했습니다.

BarcodeReader.ReadPdf()는 전달받은 모든 페이지를 단일 작업에서 처리합니다. 대형 고해상도 문서의 전체 페이지 범위가 한 번에 읽힐 때, 그 모든 페이지가 메모리에 함께 유지되므로 페이지 집합 크기에 따라 최대 사용량이 증가합니다. 이는 IronBarcode의 확인된 결함이 아닌 배치된 읽기 방식을 반영합니다.

해결책

1. 정해진 페이지 조각으로 읽기

PdfBarcodeReaderOptions.PageNumbers로 문서를 고정 페이지 크기의 조각으로 나누어 한 번에 하나의 조각만 메모리에 저장되도록 하세요. 작은 chunkSize는 최대 메모리를 줄이지만 통과 횟수가 증가하므로 환경의 메모리 한계에 맞춰 조정하세요.

var barcodeMetadata = new List<BarcodeResult>();
var pageChunks = Enumerable.Range(1, pdf.PageCount)
    .GroupBy(i => i / 50)
    .Select(g => g.ToArray())
    .ToList();
foreach (var chunk in pageChunks)
{
    var readerOptions = new PdfBarcodeReaderOptions
    {
        ExpectMultipleBarcodes = true,
        ExpectBarcodeTypes = IronBarCode.BarcodeEncoding.AllOneDimensional,
        Speed = ReadingSpeed.Detailed,
        ScanMode = BarcodeScanMode.OnlyDetectionModel,
        DPI = 300,
        PageNumbers = chunk
    };
    Console.WriteLine($"Processing pages: Pages {chunk.First()}-{chunk.Last()}");
    var chunkResult = BarcodeReader.ReadPdf(pdf.Stream, readerOptions);
    if (chunkResult != null && chunkResult.Count > 0)
    {
        barcodeMetadata.AddRange(chunkResult);
    }
    // Optional memory pressure relief
    GC.Collect();
    GC.WaitForPendingFinalizers();
}
Console.WriteLine($"Total barcodes found: {barcodeMetadata.Count}");
var barcodeMetadata = new List<BarcodeResult>();
var pageChunks = Enumerable.Range(1, pdf.PageCount)
    .GroupBy(i => i / 50)
    .Select(g => g.ToArray())
    .ToList();
foreach (var chunk in pageChunks)
{
    var readerOptions = new PdfBarcodeReaderOptions
    {
        ExpectMultipleBarcodes = true,
        ExpectBarcodeTypes = IronBarCode.BarcodeEncoding.AllOneDimensional,
        Speed = ReadingSpeed.Detailed,
        ScanMode = BarcodeScanMode.OnlyDetectionModel,
        DPI = 300,
        PageNumbers = chunk
    };
    Console.WriteLine($"Processing pages: Pages {chunk.First()}-{chunk.Last()}");
    var chunkResult = BarcodeReader.ReadPdf(pdf.Stream, readerOptions);
    if (chunkResult != null && chunkResult.Count > 0)
    {
        barcodeMetadata.AddRange(chunkResult);
    }
    // Optional memory pressure relief
    GC.Collect();
    GC.WaitForPendingFinalizers();
}
Console.WriteLine($"Total barcodes found: {barcodeMetadata.Count}");
Imports System
Imports System.Collections.Generic
Imports System.Linq
Imports IronBarCode

Dim barcodeMetadata As New List(Of BarcodeResult)()
Dim pageChunks = Enumerable.Range(1, pdf.PageCount) _
    .GroupBy(Function(i) i \ 50) _
    .Select(Function(g) g.ToArray()) _
    .ToList()

For Each chunk In pageChunks
    Dim readerOptions As New PdfBarcodeReaderOptions With {
        .ExpectMultipleBarcodes = True,
        .ExpectBarcodeTypes = BarcodeEncoding.AllOneDimensional,
        .Speed = ReadingSpeed.Detailed,
        .ScanMode = BarcodeScanMode.OnlyDetectionModel,
        .DPI = 300,
        .PageNumbers = chunk
    }
    Console.WriteLine($"Processing pages: Pages {chunk.First()}-{chunk.Last()}")
    Dim chunkResult = BarcodeReader.ReadPdf(pdf.Stream, readerOptions)
    If chunkResult IsNot Nothing AndAlso chunkResult.Count > 0 Then
        barcodeMetadata.AddRange(chunkResult)
    End If
    ' Optional memory pressure relief
    GC.Collect()
    GC.WaitForPendingFinalizers()
Next

Console.WriteLine($"Total barcodes found: {barcodeMetadata.Count}")
$vbLabelText   $csharpLabel

각 반복은 PageNumbers에 명시된 페이지만 읽으므로 메모리가 파일 전체에 걸쳐 누적되는 대신 청크 간에 다시 줄어듭니다.

2. PDF 스트림을 캐싱하고 위치를 재설정

루프 전에 스트림을 로컬로 읽고, 각 청크마다 되감습니다. Stream 속성은 접근 시마다 할당될 수 있으므로, 이를 var pdfStream = pdf.Stream;에 저장하고 각 청크 읽기 전에 pdfStream.Seek(0, SeekOrigin.Begin)를 호출합니다.

3. 한 번만 리더 옵션 빌드하기

루프 외부에서 PdfBarcodeReaderOptions를 구성하고, 매 반복마다 새로운 옵션 객체를 할당하기보다는 청크 당 PageNumbers만 변경합니다.

4. 결과 목록 미리 크기 조정하기

추가된 결과에 따라 내부 배열이 반복적으로 두 배가 되지 않도록 결과 목록을 추정 용량으로 초기화하세요. 대략 10페이지당 하나의 바코드라는 시작 수치를 재현이 추정합니다.

Curtis Chau
기술 문서 작성자

커티스 차우는 칼턴 대학교에서 컴퓨터 과학 학사 학위를 취득했으며, Node.js, TypeScript, JavaScript, React를 전문으로 하는 프론트엔드 개발자입니다. 직관적이고 미적으로 뛰어난 사용자 인터페이스를 만드는 데 열정을 가진 그는 최신 프레임워크를 활용하고, 잘 구성되고 시각적으로 매력적인 매뉴얼을 제작하는 것을 즐깁니다.

커티스는 개발 분야 외에도 사물 인터넷(IoT)에 깊은 관심을 가지고 있으며, 하드웨어와 소프트웨어를 통합하는 혁신적인 방법을 연구합니다. 여가 시간에는 게임을 즐기거나 디스코드 봇을 만들면서 기술에 대한 애정과 창의성을 결합합니다.

시작할 준비 되셨나요?
Nuget 다운로드 2,317,217 | 버전: 2026.7 방금 출시
Still Scrolling Icon

아직도 스크롤하고 계신가요?

빠른 증거를 원하시나요? PM > Install-Package BarCode
샘플을 실행하세요 실이 바코드로 변하는 모습을 지켜보세요.