IRONSOFTWAREHOME

C#网页抓取库

突破基础HTML解析的局限。借助.NET 10的多线程技术,实现自动化网页抓取,大规模提取并导出结构化数据。

  • Scrape 使用 CSS 选择器、XPath 和 JavaScript 渲染
  • 具有数百个同时请求的多线程
  • 支持节流、代理、用户代理和 robots.txt
  • 免费试用 30 天,功能齐全,无需信用卡
C# 网页抓取器
using IronWebScraper;

public class Program
{
    private static void Main(string[] args)
    {
        var ScrapeJob = new BlogScraper();
        ScrapeJob.Start();
    }
}

public class BlogScraper : WebScraper
{
    public override void Init()
    {
        LoggingLevel = LogLevel.All;
        Request("https://www.zyte.com/blog/", Parse);
    }

    public override void Parse(Response response)
    {
        foreach (HtmlNode title_link in response.Css(".oxy-post-title"))
        {
            string strTitle = title_link.TextContentClean;
            Scrape(new ScrapedData() { { "Title", strTitle } });
        }

        if (response.CssExists("div.oxy-easy-posts-pages > a[href]"))
        {
            string next_page = response.Css("div.oxy-easy-posts-pages > a[href]")[0].Attributes["href"];
            Request(next_page, Parse);
        }
    }
}
NuGet Downloads Badge
PM >Install-Package IronWebScraper

跨平台支持

为在.NET 10, 9, 8, 7, 6, 5, Core, Standard, or Framework上运行的C#, F#, & VB.NET而设计

NET 标志
Visual Studio 标志
NuGet 标志
ReSharper
Windows 标志
Linux 标志
Mac 标志
Docker 标志
Azure 标志
AWS 标志

为什么选择 IronWebScraper

从单个 C# 类中抓取成千上万的页面。CSS 选择器、XPath、JavaScript 渲染、虚拟身份和礼貌控件在一个库中。

点击查看关于 IronWebScraper 的视频

广泛的抓取能力

  • using CSS 选择器或 XPath 表达式进行解析;jQuery 风格的语法。
  • 渲染 JavaScript 页面,不仅是静态 HTML。
  • 输出到 C# 类实例、JSON 或下载文件。

5 分钟内启动

  • PM > Install-Package IronWebScraper

    → 5分钟快速入门。
  • 简单API:Request(url, Parse), response.Css(".selector"), Scrape(data).
  • 智能默认设置:由框架处理多线程、礼貌性和缓存。

Enterprise绩效

  • .NET 10,Core,Standard,或 Framework
  • 支持C#,VB.NET,F#。DigiCert签署的二进制文件。
  • 部署于任何地方:Windows、Linux、macOS、Docker、Azure、AWS。
支持的平台

礼貌、弹性和审核友好

  • 内置的限流、代理支持、用户代理和 robots.txt 合规性。
  • 虚拟用户身份:每次请求的用户代理、cookies、登录和 IP。
  • 自动保存的作业在出现异常、崩溃或掉电后恢复。

以开发者为先的支持和许可

  • 永久许可:一次购买,永久使用。可选更新和续订。
  • 24/5 工程师支持(Premium中24/7)。真人,聊天响应中位数<1分钟。
  • 30天退款保证不合适?全额退款,无需解释。

为建筑者

  • 您将真正使用的功能:
    • CSS 选择器 & XPath
    • multithreaded crawling
    • 代理 & 用户代理轮换
    • 虚拟用户身份
    • auto-resume on crash
    • JavaScript渲染
    • 限流 & 礼貌性
    • robots.txt 合规
    • 动作重放(离线)
    • JSON 或类输出
  • 适用于任何地方:Windows、Linux、macOS、Docker、Azure、AWS。

购买者

  • 被Iron Suite的数百万工程师信赖。
  • 为真实工作负载构建:系统迁移、竞争分析、搜索索引、数据挖掘。
  • 采购友好:永久许可证,可选续订,可开发票,多种支付选项(包括本地:Amazon Pay,支付宝,Apple Pay,IDEAL,SEPA,ACH)。
  • 30 天退款保证。

入门:C#代码示例

C# VB PDF .NET : C# 网页抓取器C# 网页抓取器
using IronWebScraper;

public class Program
{
    private static void Main(string[] args)
    {
        var ScrapeJob = new BlogScraper();
        ScrapeJob.Start();
    }
}

public class BlogScraper : WebScraper
{
    public override void Init()
    {
        LoggingLevel = LogLevel.All;
        Request("https://www.zyte.com/blog/", Parse);
    }

    public override void Parse(Response response)
    {
        foreach (HtmlNode title_link in response.Css(".oxy-post-title"))
        {
            string strTitle = title_link.TextContentClean;
            Scrape(new ScrapedData() { { "Title", strTitle } });
        }

        if (response.CssExists("div.oxy-easy-posts-pages > a[href]"))
        {
            string next_page = response.Css("div.oxy-easy-posts-pages > a[href]")[0].Attributes["href"];
            Request(next_page, Parse);
        }
    }
}
NuGet Downloads Badge
PM > Install-Package IronWebScraper

IronWebScraper 提供了一个强大的框架来使用 C# 代码从网站中提取数据和文件。

  1. 使用NuGet将 IronWebScraper 安装到您的项目中。
  2. 创建一个扩展WebScraper的类。
  3. 创建一个Request方法解析至少一个URL。
  4. 创建一个Request更多页面。 使用response.Css来使用jQuery风格的CSS选择器处理HTML元素。
  5. 在您的应用程序中,创建一个您自己的网页抓取类的实例并调用Start();方法。
  6. 阅读我们的C#网络抓取教程以学习如何使用IronWebScraper创建高级网络抓取器。
了解如何使用 C# 抓取在线电影网站数据

直接来自我们开发团队的人工支持

无论是产品、集成还是授权问题,Iron 产品开发团队随时准备回答您所有问题。立即联系并与 Iron 开始对话,以便在您的项目中充分利用我们的库。

强大的抓取引擎掌控在您手中

只需编写一个C#网页抓取器类即可将成千上万甚至百万网页抓取为C#类实例、JSON或下载文件。IronWebScraper允许您编写简洁、线性的工作流程,模拟人类浏览行为。IronWebScraper将作为一群虚拟网络浏览器并行运行您的代码,既有礼貌又具容错性。

简单、灵活的逻辑

必须编程IronWebScraper以了解如何处理它遇到的每种类型的页面。这是通过使用CSS选择器或XPath表达式以非常简洁的方式实现的,并且可以在C#中完全自定义。这种自由让您可以决定在网站上抓取哪些页面,以及对抓取的数据进行什么操作。每种方法都可以在Visual Studio中干净地调试和观看。

快速而有礼貌的行为

IronWebScraper处理多线程和网络请求,以便同时处理数百个并发线程,而无需开发人员去管理它们。礼貌可以设置为调节请求,从而减少对目标Web服务器的过度负载的风险。

创建虚拟用户身份

IronWebScraper可以使用一个或多个“身份” - 模拟实际世界中人类请求的会话。每个请求可以通过编程方式或随机分配其自己的身份、用户代理、Cookie、登录甚至IP地址。请求通过URL、解析方法和POST变量的组合设置为自动唯一。

动作重放

IronWebScraper使用高级缓存技术,允许开发者在不联机的情况下“现场”更改代码并重放每一个先前的请求。每个抓取作业都会自动保存,并且在出现异常或停电时可以恢复。
Visual Studio库用于PDF创建和内容编辑。

通过Microsoft Visual Studio快速安装

IronWebScraper通过Visual Studio安装程序迅速将网页抓取工具掌控在您的手中。无论是在Visual Studio中直接通过NuGet安装还是下载DLL,您都可以迅速完成设置。只需一个DLL,没有依赖项。

支持:

  • .NET Framework 4.0 及以上版本支持 C#、VB、F#
  • Microsoft Visual Studio。 .NET 开发 IDE 图标
  • NuGet 安装程序支持 Visual Studio
  • JetBrains ReSharper C# 语言助手兼容
  • Microsoft Azure C# .NET 托管平台兼容

.NET网页抓取社区教程

教程 + 代码示例 .NET中的网页抓取 | VB.NET 和 ASP.NET PDF
VBC#ASP.NET

C#和VB.NET项目中的网页抓取

了解Ahmed如何在他的项目中使用IronWebScraper将内容从一个站点迁移到另一个站点。提供用于抓取电子商务和博客网站的示例项目和代码

我们的客户使用IronWebScraper...

会计和金融系统

  • # 收据
  • # 报告
  • # 发票打印
向ASP.NET会计和金融系统添加PDF支持

业务数字化

  • # 文档
  • # 订购和标签
  • # 纸质替代
C#业务数字化用例

企业内容管理

  • # 内容制作
  • # 文档管理
  • # 内容分发
.NET CMS PDF支持

数据和报告应用程序

  • # 性能跟踪
  • # 趋势映射
  • # 报告
C# PDF报告
今天就加入他们
Iron Software企业.NET组件开发者
C#库开发者

数千家企业、政府、中小企业和开发者信赖Iron软件产品。

Iron团队在.NET软件组件市场拥有超过10年的经验。

Iron Software客户图标
Iron Software客户图标
Iron Software客户图标
Iron Software客户图标
Iron Software客户图标
Iron Software客户图标
Iron Software客户图标
Iron Software客户图标

一流的工程,
24小时支持

准备开始了吗?

Nuget Downloads 143,929版本:2026.9刚刚发布

立即获取您的免费30 天试用密钥
无需信用卡或创建账户
Key in blue circle

立即获取免费的 30 天试用版密钥

Your trial license will be sent to your email address

无任何限制。100% 解锁。无需信用卡。

bullet_checked无需信用卡或创建账户无任何限制。100% 解锁。无需信用卡。
  • Logo Aetna
  • Logo NASA
  • Logo GE
  • Logo Porsche
  • Logo USDA
  • Logo Qatar
Join Millions of Engineers who’ve tried IronPDF
预约您的免费现场演示
Booking Badge

深受全球数百万工程师信赖

Iron Software 的客户徽标
获取您的无义务咨询
填写下面的表格或通过sales@ironsoftware.com
您的资料将始终保密。
深受全球数百万工程师信赖
Iron Software 的客户徽标
立即获取您的免费30 天试用密钥
无需信用卡或创建账户