it编程 > 编程语言 > Asp.net

C#代码轻松实现从PDF文档中提取图片

43人参与 2026-09-04 Asp.net

从 pdf 中提取图片是许多用户都会遇到的常见需求,例如将图片重新用于演示文稿、归档重要图像,或便于后续分析。掌握使用 c# 提取 pdf 图片的方法,可以帮助开发者更高效地管理资源,并简化日常工作流程。

本文将介绍如何使用 c#pdf 的单个页面以及整个 pdf 文档中提取图片,并以 .net pdf 处理库作为实现工具。

安装 .net pdf 处理库

首先,需要将相关 pdf 处理库中的 dll 文件添加为 .net 项目的引用。你可以从对应的官方资源中下载所需文件,也可以通过 nuget 安装相应的 pdf 处理组件。

pm> install-package spire.pdf

从指定 pdf 页面中提取图片

如果只需要提取 pdf 某一页面中的图片,可以先获取该页面包含的图片信息,再将图片逐一保存为独立文件。使用 c# 和 .net pdf 处理库可以较方便地完成这一过程。

以下示例使用相关 pdf api 获取页面中的图片信息。通过 getimagesinfo() 方法可以读取指定页面中的图片集合,然后使用 image.save() 将提取出的图片保存为 png 文件。

基本步骤如下:

这种方式适用于只需要提取 pdf 中某个特定页面图片的场景,可以避免遍历整个文档,从而减少不必要的处理。

完整示例代码如下:

using spire.pdf;
using spire.pdf.utilities;
using system.drawing;

namespace extractimagesfromspecificpage
{
    class program
    {
        static void main(string[] args)
        {
            // 创建一个 pdfdocument 对象
            pdfdocument doc = new pdfdocument();

            // 加载 pdf 文档
            doc.loadfromfile("c:\\users\\administrator\\desktop\\input.pdf");

            // 获取指定页面
            pdfpagebase page = doc.pages[0];

            // 创建一个 pdfimagehelper 对象
            pdfimagehelper imagehelper = new pdfimagehelper();

            // 获取页面中的所有图片信息
            pdfimageinfo[] imageinfos = imagehelper.getimagesinfo(page);

            // 遍历图片信息
            for (int i = 0; i < imageinfos.length; i++)
            {
                // 获取指定的图片信息
                pdfimageinfo imageinfo = imageinfos[i];

                // 获取图片
                image image = imageinfo.image;

                // 将图片保存为 png 文件
                image.save("c:\\users\\administrator\\desktop\\extracted\\image-" + i + ".png");
            }

            // 释放资源
            doc.dispose();
        }
    }
}

从整个 pdf 文档中提取所有图片

了解如何从指定页面提取图片后,你还可以遍历 pdf 文档中的所有页面,并从每个页面中提取图片。这样可以一次性获取整个文档中包含的所有图片。

从整个 pdf 文档中提取所有图片的步骤如下:

完整示例代码如下:

using spire.pdf;
using spire.pdf.utilities;
using system.drawing;

namespace extractallimages
{
    class program
    {
        static void main(string[] args)
        {
            // 创建一个 pdfdocument 对象
            pdfdocument doc = new pdfdocument();

            // 加载 pdf 文档
            doc.loadfromfile("c:\\users\\administrator\\desktop\\input.pdf");

            // 创建一个 pdfimagehelper 对象
            pdfimagehelper imagehelper = new pdfimagehelper();

            // 声明一个 int 类型变量
            int m = 0;

            // 遍历所有页面
            for (int i = 0; i < doc.pages.count; i++)
            {
                // 获取指定页面
                pdfpagebase page = doc.pages[i];

                // 获取页面中的所有图片信息
                pdfimageinfo[] imageinfos = imagehelper.getimagesinfo(page);

                // 遍历图片信息
                for (int j = 0; j < imageinfos.length; j++)
                {
                    // 获取指定的图片信息
                    pdfimageinfo imageinfo = imageinfos[j];

                    // 获取图片
                    image image = imageinfo.image;

                    // 将图片保存为 png 文件
                    image.save("c:\\users\\administrator\\desktop\\extracted\\image-" + m + ".png");
                    m++;
                }

            }

            // 释放资源
            doc.dispose();
        }
    }
}

总结

提取 pdf 中的图片是文档处理中的常见需求。通过 c# 和 .net pdf 处理库,可以根据实际需求提取单个页面中的图片,也可以遍历整个 pdf 文档,一次性获取所有页面中的图片。

本文介绍了两种实现方式:第一种针对指定页面,通过获取页面中的图片信息并逐一保存,实现精准提取;第二种遍历 pdf 的所有页面,获取每一页中的图片并保存为独立的 png 文件。开发者可以根据具体应用场景选择合适的方法,从而更高效地处理和管理 pdf 中的图像资源。

到此这篇关于c#代码轻松实现从pdf文档中提取图片的文章就介绍到这了,更多相关c# pdf提取图片内容请搜索代码网以前的文章或继续浏览下面的相关文章希望大家以后多多支持代码网!

(0)

您想发表意见!!点此发布评论

推荐阅读

使用C#实现条形码和二维码生成与识别功能

09-05

C#代码轻松实现为Word段落或文本添加底纹

09-05

C#将.NET4项目升级为.NET8项目的流程步骤

09-01

C#代码轻松实现在PowerPoint中平均分布表格行和列

09-09

C#可选参数时重载详细方案

09-10

C#代码如何设置限制PDF复制和打印权限

09-10

猜你喜欢

版权声明:本文内容由互联网用户贡献,该文观点仅代表作者本人。本站仅提供信息存储服务,不拥有所有权,不承担相关法律责任。 如发现本站有涉嫌抄袭侵权/违法违规的内容, 请发送邮件至 2386932994@qq.com 举报,一经查实将立刻删除。

发表评论