博客
关于我
C# 读取Word文本框中的文本、图片和表格(附VB.NET代码)
阅读量:414 次
发布时间:2019-03-06

本文共 6900 字,大约阅读时间需要 23 分钟。

【概述】

Word文档中的文本框可以包含丰富多样的内容,包括文本、图片、表格等。在本文中,我们将通过C#程序代码介绍如何读取这些文本框中的内容。附有VB.NET代码供参考,需要的话可以作为参考。

【程序环境】

在运行本程序之前,需要确保以下程序集文件已安装:

  • Spire.Doc
  • Spire.Doc.Documents
  • Spire.Doc.Fields
  • System
  • System.IO
  • System.Text

此外,还需要安装以下相关DLL文件:

【程序代码】

1. 读取文本框中的文本

【C#】

using Spire.Doc;using Spire.Doc.Documents;using Spire.Doc.Fields;using System;using System.IO;using System.Text;namespace ExtractText{    class Program    {        static void Main(string[] args)        {            // 加载Word源文档            Document doc = new Document();            doc.LoadFromFile("test.docx");                        // 获取文本框            TextBox textbox = doc.TextBoxes[0];                        // 创建StringBuilder类的对象            StringBuilder sb = new StringBuilder();                        // 遍历文本框中的对象,获取文本            foreach (object obj in textbox.Body.ChildObjects)            {                if (obj is Paragraph)                {                    string text = ((Paragraph)obj).Text;                    sb.AppendLine(text);                }            }                        // 保存写入的txt文档到指定路径            File.WriteAllText("ExtractedText.txt", sb.ToString());                        System.Diagnostics.Process.Start("ExtractedText.txt");        }    }}

【VB.NET】

Imports Spire.DocImports Spire.Doc.DocumentsImports Spire.Doc.FieldsImports System.IOImports System.TextNamespace ExtractText    Class Program    {        Private Shared Sub Main(args As String())            ' 加载Word源文档            Dim doc As New Document()            doc.LoadFromFile("test.docx")                        ' 获取文本框            Dim textbox As TextBox = doc.TextBoxes(0)                        ' 创建StringBuilder类的对象            Dim sb As New StringBuilder()                        ' 遍历文本框中的对象,获取文本            For Each obj As Object In textbox.Body.ChildObjects                If TypeOf obj Is Paragraph Then                    Dim text As String = DirectCast(obj, Paragraph).Text                    sb.AppendLine(text)                End If            Next                        ' 保存写入的txt文档到指定路径            File.WriteAllText("ExtractedText.txt", sb.ToString())                        System.Diagnostics.Process.Start("ExtractedText.txt")        End Sub    End ClassEnd Namespace

2. 读取文本框中的图片

【C#】

using Spire.Doc;using Spire.Doc.Documents;using Spire.Doc.Fields;using System;using System.IO;using System.Text;namespace ExtractImg{    class Program    {        static void Main(string[] args)        {            // 加载Word源文档            Document doc = new Document();            doc.LoadFromFile("test.docx");                        // 获取文本框            TextBox textbox = doc.TextBoxes[0];                        int index = 0;                        // 遍历文本框中的所有段落            for (int i = 0; i < textbox.Body.Paragraphs.Count; i++)            {                Paragraph paragraph = textbox.Body.Paragraphs[i];                                // 遍历段落中的所有子对象                for (int j = 0; j < paragraph.ChildObjects.Count; j++)                {                    object obj = paragraph.ChildObjects[j];                                        // 判断对象是否为图片                    if (obj is DocPicture)                    {                        // 获取图片                        DocPicture picture = (DocPicture)obj;                        string imageName = String.Format("Image-{0}.png", index);                        picture.Image.Save(imageName, System.Drawing.Imaging.ImageFormat.Png);                        index++;                    }                }            }        }    }}

【VB.NET】

Imports Spire.DocImports Spire.Doc.DocumentsImports Spire.Doc.FieldsNamespace ExtractImg    Class Program    {        Private Shared Sub Main(args As String())            ' 加载Word源文档            Dim doc As New Document()            doc.LoadFromFile("test.docx")                        ' 获取文本框            Dim textbox As TextBox = doc.TextBoxes(0)                        Dim index As Integer = 0                        ' 遍历文本框中的所有段落            For i As Integer = 0 To textbox.Body.Paragraphs.Count - 1                Dim paragraph As Paragraph = textbox.Body.Paragraphs(i)                                ' 遍历段落中的所有子对象                For j As Integer = 0 To paragraph.ChildObjects.Count - 1                    Dim obj As Object = paragraph.ChildObjects(j)                                        ' 判断对象是否为图片                    If TypeOf obj Is DocPicture Then                        ' 获取图片                        Dim picture As DocPicture = DirectCast(obj, DocPicture)                        Dim imageName As String = [String].Format("Image-{0}.png", index)                        picture.Image.Save(imageName, System.Drawing.Imaging.ImageFormat.Png)                        index += 1                    End If                Next            Next        End Sub    End ClassEnd Namespace

3. 读取文本框中的表格

【C#】

using Spire.Doc;using Spire.Doc.Documents;using Spire.Doc.Fields;using System.IO;using System.Text;namespace ExtractTable{    class Program    {        static void Main(string[] args)        {            // 加载Word文档            Document doc = new Document();            doc.LoadFromFile("test.docx");                        // 获取文本框            TextBox textbox = doc.TextBoxes[0];                        // 获取文本框中的表格            Table table = textbox.Body.Tables[0] as Table;                        StringBuilder sb = new StringBuilder();                        // 遍历表格中的段落并提取文本            foreach (TableRow row in table.Rows)            {                foreach (TableCell cell in row.Cells)                {                    foreach (Paragraph paragraph in cell.Paragraphs)                    {                        sb.AppendLine(paragraph.Text);                    }                }            }                        File.WriteAllText("ExtractedTable.txt", sb.ToString());        }    }}

【VB.NET】

Imports Spire.DocImports Spire.Doc.DocumentsImports Spire.Doc.FieldsImports System.IOImports System.TextNamespace ExtractTable    Class Program    {        Private Shared Sub Main(args As String())            ' 加载Word文档            Dim doc As New Document()            doc.LoadFromFile("test.docx")                        ' 获取文本框            Dim textbox As TextBox = doc.TextBoxes(0)                        ' 获取文本框中的表格            Dim table As Table = TryCast(textbox.Body.Tables(0), Table)                        Dim sb As New StringBuilder()                        ' 遍历表格中的段落并提取文本            For Each row As TableRow In table.Rows                For Each cell As TableCell In row.Cells                    For Each paragraph As Paragraph In cell.Paragraphs                        sb.AppendLine(paragraph.Text)                    Next                Next            Next                        File.WriteAllText("ExtractedTable.txt", sb.ToString())        End Sub    End ClassEnd Namespace

【最后】

以上就是本文关于通过C#程序读取Word中的文本框的方法。希望以上内容能为您提供帮助。如果需要转载请务必注明出处。

你可能感兴趣的文章
pip 或 pip3 为 Python 3 安装包?
查看>>
pip 文件损坏导致 pip无法使用 报错 ImportError: cannot import name 'main' from 'pip._int
查看>>
pip 无法从 requirements.txt 安装软件包
查看>>
pip/pip3更换国内源
查看>>
pip3 install PyQt5 --user 失败
查看>>
pip3命令全解析:Python3包管理工具的详细使用指南
查看>>
pip3安装命令重复创建文件‘/tmp/pip-install-xxxxx/package‘失败
查看>>
PIPE 接口信号列表
查看>>
pipeline配置与管理Job企业级实战
查看>>
pipeline项目配置实战
查看>>
Pipenv 与 Conda?
查看>>
QVGA/HVGA/WVGA/FWVGA分辨率屏含义及大小//Android虚拟机分辨率
查看>>
pipreqs : 无法将“pipreqs”项识别为 cmdlet、函数、脚本文件或可运行程序的名称。请检查名称的拼写,如果包括路径,请确保路径 正确,然后再试一次。
查看>>
pipy国内镜像的网址
查看>>
quiver绘制python语言
查看>>
pip下载缓慢
查看>>
PIP使用SSH从BitBucket安装自定义软件包,无需输入SSH密码
查看>>
pip命令提示unknow or unsupported command install解决方法
查看>>
pip在安装模块时提示Read timed out
查看>>
pip更换源
查看>>