-
C# 读取Word文本框中的文本、图片和表格(附VB.NET代码)
【概述】
Word中可插入文本框,在文本框中可添加文本、图片、表格等内容。本篇文章通过C#程序代码介绍如何来读取文本框中的文本、图片和表格等内容。附VB.NET代码,有需要可作参考。
【程序环境】
程序中所需必要的程序集文件Spire.Doc.dll,及其他相关dll文件(见下文)。
用于测试的Word源文档如图:
【程序代码】
1.读取文本框中的文本
所需程序集:
【C#】
using Spire.Doc; using Spire.Doc.Documents; using Spire.Doc.Fields; using System; using System.IO; using System.Text; namespace ExtractText { class Program { static void Main(string[] args) { //加载Word源文档 Document doc = new Document(); doc.LoadFromFile("test.docx"); //获取文本框 TextBox textbox = doc.TextBoxes[0]; //创建StringBuilder类的对象 StringBuilder sb = new StringBuilder(); //遍历文本框中的对象,获取文本 foreach (object obj in textbox.Body.ChildObjects) { if (obj is Paragraph) { String text = ((Paragraph)obj).Text; sb.AppendLine(text); } } //保存写入的txt文档到指定路径 File.WriteAllText("ExtractedText.txt", sb.ToString()); System.Diagnostics.Process.Start("ExtractedText.txt"); } } }
【vb.net】
Imports Spire.Doc Imports Spire.Doc.Documents Imports Spire.Doc.Fields Imports System.IO Imports System.Text Namespace ExtractText Class Program Private Shared Sub Main(args As String()) '加载Word源文档 Dim doc As New Document() doc.LoadFromFile("test.docx") '获取文本框 Dim textbox As TextBox = doc.TextBoxes(0) '创建StringBuilder类的对象 Dim sb As New StringBuilder() '遍历文本框中的对象,获取文本 For Each obj As Object In textbox.Body.ChildObjects If TypeOf obj Is Paragraph Then Dim text As [String] = DirectCast(obj, Paragraph).Text sb.AppendLine(text) End If Next '保存写入的txt文档到指定路径 File.WriteAllText("ExtractedText.txt", sb.ToString()) System.Diagnostics.Process.Start("ExtractedText.txt") End Sub End Class End Namespace
文本读取结果:
2.读取文本框中的图片
所需程序集:
【C#】
using Spire.Doc; using Spire.Doc.Documents; using Spire.Doc.Fields; using System; namespace ExtractImg { class Program { static void Main(string[] args) { //加载Word源文档 Document doc = new Document(); doc.LoadFromFile("test.docx"); //获取文本框 TextBox textbox = doc.TextBoxes[0]; int index = 0 ; //遍历文本框中所有段落 for (int i = 0 ; i < textbox.Body.Paragraphs.Count;i++) { Paragraph paragraph = textbox.Body.Paragraphs[i]; //遍历段落中的所有子对象 for (int j = 0; j < paragraph.ChildObjects.Count; j++) { object obj = paragraph.ChildObjects[j]; //判定对象是否为图片 if (obj is DocPicture) { //获取图片 DocPicture picture = (DocPicture) obj; String imageName = String.Format("Image-{0}.png", index); picture.Image.Save(imageName, System.Drawing.Imaging.ImageFormat.Png); index++; } } } } } }
【vb.net】
Imports Spire.Doc Imports Spire.Doc.Documents Imports Spire.Doc.Fields Namespace ExtractImg Class Program Private Shared Sub Main(args As String()) '加载Word源文档 Dim doc As New Document() doc.LoadFromFile("test.docx") '获取文本框 Dim textbox As TextBox = doc.TextBoxes(0) Dim index As Integer = 0 '遍历文本框中所有段落 For i As Integer = 0 To textbox.Body.Paragraphs.Count - 1 Dim paragraph As Paragraph = textbox.Body.Paragraphs(i) '遍历段落中的所有子对象 For j As Integer = 0 To paragraph.ChildObjects.Count - 1 Dim obj As Object = paragraph.ChildObjects(j) '判定对象是否为图片 If TypeOf obj Is DocPicture Then '获取图片 Dim picture As DocPicture = DirectCast(obj, DocPicture) Dim imageName As [String] = [String].Format("Image-{0}.png", index) picture.Image.Save(imageName, System.Drawing.Imaging.ImageFormat.Png) index += 1 End If Next Next End Sub End Class End Namespace
图片读取结果:
3.读取文本框中的表格
所需程序集:
【C#】
using Spire.Doc; using Spire.Doc.Documents; using Spire.Doc.Fields; using System.IO; using System.Text; namespace ExtractTable { class Program { static void Main(string[] args) { //加载Word文档 Document doc = new Document(); doc.LoadFromFile("test.docx"); //获取文本框 TextBox textbox = doc.TextBoxes[0]; //获取文本框中表格 Table table = textbox.Body.Tables[0] as Table; StringBuilder sb = new StringBuilder(); //遍历表格中的段落并提取文本 foreach (TableRow row in table.Rows) { foreach (TableCell cell in row.Cells) { foreach (Paragraph paragraph in cell.Paragraphs) { sb.AppendLine(paragraph.Text); } } } File.WriteAllText("ExtractedTable.txt", sb.ToString()); } } }
【vb.net】
Imports Spire.Doc Imports Spire.Doc.Documents Imports Spire.Doc.Fields Imports System.IO Imports System.Text Namespace ExtractTable Class Program Private Shared Sub Main(args As String()) '加载Word文档 Dim doc As New Document() doc.LoadFromFile("test.docx") '获取文本框 Dim textbox As TextBox = doc.TextBoxes(0) '获取文本框中表格 Dim table As Table = TryCast(textbox.Body.Tables(0), Table) Dim sb As New StringBuilder() '遍历表格中的段落并提取文本 For Each row As TableRow In table.Rows For Each cell As TableCell In row.Cells For Each paragraph As Paragraph In cell.Paragraphs sb.AppendLine(paragraph.Text) Next Next Next File.WriteAllText("ExtractedTable.txt", sb.ToString()) End Sub End Class End Namespace
表格数据读取结果:
出处:https://www.cnblogs.com/Yesi/p/14509773.html
栏目列表
最新更新
nodejs爬虫
Python正则表达式完全指南
爬取豆瓣Top250图书数据
shp 地图文件批量添加字段
爬虫小试牛刀(爬取学校通知公告)
【python基础】函数-初识函数
【python基础】函数-返回值
HTTP请求:requests模块基础使用必知必会
Python初学者友好丨详解参数传递类型
如何有效管理爬虫流量?
2个场景实例讲解GaussDB(DWS)基表统计信息估
常用的 SQL Server 关键字及其含义
动手分析SQL Server中的事务中使用的锁
openGauss内核分析:SQL by pass & 经典执行
一招教你如何高效批量导入与更新数据
天天写SQL,这些神奇的特性你知道吗?
openGauss内核分析:执行计划生成
[IM002]Navicat ODBC驱动器管理器 未发现数据
初入Sql Server 之 存储过程的简单使用
SQL Server -- 解决存储过程传入参数作为s
关于JS定时器的整理
JS中使用Promise.all控制所有的异步请求都完
js中字符串的方法
import-local执行流程与node模块路径解析流程
检测数据类型的四种方法
js中数组的方法,32种方法
前端操作方法
数据类型
window.localStorage.setItem 和 localStorage.setIte
如何完美解决前端数字计算精度丢失与数