您的位置:首页 > 编程语言 > C#

C#实现Word中表格信息读取

2017-01-23 11:06 525 查看

很多时候,会有很多信息存放在Word文档中。而我们需要把这些信息提取出来,另做它用。而Word的格式是ms的机密,不知道有没有NB人可以对其做字符流的分析,反正我是没这能力也没这打算。所以就只能用ms提供的组件来进行编程。但ms没有提供托管的类库,而是提供了对com组件的PIA转换。具体添加,使用和相关知识,可以参见kaneboy's blog中的http://blog.joycode.com/kaneboy/articles/67688.aspx。高手的讲解,很是清晰。

而我想做的是对word文档中的表信息进行提取。网上很难找到相关的代码(打开一个已有文档,对其内容进行分析),但我觉得这种工作是很有意义的。写了一段小的Demo,如下:
object oFileName = @"C:\Documents and Settings\liush\My Documents\TestDoc.doc";

object oReadOnly = true;

object oMissing = System.Reflection.Missing.Value;
Word._Application oWord;

Word._Document oDoc;

oWord = new Word.Application();

oWord.Visible = true;//只是为了方便观察

oDoc = oWord.Documents.Open(ref oFileName, ref oMissing, ref oReadOnly, ref oMissing, ref oMissing,

    ref oMissing, ref oMissing, ref oMissing, ref oMissing, ref oMissing, ref oMissing, ref oMissing);
//MessageBox.Show(oDoc.Tables.Count.ToString());

for (int tablePos = 1; tablePos <= oDoc.Tables.Count; tablePos++)

{

    Word.Table nowTable = oDoc.Tables.Item(tablePos);

    string tableMessage = string.Format("第{0}/{1}个表:\n", tablePos, oDoc.Tables.Count);
    for (int rowPos = 1; rowPos <= nowTable.Rows.Count; rowPos++)

    {

for (int columPos = 1; columPos <= nowTable.Columns.Count; columPos++)

{

tableMessage += nowTable.Cell(rowPos, columPos).Range.Text;

tableMessage = tableMessage.Remove(tableMessage.Length - 2, 2);//remove \r\a

tableMessage += "\t";

}
tableMessage += "\n";

    }
    MessageBox.Show(tableMessage);

}
如果看过了上面kaneboy的文章(这是一个系列的之一),再看这段代码应该不会很难理解。打开一个已有文档,然后遍历其中的所有的表。这里只是简单的将信息显示出来,具体实践上可以对这些信息进行分析。做完这些后,终于找到了一些官方的支持文档,地址如下:
http://msdn2.microsoft.com/zh-CN/library/y1xatbkd.aspx

其中的word任务有对word各种操作的简单代码事例,用vb和c#写的。看完之后,我想每个人都会明白vb对com的支持比c#不是简单明了一点两点。(可以看下这个http://blog.joycode.com/kaneboy/archive/2005/08/03/61489.aspx)同样的代码,用vb实现打开word文档的操作,代码如下:
Dim fileName As String = "C:\Documents and Settings\liush\My Documents\TestDoc.doc"

Dim isReadOnly As Boolean = True
Dim wordApplication As Word.Application = New Word.Application()

Dim wordDocument As Word.Document

wordApplication.Visible = True

wordDocument = wordApplication.Documents.Open(fileName, , isReadOnly)
所以,下次我要做COM操作的时候,我还会回归我可爱的VB的。但是,用了太久的C#毛病越来越多了,动不动就习惯性加括号,加分号。。。
内容来自用户分享和网络整理,不保证内容的准确性,如有侵权内容,可联系管理员处理 点击这里给我发消息
标签: