把Word转为简洁html的若干方法 清理 拷贝 word 垃圾 代码 ,word 转 html
2008-03-25 10:27
731 查看
把Word转为简洁html的若干方法 - 网页设计专栏
word可以直接另存为 htm,但即使是 另存为 html 也会有大量的废代码。以前我一般用 dreamweaver 的 clean up html 来处理,先处理 word 特有标签,然后删除一些 font,b,span 等。进一步,在 editplus 里面用正则进行处理,最后得到我想要的干净的html 代码。当然最完美的办法就是拷贝文字出来,自己用文本编辑器书写htm标签,:) 今天又看到lifehacker这几种word 2 clean htm方法: 1.使用这个HTML Tidy Library Project开源软件来处理。 2.微软官方站点也有个Office 2000 HTML Filter 2.0工具,可以用来处理掉word2000转html时出现的多余代码。 3.使用这个Word HTML Cleaner 在线工具来处理。只能处理word2000以下版本。 4.有人给出了正则表达式(其实,上面的各种软件也都是用正则来解决的) 删除不需要的标签 <[/]?(font|span|xml|[ovwxp]:w+)[^>]*?>
- replace any matches with the empty string 删除class,style...等不需要的属性 <([^>]*)(?:class|lang|style|size|face|[ovwxp]:w+)=(?:'[^']*'|""[^""]*""|[^>]+)([^>]*)>
- replace any matches with <$1$2> 详细解释在Clean Word HTML using Regular Expressions
相关文章推荐
- php实现将上传word文件转为html的方法
- 利用C#代码将html样式文件与Word文档互换的方法
- 正则表达式去掉word转为html后的垃圾样式
- 用JS清除word保存为html格式后产生的垃圾代码
- 清除Word转html的垃圾代码
- php实现将上传word文件转为html的方法
- java代码拷贝到word中保持代码高亮方法
- eclipse中默认HTML和js编辑器非常慢,尤其在拷贝粘贴代码时的解决方法
- php实现将上传word文件转为html的方法
- 去除HTML代码中所有标签的两种方法
- Greenplum 清理垃圾、修改存储模式(行列变换) 平滑方法 - 交换数据、交互分区
- 如何解决eclipse中代码拷贝到word文档中高亮显示的问题
- Teleport Ultra/Teleport Pro的冗余代码批量清理方法
- 磁盘垃圾文件清理器python代码实现
- 类型的已垃圾回收委托进行了回调。这可能会导致应用程序崩溃、损坏和数据丢失。向非托管代码传递委托时,托管应用程序必须让这些委托保持活动状态,直到确信不会再次调用它们的问题的解决方法
- UIWebView中Html中用JS调用OC方法及OC执行JS代码
- Zen Coding: 一种快速编写HTML/CSS代码的方法
- 利用通道以及递归方法拷贝文件的代码案例
- HTML页面跳转方法及代码
- Python 代码简洁方法