apache tika检测文件是否损坏的方法
2019-12-17 12:05
1146 查看
Apache Tika用于文件类型检测和从各种格式的文件内容提取的库。
将上传文件至服务器,进行解析文件时,经常需要判断文件是否损坏。我们可以使用tika来检测文件是否损坏
maven引入如下:
<dependency> <groupId>org.apache.tika</groupId> <artifactId>tika-app</artifactId> <version>1.18</version> </dependency> <dependency> <groupId>xerces</groupId> <artifactId>xercesImpl</artifactId> <version>2.11.0</version> </dependency>
如果jar包冲突时可以引入如下:
<dependency> <groupId>org.apache.tika</groupId> <artifactId>tika-core</artifactId> <version>1.18</version> </dependency> <dependency> <groupId>org.apache.tika</groupId> <artifactId>tika-parsers</artifactId> <version>1.18</version> </dependency> <dependency> <groupId>xerces</groupId> <artifactId>xercesImpl</artifactId> <version>2.11.0</version> </dependency>
使用tika检测文件是否损坏:
如果从输入流读取失败,则parse方法抛出IOException异常,从流中获取的文档不能被解析抛TikaException异常,处理器不能处理事件则抛SAXException异常
当文档不能被解析时,说明文档损坏
执行过程:
public static void main(String[] args) { try { //Assume sample.txt is in your current directory File file = new File("D:\\测试.txt"); boolean result = isParseFile(file); } catch (Exception e) { e.printStackTrace(); } } /** * 验证文件是否损坏 * * @param file 文件 * @return true/false * @throws Exception */ private static boolean isParseFile(File file) throws Exception { try { Tika tika = new Tika(); String filecontent = tika.parseToString(file); System.out.println(filecontent); return true; } catch (TikaException e) { return false; } }
输出结果:
测试数据---读取文本内容
总结
以上所述是小编给大家介绍的apache tika检测文件是否损坏的方法,希望对大家有所帮助,如果大家有任何疑问请给我留言,小编会及时回复大家的。在此也非常感谢大家对脚本之家网站的支持!
如果你觉得本文对你有帮助,欢迎转载,烦请注明出处,谢谢!
您可能感兴趣的文章:
相关文章推荐
- 检测一个文件是否存在的方法
- 在config配置文件添加iis的Mime类型,检测文件中是否存在添加语句,使用xml解析方法
- NET检测文件和文件夹是否存在的方法
- go语言检测文件是否存在的方法
- 自动化测试:k8s环境下,通过检测文件是否存在来自动启停tomcatapp的方法_20160316_七侠镇莫尛貝
- PHP检测文件方法,类方法是否存在
- 检测一个文件是否为文本文件/二进制文件的方法
- C# 检测文件是否被其他进程占用的几种方法
- 自动化测试:k8s环境下,通过检测文件是否存在来自动启停tomcatapp的方法_20160316_七侠镇莫尛貝
- 检测远程URL是否存在的三种方法
- asp.net(c#)上传文件时检测文件类型方法小结
- 检测远程URL是否存在的三种方法
- Asp检测文件是否存在的函数
- LNK1123: 转换到 COFF 期间失败: 文件无效或损坏 &amp;&amp; CVT1100: 重复的资源 解决方法
- 检测远程URL是否存在 方法参考
- 回滚段表空间中的一个数据文件丢失或者损坏的恢复方法的总结
- 用javascript实现检测指定目录是否存在的方法 原创
- 数据库文件损坏后的恢复方法
- oracle9i回滚段表空间数据文件损坏或丢失后的恢复方法
- 检测网络是否连接的两种方法(C#)