您的位置:首页 > 运维架构 > Apache

OSS 数据湖实践 —— 使用EMR JindoFs Cache提升性能

2020-05-27 13:58 417 查看

精选30+云产品,助力企业轻松上云!>>>

通过使用cache缓存机制,减少数据分析处理过程中直读OSS的次数,不仅能够提高性能,更能减少与OSS的交互流量,减少数据分析成本与时间开销。

前提条件

  • 已注册阿里云账号,详情请参见注册云账号。
  • 已开通E-MapReduce服务和OSS服务。
  • 已完成云账号的授权,详情请参见角色授权。
  • 已创建Haoop集群,且带有Hive组件,且配置OSS数据源。

步骤一:设置JindoFs Cache

打开smartdata服务中client配置,
把jfs.cache.data-cache.enable为1, 表示打开JindoFs的cache功能打开

步骤二:进行作业测试

数据分析作业具体可看其他OSS数据湖实践文档功能
OSS Spark 实践文档
OSS Flink 实践文档
OSS Hive 实践文档


1000
内容来自用户分享和网络整理,不保证内容的准确性,如有侵权内容,可联系管理员处理 点击这里给我发消息