您的位置：首页 > 其它

用户实时行为数据采集

2016-07-21 11:32 120 查看

用户实时行为数据采集如下：

1.web、wap通过埋点实时发送用户行为数据至后端server， app直接调用http接口，server通过logback直接输出日志文件

2.flume通过tail命令监控日志文件变化

3.flume通过生产者消费者模式将tail收集到日志推送至kafka集群

4.kafka根据服务分配topic，一个topic可以分配多个group，一个group可以分配多个partition

5.storm实时监听kafka，流式处理日志内容，根据特定业务规则，将数据实时存储至cache，同时根据需要可以写入hdfs

6.kafka直接写入hdfs

内容来自用户分享和网络整理，不保证内容的准确性，如有侵权内容，可联系管理员处理

标签： 实时日志采集 flume kafka

相关文章推荐

Kafka 之中级
Flume环境部署和配置详解及案例大全
Linux下Kafka单机安装配置方法(图文)
Kafka使用入门教程第1/2页
Play! Akka Flume实现的完整数据收集
log4j + flume 1.6 集成
flume自定义Interceptor
使用Flume聚合Tomcat 日志
#Note# Analyzing Twitter Data with Apache Hadoo...
Logstash 与Elasticsearch整合使用示例
大数据实验室（大数据基础培训）——Kafka的安装、配置及基础使用
大数据实验室（大数据基础培训）——概要
kafka-manager 的编译和使用（附安装包）
Kafka源码调试环境搭建
Kafka+Log4j实现日志集中管理
apache flume 配置存储在Linux本地服务器
Kafka深度解析
Kafka设计解析（三）- Kafka High Availability （下）
kafka+storm初探

新的分享

一次教科书级别的Redis高可用架构设计实践 - Redis
曾光：北京这次的毒株不像国内流行类型
从PRD文档到产品上线，有哪些问题需要解决？
vue3自定义指令的使用
Oracle SQL性能优化最常用的40条建议 - ORACLE
程序员翻车常见反应，你中枪了吗？ - 职场生涯
新鲜开源：基于Prometheus的企业监控平台设计与实现 - 运维
嵌入式软件开发之程序架构设计-任务调度
【Java面试】请简单说一下你对受检异常和非受检异常的理解
奇安信更新招股书：第一季亏损过5亿，齐向东持股38%
艾瑞咨询：2020年中国后智能厨房案例研究报告
艾瑞咨询：2020年中国人工智能+物流发展研究报告

章节导航