IT数码 购物 网址 头条 软件 日历 阅读 图书馆
TxT小说阅读器
↓语音阅读,小说下载,古典文学↓
图片批量下载器
↓批量下载图片,美女图库↓
图片自动播放器
↓图片自动播放器↓
一键清除垃圾
↓轻轻一点,清除系统垃圾↓
开发: C++知识库 Java知识库 JavaScript Python PHP知识库 人工智能 区块链 大数据 移动开发 嵌入式 开发工具 数据结构与算法 开发测试 游戏开发 网络协议 系统运维
教程: HTML教程 CSS教程 JavaScript教程 Go语言教程 JQuery教程 VUE教程 VUE3教程 Bootstrap教程 SQL数据库教程 C语言教程 C++教程 Java教程 Python教程 Python3教程 C#教程
数码: 电脑 笔记本 显卡 显示器 固态硬盘 硬盘 耳机 手机 iphone vivo oppo 小米 华为 单反 装机 图拉丁
 
   -> 大数据 -> 离线项目笔记:数据拉取之flume的配置 -> 正文阅读

[大数据]离线项目笔记:数据拉取之flume的配置

上下游配置文件

上游

##定义a1的三个组件的名称
a1.sources = r1
a1.sinks = k1
a1.channels = c1

##定义Source的类型
a1.sources.r1.channels = c1
a1.sources.r1.type = TAILDIR
a1.sources.r1.filegroups = g1
a1.sources.r1.filegroups.g1 = /var/logdata/whh_online_data.*
a1.sources.r1.batchSize = 5000

##定义Channel的类型
a1.channels.c1.type = file
a1.channels.c1.checkpointDir = /opt/data/flume-data/checkpoint/
a1.channels.c1.dataDir = /opt/data/flume-data/data/
a1.channels.c1.transactionCapacity = 10000

##定义Sink的类型
a1.sinks.k1.channel = c1
a1.sinks.k1.type = AVRO
a1.sinks.k1.hostname = node03
a1.sinks.k1.port = 4646

下游

两个下游(node03)

# 命名此代理上的组件
a2.sources = r1
a2.sinks = k1
a2.channels = c1


#描述/配置源
a2.sources.r1.channels = c1
a2.sources.r1.type = avro
a2.sources.r1.bind = node03
a2.sources.r1.port = 4646


#使用在内存中缓冲事件的通道
a2.channels.c1.type = file
a2.channels.c1.checkpointDir = /opt/data/flume-data/checkpoint/
a2.channels.c1.dataDir = /opt/data/flume-data/data/
a2.channels.c1.transactionCapacity = 10000


#描述接收器
a2.sinks.k1.channel = c1
a2.sinks.k1.type = HDFS
a2.sinks.k1.hdfs.path = hdfs://hdfs-whh/logdata/applog/%Y-%m-%d/
a2.sinks.k1.hdfs.filePrefix = whh-
a2.sinks.k1.hdfs.fileSuffix = .log.snappy
a2.sinks.k1.hdfs.rollInterval = 300
a2.sinks.k1.hdfs.rollSize = 104857600
a2.sinks.k1.hdfs.rollCount = 100
a2.sinks.k1.hdfs.fileType = CompressedStream
a2.sinks.k1.hdfs.codeC = snappy
a2.sinks.k1.hdfs.useLocalTimeStamp = false

启动命令

服务端:node03
bin/flume-ng agent -n a2 -c conf/ -f myconf/avro_2_hdfs.conf -Dflume.root.logger=INFO,console ? ? 将日志打印到控制台在命令后面加入-Dflume.root.logger=INFO,console

客户端:node01,node02
bin/flume-ng agent -n a1 -c conf/ -f myconf/file_2_avro.conf

后台启动:
nohup bin/flume-ng agent -n a2 -c conf/ -f myconf/file_2_avro.conf 1>/dev/null 2>&1 &

查看状态
bin/flume-ng agent -n a2 -c conf/ -f myconf/avro_2_hdfs.conf -Dflume.monitoring.type=http -Dflume.monitoring.port=34545


bin/flume-ng agent -n a2 -c conf/ -f myconf/avro_2_hdfs.conf -Dflume.root.logger=INFO,console -Dflume.monitoring.type=http -Dflume.monitoring.port=34545

上游:
先在flume目录下创建文件 myconf,在myconf目录下配置文件vim file_2_avro.conf

下游
先在flume目录下创建文件myconf,在myconf目录下配置文件vim avro_2_hdfs.conf


启动时,因为数据存放到hdfs中,所以先把hadoop集群启动,随后启动服务端,
启动客户端,开启数据。

  大数据 最新文章
实现Kafka至少消费一次
亚马逊云科技:还在苦于ETL?Zero ETL的时代
初探MapReduce
【SpringBoot框架篇】32.基于注解+redis实现
Elasticsearch:如何减少 Elasticsearch 集
Go redis操作
Redis面试题
专题五 Redis高并发场景
基于GBase8s和Calcite的多数据源查询
Redis——底层数据结构原理
上一篇文章      下一篇文章      查看所有文章
加:2022-07-21 21:37:17  更:2022-07-21 21:39:27 
 
开发: C++知识库 Java知识库 JavaScript Python PHP知识库 人工智能 区块链 大数据 移动开发 嵌入式 开发工具 数据结构与算法 开发测试 游戏开发 网络协议 系统运维
教程: HTML教程 CSS教程 JavaScript教程 Go语言教程 JQuery教程 VUE教程 VUE3教程 Bootstrap教程 SQL数据库教程 C语言教程 C++教程 Java教程 Python教程 Python3教程 C#教程
数码: 电脑 笔记本 显卡 显示器 固态硬盘 硬盘 耳机 手机 iphone vivo oppo 小米 华为 单反 装机 图拉丁

360图书馆 购物 三丰科技 阅读网 日历 万年历 2024年5日历 -2024/5/19 22:19:10-

图片自动播放器
↓图片自动播放器↓
TxT小说阅读器
↓语音阅读,小说下载,古典文学↓
一键清除垃圾
↓轻轻一点,清除系统垃圾↓
图片批量下载器
↓批量下载图片,美女图库↓
  网站联系: qq:121756557 email:121756557@qq.com  IT数码