【Flume 】Windows安装步骤、配置环境

🛠 Flume 是什么?

Apache Flume 是一个高效、可靠、可扩展的数据收集系统,通常用于收集日志、流数据,比如收集数据到 HDFS、Kafka 等。

虽然 Flume 本身是为 Linux 服务器设计的,但 在 Windows 本地也是能跑起来的(需要一点小技巧)。


📥 1. 下载 Flume 安装包

官网地址

👉 https://flume.apache.org/download.html

但是官网只提供源代码,需要自己编译(超麻烦)。

所以通常推荐直接下载已经编译好的二进制版本:

推荐直接下稳定版 1.9.0 二进制包

✅ 下载链接(已经编译好的):

https://archive.apache.org/dist/flume/1.9.0/apache-flume-1.9.0-bin.tar.gz


📦 2. 解压 Flume 包

比如你放到:

复制代码
D:\flume\apache-flume-1.9.0-bin

🛠 3. 配置环境变量(很重要)

  1. 新增环境变量 FLUME_HOME

    复制代码
    D:\flume\apache-flume-1.9.0-bin
  2. 在系统 Path 中添加:

    复制代码
    %FLUME_HOME%\bin

✅ 配置好后,在 cmd 命令行执行:

bash 复制代码
flume-ng version

如果正常输出版本号,比如:

复制代码
Flume 1.9.0

就说明安装成功!


⚙ 4. Flume 运行还需要 Java 和 Hadoop(可选)

  • Flume 依赖 Java 8(必须有 JAVA_HOME)
  • 有些 sink(比如写入 HDFS)需要 Hadoop,但一般收集到 Kafka、文件就不用。

确保:

bash 复制代码
java -version

能跑通!


🚀 5. Windows 下启动 Flume 示例

比如启动一个最简单的 Flume agent:

bash 复制代码
flume-ng agent --conf conf --conf-file conf/flume-conf.properties.template --name a1 -Dflume.root.logger=INFO,console

conf/flume-conf.properties.template 是默认的配置模板文件,你可以自己复制一份修改!


📢 注意事项

项目 注意事项
Windows路径 注意 Flume 配置文件中,路径分隔符要用 \\
Hadoop 如果用 HDFS Sink,需要 Hadoop client,但 Kafka Sink不用
服务端口 Windows有时会占用端口,记得检查

✨ 总结一波

步骤 内容
1 下载 Flume 二进制包
2 解压并配置环境变量
3 验证 flume-ng 命令
4 启动 Flume agent 测试

相关推荐
易营宝6 小时前
多语言网站建设避坑指南:既要“数据同步”,又能“按市场个性化”,别踩这 5 个坑
大数据·人工智能
fanstuck7 小时前
从0到提交,如何用 ChatGPT 全流程参与建模比赛的
大数据·数学建模·语言模型·chatgpt·数据挖掘
春日见7 小时前
vscode代码无法跳转
大数据·人工智能·深度学习·elasticsearch·搜索引擎
萤丰信息8 小时前
AI 筑基・生态共荣:智慧园区的价值重构与未来新途
大数据·运维·人工智能·科技·智慧城市·智慧园区
小天源9 小时前
Error 1053 Error 1067 服务“启动后立即停止” Java / Python 程序无法后台运行 windows nssm注册器下载与报错处理
开发语言·windows·python·nssm·error 1053·error 1067
十五年专注C++开发10 小时前
MinHook:Windows 平台下轻量级、高性能的钩子库
c++·windows·钩子技术·minhook
冰糖猕猴桃10 小时前
【AI】把“大杂烩抽取”拆成多步推理:一个从单提示到多阶段管线的实践案例
大数据·人工智能·ai·提示词·多步推理
才盛智能科技11 小时前
K链通×才盛云:自助KTV品牌从0到1孵化超简单
大数据·人工智能·物联网·自助ktv系统·才盛云
广州赛远11 小时前
IRB2600-201.65特殊机器人防护服清洗工具详解与避坑指南
大数据·人工智能
川西胖墩墩12 小时前
垂直模型价值:专业领域超越通用模型的竞争
大数据·人工智能