招聘大数据运维工程师(郑州)

负责公司大数据平台ambari(Hadoop/Spark/Flink/Kafka/HBase/Hive) 的部署、日常运维、监控与高可用保障。

负责集群扩容、容量规划、性能调优、故障排查,保障生产 7×24 稳定运行。

负责监控体系建设(Prometheus/Grafana/Zabbix/ELK),完善告警、巡检、日志分析机制。

负责自动化运维建设:Shell/Python 脚本、Ansible 批量管理、部署与备份自动化。

负责数据平台权限管理、安全策略、备份恢复、灾备演练,保障数据安全。

对接业务部门,处理作业异常、资源申请、性能问题,输出运维报告与优化方案。

参与大数据架构升级、组件版本迭代、容器化(Docker/K8s)改造等项目。

二、任职要求

  1. 基本条件

大专及以上学历,计算机、软件工程、网络、自动化、电子信息等相关专业。

1 年以上大数据运维经验;有工厂 / 制造业 / 电子行业大数据平台运维经验优先。

能接受轮班 / 应急 oncall,抗压性强,责任心强,沟通协作良好。

  1. 技术能力(必须具备)

Linux :CentOS/Rocky,系统调优、磁盘 LVM、网络、内核参数、防火墙、进程 / 内存 / CPU 排障。

大数据生态熟练:

存储:HDFS 高可用、扩容、小文件优化、权限。

调度:YARN 队列、资源隔离、调度调优。

计算:Spark、Flink 集群部署、参数调优、任务排障。

消息:Kafka、Flume 高可用、积压、分区、副本。

数仓:Hive、HBase 备份、容灾、热点优化。

脚本能力:熟练Shell;会Python做自动化工具优先。

监控与排障:熟悉Zabbix/Prometheus/Grafana/ELK,能独立定位集群异常、GC、节点宕机、数据倾斜等问题。

网络 / 存储 / 安全:熟悉 TCP/IP、路由、交换机;熟悉RAID、SAN/NAS;了解数据安全、权限审计。

有HBASE集群实际运维者优先。

  1. 加分项(有一项即可优先)

有富士康 / 电子制造 / 工厂 MES、数据中台运维经验。

熟悉Docker/K8s容器化部署与运维。

熟悉Hadoop 国产替代(CDH/CDP/ HDP华为 MRS)。

有 ** 大规模集群(200 + 节点)** 运维、调优、灾备经验。

有意者留言

相关推荐
IT小白杨11 小时前
短视频多账号运营环境管理指南:指纹浏览器与云手机技术解析
大数据·经验分享·web安全·智能手机·音视频·指纹浏览器
anxiao_m11 小时前
数字孪生私有化部署怎么选?主流平台横向深度测评
大数据·3dcoat
明志数科12 小时前
宇树科技IPO背后的产业逻辑:人形机器人从“讲故事“到“交数据“
运维·服务器·数据库
外滩运维专家12 小时前
验证码接口上线三天就被刷了,我后来加的几道防线
运维
Data_Journal12 小时前
什么是 CAPTCHA,它是如何工作的?
java·大数据·服务器·前端·数据库
跨境小彭12 小时前
店群运营实操复盘:批量活动申报自动化优化方案
大数据·运维·人工智能·自动化·跨境电商·temu·temu电商运营
Eric.4612 小时前
Stable Diffusion+ComfyUI+OpenClaw AI漫剧量产提示词工程:结构化Prompt、负面词脱敏、权重锁定防画面崩坏全方案
大数据·人工智能·stable diffusion·prompt·comfyui·ai漫剧
Jlzn888812 小时前
2026年锂电CCS组装线:车规储能双场景兼容自动化方案的技术架构与实践
运维·架构·自动化
AC赳赳老秦13 小时前
语义采集进阶实战:利用 OpenClaw AI 语义识别自动提取网页核心信息,无需手动编写选择器
java·运维·服务器·python·信息可视化·deepseek·openclaw
长谷深风11113 小时前
ReAct框架:让AI像人类一样思考与行动
大数据·人工智能·热门·ai agent·agent工作流·智能体设计·ai产品设计