岗位描述(节选)
1、负责数据仓库建设、ETL流程开发及数据模型设计;
2、负责离线(Hive/Spark SQL)和实时(Flink/Spark Streaming)数据计算任务的开发与性能调优;
3、参与大数据平台的日常运维、监控及数据质量保障;
4、响应业务部门的数据提取需求,提供高效查询与可视化方案支持。
【任职资格】
1、教育背景: 原则上硕士及以上学历,计算机、数学、统计学、数据科学等相关专业;
2、知识技能: 熟悉Hadoop生态(HDFS、Hive、HBase),了解Spark或Flink计算框架;掌握Java/Scala/Python中至少一门语言,熟悉SQL及关系型数据库;了解Linux环境开发;
3、工作经验: 无强制要求,有大数据相关实习或课程项目经验者优先;
4、能力素质: 对数据敏感,具有较强的逻辑分析和问题排查能力,责任心强,能承受阶段性工作压力。