20000-50000 元
岗位职责 1.参与大数据平台核心模块开发,包括数据采集链路搭建(基于 Kafka、Flume 等组件)、ETL 流程设计与实现,保障数据从业务系统到数据仓库的高效流转。 2.负责数据仓库建模与迭代,基于 Kimball 或 Inmon 模型设计事实表与维度表,支撑离线分析与实时决策需求,确保数据资产的一致性与可用性。 3.基于 Spark、Flink 等分布式计算框架开发数据处理任务,实现海量数据的离线批处理与实时流计算,优化任务执行效率与资源占用。 4.参与数据服务平台构建,设计面向业务的数据分析接口与指标计算逻辑,赋能产品迭代、运营决策与商业化分析场景。 5.监控数据质量与系统性能,使用 Prometheus、Grafana 等工具搭建监控体系,解决数据延迟、计算瓶颈等生产问题。 6.编写技术设计文档、数据字典及操作手册,参与跨团队技术方案评审,推动大数据技术规范落地。 三、任职要求 1.学历与毕业时间:2026 届本科及以上学历毕业生,计算机、软件工程、数据科学、数学等相关专业优先。 2.技术基础:具备扎实的计算机基础,掌握数据结构、算法复杂度评估、操作系统进程调度、分布式系统 CAP 原理等核心知识。 3.编程与数据能力:熟练掌握至少一种主流编程语言(Java/Scala/Python 优先),具备规范的编码习惯;精通 SQL 语法,能编写复杂查询与优化语句,熟悉 MySQL 等关系型数据库原理。 4.大数据技术栈:了解 Hadoop 生态体系(HDFS、YARN),熟悉 Spark、Flink、Hive 等至少两种大数据组件的使用场景与基本原理,有实际项目应用经验者优先。 5.项目经验:在校期间参与过大数据相关课题研究、开源项目贡献,或有数据仓库建设、实时计算项目实习经历者优先;能清晰阐述项目架构设计与技术选型思路者加分。 6.综合素养:具备强烈的技术热情与自我驱动力,能快速学习新技术;拥有优秀的逻辑思维与问题解决能力,面对复杂数据场景能提出合理解决方案;具备良好的跨团队沟通与协作精神
已认证
安全提示