职位描述
【岗位职责】
1、在导师带教下参与公司数据仓库建设:参与元器件价格、库存、供应商、用户行为等海量行业数据的ETL管道开发与维护;
2、参与数据采集与清洗:对接业务系统与外部数据源,编写稳定可靠的数据处理任务;
3、参与数据质量监控与任务调度维护,学习生产环境数据工程的成熟实践;
4、参与数据模型设计:学习维度建模方法,协助数仓分层的落地实施。
【岗位要求】
1、本科及以上学历,计算机科学与技术、人工智能等相关专业;
2、掌握SQL与至少一门开发语言(Python优先,Java亦可),课程项目或实习中有实际编码经验;
3、掌握数据结构、数据库原理、操作系统等计算机基础课程知识;
4、了解Linux基本操作与Shell脚本;
5、做事严谨细致,重视代码质量与数据准确性;
6、对海量数据处理有兴趣,愿意持续学习大数据技术栈。
加分项:
1、有大数据相关实习经历,或课程项目/毕业设计涉及数据处理管道搭建;
2、了解Hadoop / Spark / Flink生态,或有Hive SQL使用经验;
3、了解Airflow / DolphinScheduler等调度工具;
4、有个人技术博客、GitHub项目或开源贡献经历。