职位编号 J20260817160513129576
数据开发
50-80万北京市上海市本科0-3年招聘 2 人预计佣金 103.7K1天前刷新/8月17日 16:07发布
职位信息项目手册职位进展做单须知佣金规则发单顾问
寻访须知
必要条件:IC,工作1-2年(不超过2年),年轻高潜、学校背景亮眼 熟练 SQL,会多表关联、窗口函数,能做 SQL 性能调优 会使用 Hive;了解 Hadoop 生态 会 Python / Java 至少一门编程语言 懂 ETL 流程,了解数仓分层 ODS/DWD/DWS,能做数据抽取、加工 能做基础的数据质量校验,识别脏数据、重复数据
优先条件:参与过大模型训练数据集构建、数据抽样 2. 写过标注规范,管理过标注团队 / 标注项目 3. 用过向量数据库 Milvus/Chroma 4. 处理过开源大模型数据集 5. 了解 RLHF、偏好数据处理 6. 计算机、AI、统计相关本科,985/211 优先
目标公司/行业:私募量化,互联网大厂
必问问题:
待发单方补充
JD基本信息
岗位职责
数仓/数据平台/ETL/数据引擎/数据挖掘方向,或愿意转数据的算法;需熟练vibecoding 参与企业数据体系建设,涵盖离线 / 实时数仓搭建、ETL 数据链路开发、数据平台、数据引擎相关开发优化工作; 基于业务需求开展数据建模、数据清洗、指标体系建设、数据质量管控; 开展数据挖掘、特征加工分析,支撑业务分析决策; 持续优化 SQL、任务调度、大数据任务性能,解决海量数据场景下的性能、稳定性问题; 算法背景候选人可转型数据方向,依托算法基础参与数据挖掘、特征体系建设。
任职要求
SQL:写复杂查询、多表关联、窗口函数,调优慢 SQL,这是吃饭本事 大数据组件:Hive、Hadoop、Spark,大部分岗位必看;部分会要 Flink 实时计算 至少一门编程语言:Python 或者 Java 懂数仓分层:ODS/DWD/DWS/ADS,知道数据怎么流转,会做 ETL(抽取‑转换‑加载) 了解数据质量:会做校验,防止脏数据、重复数据
所属行业:互联网、人工智能/大模型/算力、大数据
职能分类:数据开发
工作城市:
北京,招聘1人,详细地址:海淀区清华园上海,招聘1人,详细地址:上海
职位要求
学历要求:本科·985/211
工作年限:0-3年
薪资福利
年薪范围:50-80万 15薪
薪资福利:-
面试信息
面试轮次:3轮
视频面试:可以接受
面试流程:-