温馨提示:
全部机会 / 智家定制生态圈 / 人工智能中试基地中心 / 中试基地技术小微 / 数据集开发工程师
机会编号:JD10228081
数据集开发工程师 薪资面议
青岛市 · 本科及以上 · 5年以上
2026-07-07
张女士 | zhanglidan@haier.com
收藏 我要推荐
职责描述
1.全面负责数据集的全生命周期管理(规划、采集、清洗、标注、应用、维护、退役),为AI应用及各领域业务应用提供高质量数据集支持。
2.负责数据集的存储管理、发布共享、质量评估、安全合规等方面建设。主导非结构化元数据信息的设计,实现数据集的可查、可用、可管、合规。
3.负责数据标注体系规划及落地,与需求方深度协作完成数据的标注工作。
4.负责使用平台算子能力熟练使用相关技术栈(Python、Spark、Ray、DataJuicer)完成数据清洗加工任务。
2.负责数据集的存储管理、发布共享、质量评估、安全合规等方面建设。主导非结构化元数据信息的设计,实现数据集的可查、可用、可管、合规。
3.负责数据标注体系规划及落地,与需求方深度协作完成数据的标注工作。
4.负责使用平台算子能力熟练使用相关技术栈(Python、Spark、Ray、DataJuicer)完成数据清洗加工任务。
任职要求
1.本科及以上学历,计算机、大数据、软件工程、人工智能等相关专业,3年以上数据集管理、数据处理或AI数据开发相关经验。
2.熟练掌握数据采集、清洗、标注、加工相关技术栈,精通Python、SQL,掌握Spark、Ray、DataJuicer等分布式计算与数据加工框架,熟练使用pandas、numpy等数据处理模块,具备大规模数据清洗加工的实战能力。
3.熟悉数据集全生命周期管理流程,掌握数据存储管理、发布共享、质量评估、安全合规等体系建设方法,具备非结构化数据元数据设计与治理能力。
4.熟悉数据标注体系规划与落地流程,能与业务需求方深度协作,推动标注标准制定、质量把控及交付闭环。
5.具备具备强烈的责任意识、良好的沟通协调能力与项目推进能力,能高效对接AI算法团队及各业务领域需求方,确保数据集从规划到应用的全链路交付质量。
2.熟练掌握数据采集、清洗、标注、加工相关技术栈,精通Python、SQL,掌握Spark、Ray、DataJuicer等分布式计算与数据加工框架,熟练使用pandas、numpy等数据处理模块,具备大规模数据清洗加工的实战能力。
3.熟悉数据集全生命周期管理流程,掌握数据存储管理、发布共享、质量评估、安全合规等体系建设方法,具备非结构化数据元数据设计与治理能力。
4.熟悉数据标注体系规划与落地流程,能与业务需求方深度协作,推动标注标准制定、质量把控及交付闭环。
5.具备具备强烈的责任意识、良好的沟通协调能力与项目推进能力,能高效对接AI算法团队及各业务领域需求方,确保数据集从规划到应用的全链路交付质量。
工作地点
青岛市 海尔科创园