温馨提示:
全部机会 / 智家定制生态圈 / 人工智能中试基地中心 / 中试基地解决方案小微 / 边缘AI部署专家
机会编号:JD10231585
边缘AI部署专家 薪资面议
青岛市 · 本科及以上 · 5年以上
2026-09-28
张女士 | zhanglidan@haier.com
收藏 我要推荐
职责描述
1. 针对不同边缘硬件平台(如NVIDIA Jetson、华为Atlas、算能、瑞芯微等)与业务场景,设计端到端的AI模型部署方案,包含模型转换、推理管线搭建与系统裁剪。
2. 运用量化、剪枝、蒸馏、算子融合等模型压缩技术,在精度损失可控的前提下大幅降低模型体积与计算开销,适配边缘设备的算力与内存约束。
3. 基于TensorRT、ONNX Runtime、MNN/NCNN等推理引擎进行深度调优,通过流水线并行、内存复用、混合精度推理等手段,降低推理时延、提升吞吐。
4. 解决因硬件异构、指令集差异、OS版本碎片化导致的兼容性问题,建立边缘设备I/O接口、传感器驱动与AI推理程序的稳定适配方案。
2. 运用量化、剪枝、蒸馏、算子融合等模型压缩技术,在精度损失可控的前提下大幅降低模型体积与计算开销,适配边缘设备的算力与内存约束。
3. 基于TensorRT、ONNX Runtime、MNN/NCNN等推理引擎进行深度调优,通过流水线并行、内存复用、混合精度推理等手段,降低推理时延、提升吞吐。
4. 解决因硬件异构、指令集差异、OS版本碎片化导致的兼容性问题,建立边缘设备I/O接口、传感器驱动与AI推理程序的稳定适配方案。
任职要求
1.本科及以上学历,计算机、人工智能、自动化、电子信息、软件工程等相关专业。
2.模型优化与推理: 精通模型压缩技术(量化、剪枝、蒸馏)及边缘推理引擎(如TensorRT, ONNX Runtime, mnn/ncnn),能够将大模型或CV模型高效部署在Jetson、Atlas 200、算能等边缘盒子或端侧芯片上。
3.熟悉模型量化方法,如FP16、INT8、PTQ、QAT等,了解量量化带来的精度损失与校准方法。
4. 熟悉C++或Python,具备较强的工程实现和问题定位能力。
5. 熟练使用Vibe Coding/Al编程辅助工具,能够借助Cursor、GitHubCopilot、Claude Code、ChatGPT/Codex
2.模型优化与推理: 精通模型压缩技术(量化、剪枝、蒸馏)及边缘推理引擎(如TensorRT, ONNX Runtime, mnn/ncnn),能够将大模型或CV模型高效部署在Jetson、Atlas 200、算能等边缘盒子或端侧芯片上。
3.熟悉模型量化方法,如FP16、INT8、PTQ、QAT等,了解量量化带来的精度损失与校准方法。
4. 熟悉C++或Python,具备较强的工程实现和问题定位能力。
5. 熟练使用Vibe Coding/Al编程辅助工具,能够借助Cursor、GitHubCopilot、Claude Code、ChatGPT/Codex
工作地点
青岛市 海尔生态园