AI模型部署与性能优化工程师 深圳 社招 全职 数字技术 - 芯片研发 本科及以上 3-5 年 职位描述 1. 负责将客户常见辅助驾驶算法模型(CNN,Transformer,LLM,多模态等)部署到公司大算力芯片平台,解决过程中可能涉及的算子不支持、模型规格不匹配的兼容性问题。2. 运用性能分析工具对模型进行全栈性能剖析,识别计算、内存、调度瓶颈,通过图融合、算子替换、内存优化以及其他软硬件优化技术,提升推理速度和吞吐量。3. 配合客户实施PTQ/QAT量化方案,定位并解决量化或其他过程引入的精度损失问题。4. 系统性地诊断并解决单模型部署和多模型并发场景下的稳定性问题。深入定位Core Dump / Crash的根本原因(内存越界、资源竞争等)并推动解决。5. 深入理解客户需求,提供部署、性能调优方案和建议。建设并维护车载/机器人场景 Model Zoo,输出最佳实践案例文档,降低客户使用门槛。 职位要求 1. 硕士以上学历,具备2年以上AI模型在端/边/云平台部署优化经验。有车载或机器人芯片平台项目经验者优先。2. 精通Python和C++编程,熟悉PyTorch、TensorFlow、ONNX等深度学习框架中的一种或多种。3. 熟悉TensorRT、TVM、ONNX Runtime、vLLM、llama.cpp等主流推理引擎中的一种或多种。4. 熟悉常见网络模型结构和算子,具备模型部署、算子开发和调优经验。掌握系统级别和算子级别 Debug & Profiling 实战技能,熟悉Nsight Systems、perf、Vtune等性能分析工具。5. 熟悉GPGPU或NPU等AI加速芯片硬件特性、了解AI软件栈,有软硬协同经验者优先。6. 积极主动,勇于承担, 具备良好的团队合作精神、沟通协调能力和技术推动力。
端侧Agent模型算法工程师-灵犀业务部 深圳 校招 正式 技术族 - 算法类 职位 ID:A163143 职位描述 灵犀是智元半尺寸人形机器人的核心产品线,也是智元最年轻、最具创新活力的团队之一。我们打造了智元首个爆款产品灵犀X2,累计销量超6000台。这里技术大牛汇聚、工程师文化浓厚,你将深度参与从技术创新、产品定义到规模化落地的全过程,与顶尖团队共同定义下一代人形智能交互服务终端。1. 数据 pipeline 工程:负责端侧 LLM、BERT 等模型的数据采集、清洗、标注、构建,搭建可复用的训练数据流水线(数据 → 训练 → 评估的完整闭环)。2. 模型训练与优化:训练 / 微调端侧模型,包括 LLM 蒸馏(大模型能力迁移到端侧小模型)、BERT 意图识别 / 槽位填充等 NLU 模型。3. 模型压缩与量化:通过蒸馏、剪枝、量化(INT8 / INT4 等)压缩模型,在精度与端侧算力 / 内存约束之间做权衡调优。4.