AI编译器研发(自动驾驶/机器人) 深圳、上海 全职 芯片板块 职位描述 1、编译器架构设计:设计并实现AI编译器中间表示(IR),支持模型图优化、算子融合、循环优化等;构建从模型解析到硬件指令生成的完整编译流水线,支持PyTorch/Onnx等主流框架。2、硬件后端优化:针对自研芯片,开发高效算子库与代码生成策略:优化内存访问、指令调度,提升端到端推理性能。3、性能调优与验证:通过Profiling工具定位性能瓶颈,优化算子,并设计自动调优流程;与硬件团队合作,验证算子在目标设备上的性能与正确性。4、业务场景落地:结合自动驾驶感知、决策规划,或机器人SLAM、运动控制等场景,优化编译器对实时性、低功耗的需求;参与模型量化与编译器的协同设计。5、技术探索与创新:研究动态形状处理、稀疏计算等前沿编译技术;探索LLVM/GCC等传统编译技术与MLIR的集成方案。 职位要求 1、必备技能:(1)精通C++/Python,具备大型系统开发经验。(2)深入理解MLIR框架,熟悉其Dialect设计、Pass优化机制。(3)有NPU或GPU硬件经验,熟悉CUDA、OpenCL或NPU专用指令集。(4)熟悉至少一种深度学习框架(TensorFlow/PyTorch/Onnx)。2、加分项:(1)有LLVM/GCC后端开发经验,熟悉内联优化、寄存器分配、指令调度、代码生成等。(2)参与过开源AI编译器项目(如TVM、Apache MLIR)。(3)了解自动驾驶感知算法(如BEV感知、多传感器融合)或机器人控制等模型。(4)发表过编译器优化、体系结构相关论文或专利。岗位介绍:我们正在寻找AI编译器研发工程师,专注于AI编译器框架设计与优化。包括模型量化、图优化、codegen、算子优化及软硬件协同优化等。您将参与构建高性能、低延迟的AI编译工具链,支撑自动驾驶、机器人等业务场景。 投递...
2027校招-AI编译器工程师(上海/杭州/成都) 上海、成都、杭州 校招 正式 职位描述 一、岗位定位负责大模型推理 / 训练框架底层编译器的设计、开发与优化,将上层深度学习模型(Transformer / MoE / 多模态等)高效映射到 GPU、NPU、Ascend、CPU 等异构硬件,提升大模型在真实业务中的吞吐、延迟与资源利用率。二、岗位职责参与大模型编译器前后端开发:图级优化(算子融合、常量折叠、Layout 转换)、算子 Lowering、调度与内存规划。负责面向 Transformer / Attention / MoE 等核心算子的底层代码生成与 kernel 性能调优(Tiling、流水线、双缓冲、量化等)。对接主流编译基础设施(MLIR / LLVM / TVM / XLA / PyTorch 2.x Inductor 等),参与自定义 Dialect 与