Were looking for outstanding AI systems software engineers to develop groundbreaking technologies across the inference systems software stack. Our team builds core AI systems software that accelerates high-impact workloads on NVIDIA GPUs, from deep learning primitives
【27届校招】具身智能模型部署工程师 深圳 正式 研发 - 算法 职位描述 负责具身智能模型在机器人端和小鹏自研芯片平台上的适配、优化与部署,参与模型转换、量化、性能评测、精度验证和上线发布全流程。通过工程优化提升模型推理性能、资源利用率和运行稳定性,推动算法能力高效落地到机器人产品。岗位职责1、负责 VLM、VLA、多模态及其他具身智能模型在小鹏自研芯片平台上的转换、适配、量化与部署;2、开展端侧推理性能评测与优化,分析时延、内存、功耗和算力利用率等关键指标;建立模型精度对齐与自动化回归能力,定位模型转换、量化及算子适配过程中的精度问题;3、参与模型部署工具链建设,完善模型转换、性能基准、端侧验证和发布流程;与算法和芯片团队协作,从模型设计阶段参与部署可行性评估,推动模型在机器人端稳定运行。 职位要求 1、计算机、人工智能、电子工程、自动化等相关专业本科及以上学历,面向应届毕业生;2、熟练掌握 C++ 或 Python,具备良好的数据结构、算法和软件工程基础;3、理解深度学习基本原理,熟悉 Transformer、视觉或多模态模型的基本结构与计算特点;4、熟悉 PyTorch 等训练框架,了解模型导出、转换和推理部署的基本流程;5、对模型性能优化有兴趣,能够结合日志、性能数据和实验结果分析定位问题;6、具备良好的学习能力和动手能力,有相关课程设计、实习、科研或个人项目经验。加分项:1、有 LLM、VLM、VLA 或多模态模型部署与优化项目经验;2、熟悉 ONNX、TensorRT、llama.cpp、MLC LLM 或芯片推理 SDK;3、了解 PTQ、QAT、混合精度等量化方法,并有精度对齐实践;4、有 CUDA、NPU、嵌入式 Linux 或开发板模型部署经验;5、在 AI 系统、编译器、并行计算相关竞赛、开源项目或论文中有突出成果。我们期望你具备的特质:1、学习能力:愿意持续学习模型、运行时和芯片平台知识,能够快速进入新的技术领域;2、工程思维:重视数据、实验和代码质量,能够把想法转化为可验证、可复现的工程结果;3、探索精神:对模型如何在真实机器人上高效运行保持好奇,愿意深入定位和解决复杂问题。 投递...
校招-端侧大模型多平台部署优化 南京 校招 正式 数字技术 - 算法 本科及以上 2027届校园招聘-正式批 职位 ID:A118122A 职位描述 1,负责数字座舱性能问题分析,涉及Android全栈以及QNX系统多领域;2,能够针对系统中出现的性能问题给出专业的分析,解决方案并实施落地;3,业界先进的系统架构,性能优化方案,性能测试方案,竞品性能表现调研,给出合理建议。 职位要求 1、本科及以上学历,计算机或AI相关专业,精通C/C++/Java语言,具有大型项目的开发经验2、有LLM大语言模型,多模态大模型部署经验,优化经验,实际部署过大模型3、熟悉大模型部署优化的思路,在模型转换、算子融合、量化、图优化、推理引擎、KV Cache等方向有实践经验4、熟悉常用开源大模型的模型结构、SFT&RL强化训练、部署等,如Qwen系列,deepseek等5、熟悉大模型推理引擎的完整工作流,熟悉至少一种开源推理引擎,如onnx runtime、mnn、mlc-llm、vllm6、熟悉NPU的工作原理,熟悉常用算子和NPU加速的原理7、热爱技术、专研精神、责任心强,具备良好的沟通能力和团队协作精神 投递...