Refine Reset All
通过
工作类型
雇主/招聘方
发布日期
位置
工作类型
雇主/招聘方
所有筛选

A Cube 招聘 在 Beijing (Peking) - 1 Job Positions Available

主要城市:
1 – 1 的 1 招聘
ShengShu 招聘

大模型AI Infra工程师(PRC) 北京 全职 互联网 / 电子 / 网游 职位描述 1、核心算子开发与极致优化:基于华为昇腾(Ascend 910B等)、平头哥等国产AI加速芯片,进行深度学习核心计算算子(如Attention、Linear、LayerNorm、MoE等)的高性能定制开发与迭代优化;2、AI框架与系统适配:负责将主流开源AI框架(如PyTorch、MindSpore)及大模型训练/推理工具链(如Megatron-LM、DeepSpeed、vLLM等)深度适配到国产算力平台上,确保功能正确性与系统稳定性;3、端到端性能调优:使用底层性能分析工具(如Ascend Profiler等)进行算子级与模型级的性能瓶颈分析。针对计算、访存、通信瓶颈制定调优策略(如算子融合、混合精度、计算与通信重叠设计);4、编译优化与前瞻探索:参与探索TVM、MLIR、Triton等AI编译器技术在国产异构后端的应用,提升算子自动生成效率与多硬件平台的泛化适配能力。 职位要求 1、基础条件:计算机科学、软件工程、电子工程、数学或相关专业,本科及以上学历,具备扎实的计算机体系结构基础,深入理解GPU/NPU微架构、并行计算原理及内存一致性模型;2、专业技能:编程能力:精通C/C++与Python,具备出色的工程实现与架构设计能力;异构开发经验:熟练掌握至少一种主流并行编程语言(CUDA / HIP / OpenCL / Ascend C),有丰富的底层算子开发、调试和调优经验;AI框架机制:深入理解至少一种深度学习框架(PyTorch/TensorFlow/MindSpore)的底层运行机制(如计算图、算子分发机制、显存池管理等);3、【加分项】(满足其一即可优先考虑):具备华为昇腾CANN开发体系经验,熟练掌握Cube/Vector Core编程模型者优先;有千亿级参数大模型(如LLaMA、Qwen、GLM)在国产算力集群上的训练、微调或推理落地经验者优先;在开源社区(如MindSpore、vLLM、FlashAttention、Cutlass等)有核心代码贡献者优先。 投递...

ShengShu  2天前发布

Subscribe for job alerts and resources to make your job search easier!

确认邮件已发送至

请检查邮件并点击链接,开始接收招聘提醒。

接收这类最新招聘:

a cube 招聘 在 beijing

确认邮件已发送至

请检查邮件并点击链接,开始接收招聘提醒。

所有筛选 Apply
通过
工作类型
雇主/招聘方