Refine Reset All
Sort by
Company
Employer/Recruiter
Date Posted
Company
Job Title
Skills
Location
Job Type
Employer/Recruiter
All Filters

Cuda Jobs In Beijing (Peking) - 55 Job Positions Available

Top Cities:
1 – 20 of 55 jobs
北京智谱华章科技有限公司 jobs

26届校招-推理Infra工程师 北京 正式 互联网 / 电子 / 网游 职位描述 1. 参与大模型推理框架的设计与开发​:协助团队进行支撑大语言模型、图像生成等复杂模型推理的高性能框架研发,推动算法到产品落地的全链路优化,确保推理的高效性、稳定性和低延迟。2. 性能优化与调优​:在资深工程师指导下,参与优化内存管理、计算资源分配与调度策略,提升模型推理速度和资源利用率。学习并使用性能分析工具(如Nvidia Nsight)进行瓶颈定位和优化。3. 模型推理加速技术探索​:学习并应用业界前沿的推理优化技术,KV Cache优化、模型量化(Quantization)、剪枝(Pruning),跨机分布式推理优化等。 职位要求 1. 基础技能​: - 熟练掌握 C++ 和 Python 编程语言,具备扎实的数据结构、算法和操作系统基础。 - 熟悉至少一种主流的深度学习框架(如 PyTorch、TensorFlow),了解其基本实现原理。 - 了解GPU编程​(如 CUDA)或并行计算,有相关的课程项目或实验经验。2. 专业知识​: - 对 Transformer 架构及主流大模型(如GPT、Llama、Qwen等)的推理特性有基本理解。 - 了解大模型推理的基本流程和常见挑战(如延迟、吞吐、内存占用)。3.

Premium Full-time C++ Python
北京智谱华章科技有限公司  27 days ago
北京智谱华章科技有限公司 jobs

26届校招-训练Infra工程师 北京 正式 互联网 / 电子 / 网游 职位描述 1. 参与训练框架研发与优化​:协助团队进行大规模分布式训练框架的设计、实现与维护,支持复杂AI模型(如大语言模型、多模态模型)的高效训练。2. 性能调优与效率提升​:在导师指导下,优化训练过程中的内存管理、计算资源调度和分布式通信效率,提升训练速度和资源利用率。3. 集成与适配先进技术​:学习并应用业界前沿的训练加速技术(offload、动态分布式并行/流水线排布),确保框架的先进性和竞争力。4. 支持算法研发与交付​:与算法工程师紧密配合,提高训练效率,降低研发成本,提升交付能力。 职位要求 1. 基础技能​: - 熟练掌握 Python 和 C++ 编程语言,具备扎实的数据结构、算法和操作系统基础。 - 熟悉至少一种主流深度学习框架(如 PyTorch、TensorFlow),了解其基本实现原理和机制。 - 了解GPU编程​(如 CUDA)或并行计算,有相关的课程项目或实验经验。2. 专业知识​: - 对 Transformer 架构及主流大模型(如GPT、Llama等)的训练特性有基本理解。 - 了解分布式训练的基本原理(如数据并行、模型并行、流水并行)和常见挑战。3. 加分之项(满足以下任一即可)​​:

北京智谱华章科技有限公司  27 days ago
XPENG jobs

【27届校招】大模型训练推理框架工程师 深圳、北京 正式 研发 - 算法 智能机器人板块 职位描述 负责大模型训练、推理和评测的基础设施研发,为算法团队提供高效稳定的工程底座。1、训练系统:设计和优化大规模分布式训练架构(Pretrain/SFT/RL),解决千卡级训练的通信、调度、容错问题;2、推理部署:基于 vLLM 等框架优化大模型推理性能,支撑 VLT/Omni 等模型在 XP5 端侧和云端的部署;3、评测平台:开发 DeepInsight 评测系统,支持 LLM/VLM/WBC/VLA 多类模型的自动化评测、报告生成和 CI/CD 集成;4、MLOps 工具链:构建模型版本管理、实验追踪、数据管理、资源调度等基础设施,提升研发效率;5、RL 训练环境:构建分布式强化学习训练系统,支持 Agent-环境大规模并行交互。 职位要求 1、硕士及以上学历,计算机、软件工程等相关专业;2、 精通 Python,熟练掌握 C++/Go 至少一门;3、在以下至少一个方向有丰富以上经验:- 分布式训练系统(Megatron-LM/DeepSpeed/FSDP);- GPU 编程与高性能计算(CUDA/NCCL/RDMA);- ML 平台开发(Kubernetes/Ray/Airflow);- 模型推理优化(TensorRT/vLLM/量化部署);4、理解大模型训练和 RL

Premium Full-time Ml
XPENG  26 days ago
ShengShu jobs

大模型AI Infra工程师(PRC) 北京 全职 互联网 / 电子 / 网游 职位描述 1、核心算子开发与极致优化:基于华为昇腾(Ascend 910B等)、平头哥等国产AI加速芯片,进行深度学习核心计算算子(如Attention、Linear、LayerNorm、MoE等)的高性能定制开发与迭代优化;2、AI框架与系统适配:负责将主流开源AI框架(如PyTorch、MindSpore)及大模型训练/推理工具链(如Megatron-LM、DeepSpeed、vLLM等)深度适配到国产算力平台上,确保功能正确性与系统稳定性;3、端到端性能调优:使用底层性能分析工具(如Ascend Profiler等)进行算子级与模型级的性能瓶颈分析。针对计算、访存、通信瓶颈制定调优策略(如算子融合、混合精度、计算与通信重叠设计);4、编译优化与前瞻探索:参与探索TVM、MLIR、Triton等AI编译器技术在国产异构后端的应用,提升算子自动生成效率与多硬件平台的泛化适配能力。 职位要求 1、基础条件:计算机科学、软件工程、电子工程、数学或相关专业,本科及以上学历,具备扎实的计算机体系结构基础,深入理解GPU/NPU微架构、并行计算原理及内存一致性模型;2、专业技能:编程能力:精通C/C++与Python,具备出色的工程实现与架构设计能力;异构开发经验:熟练掌握至少一种主流并行编程语言(CUDA / HIP / OpenCL / Ascend C),有丰富的底层算子开发、调试和调优经验;AI框架机制:深入理解至少一种深度学习框架(PyTorch/TensorFlow/MindSpore)的底层运行机制(如计算图、算子分发机制、显存池管理等);3、【加分项】(满足其一即可优先考虑):具备华为昇腾CANN开发体系经验,熟练掌握Cube/Vector Core编程模型者优先;有千亿级参数大模型(如LLaMA、Qwen、GLM)在国产算力集群上的训练、微调或推理落地经验者优先;在开源社区(如MindSpore、vLLM、FlashAttention、Cutlass等)有核心代码贡献者优先。 投递...

ShengShu  20 days ago
GE HealthCare jobs

Job Description SummaryWe are seeking an experienced CT Reconstruction Software Architect to lead the architecture and development of next-generation CT reconstruction platforms. The successful candidate will be responsible for defining software architecture, driving image reconstruction innovations,

GE HealthCare  15 days ago
千寻智能(杭州)科技有限公司 jobs

【校招实习】AI Infra工程师 北京 实习 互联网 / 电子 / 网游 - 研发 千寻智能2027届校招实习招聘项目 职位描述 1、负责具身智能大模型千卡大规模训练系统性能优化及MFU优化。2、负责多模态大模型(VLM)在云端的高性能分布式推理系统设计、开发与全链路端到端部署。3、负责具身智能VLA模型在端侧的推理系统的研发和模型加速算法研究。 职位要求 1、熟悉GPU体系结构,熟练掌握CUDA/triton,熟练掌握C++或Python语言。2、深入了解PyTorch等深度学习框架的架构和运行原理,深入理解大模型训练多维并行架构,如Tensor并行、流水线并行、序列并行等。3、深入理解多模态模型结构,如ViT、DiT等,了解开源多模态大模型结构,如qwen-vl、llama等。4、熟悉至少一种主流开源推理引擎(如 vLLM、SGLang、TensorRT-LLM、Nvidia Dynamo等)的底层机制与源码魔改。5、熟悉量化、剪枝、蒸馏、投机推理、步数蒸馏等前沿推理加速及模型小型化技术方案。 投递...

Premium Full-time
千寻智能(杭州)科技有限公司  15 days ago
Automatically Get Matched to cuda Jobs Let our AI agent search and match you to the best jobs from across the web
Try it now
Pony.ai jobs

软件实习生 - 端到端模型性能优化 北京 实习 职位描述 1. 负责AI端到端模型的性能分析与优化;2. 负责CUDA算子开发与维护。 职位要求 1. 计算机或相关专业本科及以上学历;2. 扎实的软件工程能力,熟练掌握计算机基础知识;3. 有CUDA编程经验,熟悉TensorRT或其它AI加速库;4. 熟悉至少一种深度学习框架(Pytorch优先)。加分项:1. 熟练掌握CUDA编程,有CUDA优化经验;2. 有算法竞赛经历;3. 有基于TensorRT的模型优化经验;4. 有模型量化、蒸馏、剪枝等工程经验。 投递...

Premium Full-time
Pony.ai  15 days ago
Pony.ai jobs

算法实习生-多模态感知大模型 北京 实习 职位描述 1. 负责基于 Camera、LiDAR 及多模态融合的感知算法开发与优化,工作方向包括但不限于动态目标检测与追踪、3D occ、在线地图感知等。2. 负责研发面向高精度静态环境感知的端到端深度学习模型,重点覆盖交通信号灯(红绿灯)、交通标识、车道线、路缘、静态障碍物等关键元素的检测与识别。3. 设计端到端模型架构(如BEV感知、Transformer-based模型),实现从原始数据到结构化静态场景输出的高效映射4. 负责算法在自动驾驶实际产品中的落地和优化提升,解决实际问题。 职位要求 1. 计算机或相关专业本科以上学历;2. 熟练掌握深度学习及计算机视觉相关的基本算法;3. 熟悉基于CNN的图像检测、跟踪、识别等算法流程;4. 优秀的编程能力,熟悉C/C++或Python;5. 有较强的独立解决问题能力,学习能力及沟通能力;若能满足如下条件的其中一个,会适当加分:1. 有较强的研究能力优先,如发表过第一作者CCF A类会议或期刊等论文;2. 熟悉某种深度学习框架,如Pytorch等,对深度学习有深入的了解;3. 熟悉并行计算或cuda编程,或图像处理方面经验的优先;4. 在自动驾驶行业有实习经验;5. 能实习6个月及以上。 投递...

Premium Full-time
Pony.ai  15 days ago
千寻智能(杭州)科技有限公司 jobs

AI Infra实习生(日常实习) 北京 实习 研发 - 基础架构 千寻智能2025年秋季校园招聘项目 职位描述 1、负责构建支撑具身智能体的核心机器学习系统,开发面向机器人场景的VLA大模型训练与推理系统,支撑多模态感知、运动控制、任务规划等核心能力的持续进化;2、研发新一代具身智能系统工具链,涵盖数据采集、仿真训练、物理部署、持续优化全生命周期。 职位要求 1、计算机、人工智能、软件工程等相关专业,硕士及以上学历,2026年及之后毕业; 2、熟练使用C++/Python/Pytorch/CUDA开发生态,具有嵌入式系统开发经验者优先;3、能至少保障3个月以上的实习时间,每周4天以上出勤;4、加分项:在以下一个或多个领域有深度实践: a. 大模型训练推理:多模态大模型分布式训练、端上推理加速、Transformer模型优化; b. 高性能计算:GPU Kernel编写,高性能通信(NCCL、RDMA),AI编译器(TVM、Triton),模型量化等; c. 机器人系统:ROS2、运动控制算法、传感器数据处理pipeline。 投递...

Premium Full-time AI
千寻智能(杭州)科技有限公司  15 days ago
北京科学智能研究院 AI for Science Institute, Beijing jobs

机器学习势函数工程研发实习生 北京 实习 本科及以上 职位描述 1. 计算机、软件工程、人工智能、计算科学或相关专业本科及以上学历;2. 熟练使用 Python,具备 C/C++ 基础,能够阅读和调试工程代码;3. 熟悉 PyTorch及常见模型训练、测试和性能评测流程;4. 熟悉 Linux、Git及常用开发工具,能够根据日志定位和解决实验问题;5. 具备良好的代码规范、测试意识和实验复现意识;6. 了解 CUDA、Triton、GPU性能分析或分布式训练者优先;7. 有 DeePMD-kit、分子动力学、机器学习势函数或科学计算经验者优先;8. 大四即以上211,985在读优先;9. 善于独立思考,灵活使用各类AI工具。 职位要求 1. 根据既定方案配置、提交和监控机器学习势函数训练及测试任务;2. 整理实验数据与结果,完成精度、速度和资源消耗等指标的对比分析;3. 参与 DeePMD-kit 的功能开发、问题排查、单元测试和文档维护;4. 协助开展关键计算流程和算子的性能分析与优化;5. 完善实验脚本及自动化工具,保障实验流程稳定、可复现。 职位信息 部门: OpenLAM 投递...

Premium Full-time
北京科学智能研究院 AI For Science Institute, Beijing  15 days ago
Nvidia jobs

NVIDIA has been transforming computer graphics, PC gaming, and accelerated computing for more than 25 years. It’s a unique legacy of innovation that’s fueled by great technology—and amazing people. Today, we’re tapping into the unlimited potential

Nvidia  14 days ago
Nvidia jobs

At NVIDIA, we’re solving the world’s most ambitious problems with our groundbreaking developments in Artificial Intelligence, High-Performance Computing and Visualization. We are looking for a Developer Relations Manager to work with China industrial/research community to integrate

Nvidia  14 days ago
Nvidia jobs

NVIDIA has been transforming computer graphics, PC gaming, and accelerated computing for more than 25 years. It’s a unique legacy of innovation that’s fueled by great technology—and amazing people. Today, we’re tapping into the unlimited potential

Nvidia  14 days ago
Nvidia jobs

At NVIDIA, we’re solving the world’s most ambitious problems with our groundbreaking developments in Artificial Intelligence, High-Performance Computing and Visualization. We are looking for a Developer Relations Manager to work with China industrial/research community to integrate

Nvidia  14 days ago
Nvidia jobs

NVIDIA is the world leader in computer graphics, artificial intelligence, and accelerated computing. For over 30 years, we have been at the forefront of research and engineering around the greatest advances in technology. Our history of

Nvidia  14 days ago
Nvidia jobs

NVIDIA is leading company of AI computing. At NVIDIA, our employees are passionate about AI, HPC , VISUAL, GAMING. Our SA team is more focusing to bring NVIDIA new technology into difference industries. We help to

Nvidia  14 days ago
Nvidia jobs

We are building the next generation of GPU‑accelerated recommendation tools, redefining how models are trained and deployed at scale. Our mission is to make developing and productizing GPU‑based recommender systems as seamless, efficient, and powerful as

Nvidia  14 days ago
Nvidia jobs

We are looking for a System Application Engineer in Beijing, Shanghai, or Shenzhen, China to drive key aspects of GPU and CPU technology for enterprise and data-center platforms, including NVIDIA Enterprise GPU and CPU product lines.

Nvidia  14 days ago
Nvidia jobs

NVIDIA has been redefining computer graphics, PC gaming, and accelerated computing for more than 30 years. It’s a unique legacy of innovation that’s fueled by great technology—and amazing people. Today, we’re tapping into the unlimited potential

Nvidia  14 days ago
Nvidia jobs

NVIDIA has been defining computer graphics, PC gaming, and accelerated computing for more than 25 years. With an outstanding legacy of innovation, driven by phenomenal technology, and extraordinary people, NVIDIA is looking for a strong technical

Nvidia  14 days ago

Subscribe for job alerts and resources to make your job search easier!

Confirmation email sent to

Check your email and click on the link to start receiving your job alerts

Receive the latest job openings for:

cuda jobs in beijing

You also might be interested in:

实习生

开发工程师

AI

Computing

C++

Python

Confirmation email sent to

Check your email and click on the link to start receiving your job alerts

All Filters Apply
Sort by
Company
Employer/Recruiter