Refine Reset All
Recent Searches clear
Sort by
Company
Job Title
Employer/Recruiter
Date Posted
Company
Job Title
Skills
Location
Job Type
Employer/Recruiter
All Filters

Cuda Jobs In Beijing (Peking) - 42 Job Positions Available

Top Cities:
1 – 20 of 42 jobs
XPENG jobs

【27届校招】大模型训练推理框架工程师 深圳、北京 正式 研发 - 算法 智能机器人板块 职位描述 负责大模型训练、推理和评测的基础设施研发,为算法团队提供高效稳定的工程底座。1、训练系统:设计和优化大规模分布式训练架构(Pretrain/SFT/RL),解决千卡级训练的通信、调度、容错问题;2、推理部署:基于 vLLM 等框架优化大模型推理性能,支撑 VLT/Omni 等模型在 XP5 端侧和云端的部署;3、评测平台:开发 DeepInsight 评测系统,支持 LLM/VLM/WBC/VLA 多类模型的自动化评测、报告生成和 CI/CD 集成;4、MLOps 工具链:构建模型版本管理、实验追踪、数据管理、资源调度等基础设施,提升研发效率;5、RL 训练环境:构建分布式强化学习训练系统,支持 Agent-环境大规模并行交互。 职位要求 1、硕士及以上学历,计算机、软件工程等相关专业;2、 精通 Python,熟练掌握 C++/Go 至少一门;3、在以下至少一个方向有丰富以上经验:- 分布式训练系统(Megatron-LM/DeepSpeed/FSDP);- GPU 编程与高性能计算(CUDA/NCCL/RDMA);- ML 平台开发(Kubernetes/Ray/Airflow);- 模型推理优化(TensorRT/vLLM/量化部署);4、理解大模型训练和 RL

Premium Full-time Ml
XPENG  29 days ago
ShengShu jobs

大模型AI Infra工程师(PRC) 北京 全职 互联网 / 电子 / 网游 职位描述 1、核心算子开发与极致优化:基于华为昇腾(Ascend 910B等)、平头哥等国产AI加速芯片,进行深度学习核心计算算子(如Attention、Linear、LayerNorm、MoE等)的高性能定制开发与迭代优化;2、AI框架与系统适配:负责将主流开源AI框架(如PyTorch、MindSpore)及大模型训练/推理工具链(如Megatron-LM、DeepSpeed、vLLM等)深度适配到国产算力平台上,确保功能正确性与系统稳定性;3、端到端性能调优:使用底层性能分析工具(如Ascend Profiler等)进行算子级与模型级的性能瓶颈分析。针对计算、访存、通信瓶颈制定调优策略(如算子融合、混合精度、计算与通信重叠设计);4、编译优化与前瞻探索:参与探索TVM、MLIR、Triton等AI编译器技术在国产异构后端的应用,提升算子自动生成效率与多硬件平台的泛化适配能力。 职位要求 1、基础条件:计算机科学、软件工程、电子工程、数学或相关专业,本科及以上学历,具备扎实的计算机体系结构基础,深入理解GPU/NPU微架构、并行计算原理及内存一致性模型;2、专业技能:编程能力:精通C/C++与Python,具备出色的工程实现与架构设计能力;异构开发经验:熟练掌握至少一种主流并行编程语言(CUDA / HIP / OpenCL / Ascend C),有丰富的底层算子开发、调试和调优经验;AI框架机制:深入理解至少一种深度学习框架(PyTorch/TensorFlow/MindSpore)的底层运行机制(如计算图、算子分发机制、显存池管理等);3、【加分项】(满足其一即可优先考虑):具备华为昇腾CANN开发体系经验,熟练掌握Cube/Vector Core编程模型者优先;有千亿级参数大模型(如LLaMA、Qwen、GLM)在国产算力集群上的训练、微调或推理落地经验者优先;在开源社区(如MindSpore、vLLM、FlashAttention、Cutlass等)有核心代码贡献者优先。 投递...

ShengShu  22 days ago
GE HealthCare jobs

Job Description SummaryWe are seeking an experienced CT Reconstruction Software Architect to lead the architecture and development of next-generation CT reconstruction platforms. The successful candidate will be responsible for defining software architecture, driving image reconstruction innovations,

GE HealthCare  18 days ago
千寻智能(杭州)科技有限公司 jobs

【校招实习】AI Infra工程师 北京 实习 互联网 / 电子 / 网游 - 研发 千寻智能2027届校招实习招聘项目 职位描述 1、负责具身智能大模型千卡大规模训练系统性能优化及MFU优化。2、负责多模态大模型(VLM)在云端的高性能分布式推理系统设计、开发与全链路端到端部署。3、负责具身智能VLA模型在端侧的推理系统的研发和模型加速算法研究。 职位要求 1、熟悉GPU体系结构,熟练掌握CUDA/triton,熟练掌握C++或Python语言。2、深入了解PyTorch等深度学习框架的架构和运行原理,深入理解大模型训练多维并行架构,如Tensor并行、流水线并行、序列并行等。3、深入理解多模态模型结构,如ViT、DiT等,了解开源多模态大模型结构,如qwen-vl、llama等。4、熟悉至少一种主流开源推理引擎(如 vLLM、SGLang、TensorRT-LLM、Nvidia Dynamo等)的底层机制与源码魔改。5、熟悉量化、剪枝、蒸馏、投机推理、步数蒸馏等前沿推理加速及模型小型化技术方案。 投递...

Premium Full-time
千寻智能(杭州)科技有限公司  18 days ago
Pony.ai jobs

软件实习生 - 端到端模型性能优化 北京 实习 职位描述 1. 负责AI端到端模型的性能分析与优化;2. 负责CUDA算子开发与维护。 职位要求 1. 计算机或相关专业本科及以上学历;2. 扎实的软件工程能力,熟练掌握计算机基础知识;3. 有CUDA编程经验,熟悉TensorRT或其它AI加速库;4. 熟悉至少一种深度学习框架(Pytorch优先)。加分项:1. 熟练掌握CUDA编程,有CUDA优化经验;2. 有算法竞赛经历;3. 有基于TensorRT的模型优化经验;4. 有模型量化、蒸馏、剪枝等工程经验。 投递...

Premium Full-time
Pony.ai  18 days ago
Pony.ai jobs

算法实习生-多模态感知大模型 北京 实习 职位描述 1. 负责基于 Camera、LiDAR 及多模态融合的感知算法开发与优化,工作方向包括但不限于动态目标检测与追踪、3D occ、在线地图感知等。2. 负责研发面向高精度静态环境感知的端到端深度学习模型,重点覆盖交通信号灯(红绿灯)、交通标识、车道线、路缘、静态障碍物等关键元素的检测与识别。3. 设计端到端模型架构(如BEV感知、Transformer-based模型),实现从原始数据到结构化静态场景输出的高效映射4. 负责算法在自动驾驶实际产品中的落地和优化提升,解决实际问题。 职位要求 1. 计算机或相关专业本科以上学历;2. 熟练掌握深度学习及计算机视觉相关的基本算法;3. 熟悉基于CNN的图像检测、跟踪、识别等算法流程;4. 优秀的编程能力,熟悉C/C++或Python;5. 有较强的独立解决问题能力,学习能力及沟通能力;若能满足如下条件的其中一个,会适当加分:1. 有较强的研究能力优先,如发表过第一作者CCF A类会议或期刊等论文;2. 熟悉某种深度学习框架,如Pytorch等,对深度学习有深入的了解;3. 熟悉并行计算或cuda编程,或图像处理方面经验的优先;4. 在自动驾驶行业有实习经验;5. 能实习6个月及以上。 投递...

Premium Full-time
Pony.ai  18 days ago
Automatically Get Matched to cuda Jobs Let our AI agent search and match you to the best jobs from across the web
Try it now
千寻智能(杭州)科技有限公司 jobs

AI Infra实习生(日常实习) 北京 实习 研发 - 基础架构 千寻智能2025年秋季校园招聘项目 职位描述 1、负责构建支撑具身智能体的核心机器学习系统,开发面向机器人场景的VLA大模型训练与推理系统,支撑多模态感知、运动控制、任务规划等核心能力的持续进化;2、研发新一代具身智能系统工具链,涵盖数据采集、仿真训练、物理部署、持续优化全生命周期。 职位要求 1、计算机、人工智能、软件工程等相关专业,硕士及以上学历,2026年及之后毕业; 2、熟练使用C++/Python/Pytorch/CUDA开发生态,具有嵌入式系统开发经验者优先;3、能至少保障3个月以上的实习时间,每周4天以上出勤;4、加分项:在以下一个或多个领域有深度实践: a. 大模型训练推理:多模态大模型分布式训练、端上推理加速、Transformer模型优化; b. 高性能计算:GPU Kernel编写,高性能通信(NCCL、RDMA),AI编译器(TVM、Triton),模型量化等; c. 机器人系统:ROS2、运动控制算法、传感器数据处理pipeline。 投递...

Premium Full-time AI
千寻智能(杭州)科技有限公司  18 days ago
北京科学智能研究院 AI for Science Institute, Beijing jobs

机器学习势函数工程研发实习生 北京 实习 本科及以上 职位描述 1. 计算机、软件工程、人工智能、计算科学或相关专业本科及以上学历;2. 熟练使用 Python,具备 C/C++ 基础,能够阅读和调试工程代码;3. 熟悉 PyTorch及常见模型训练、测试和性能评测流程;4. 熟悉 Linux、Git及常用开发工具,能够根据日志定位和解决实验问题;5. 具备良好的代码规范、测试意识和实验复现意识;6. 了解 CUDA、Triton、GPU性能分析或分布式训练者优先;7. 有 DeePMD-kit、分子动力学、机器学习势函数或科学计算经验者优先;8. 大四即以上211,985在读优先;9. 善于独立思考,灵活使用各类AI工具。 职位要求 1. 根据既定方案配置、提交和监控机器学习势函数训练及测试任务;2. 整理实验数据与结果,完成精度、速度和资源消耗等指标的对比分析;3. 参与 DeePMD-kit 的功能开发、问题排查、单元测试和文档维护;4. 协助开展关键计算流程和算子的性能分析与优化;5. 完善实验脚本及自动化工具,保障实验流程稳定、可复现。 职位信息 部门: OpenLAM 投递...

Premium Full-time
北京科学智能研究院 AI For Science Institute, Beijing  17 days ago
Nvidia jobs

NVIDIA has been transforming computer graphics, PC gaming, and accelerated computing for more than 25 years. It’s a unique legacy of innovation that’s fueled by great technology—and amazing people. Today, we’re tapping into the unlimited potential

Nvidia  16 days ago
Nvidia jobs

At NVIDIA, we’re solving the world’s most ambitious problems with our groundbreaking developments in Artificial Intelligence, High-Performance Computing and Visualization. We are looking for a Developer Relations Manager to work with China industrial/research community to integrate

Nvidia  16 days ago
Nvidia jobs

NVIDIA has been transforming computer graphics, PC gaming, and accelerated computing for more than 25 years. It’s a unique legacy of innovation that’s fueled by great technology—and amazing people. Today, we’re tapping into the unlimited potential

Nvidia  16 days ago
Nvidia jobs

At NVIDIA, we’re solving the world’s most ambitious problems with our groundbreaking developments in Artificial Intelligence, High-Performance Computing and Visualization. We are looking for a Developer Relations Manager to work with China industrial/research community to integrate

Nvidia  16 days ago
Nvidia jobs

NVIDIA is the world leader in computer graphics, artificial intelligence, and accelerated computing. For over 30 years, we have been at the forefront of research and engineering around the greatest advances in technology. Our history of

Nvidia  16 days ago
Nvidia jobs

NVIDIA is leading company of AI computing. At NVIDIA, our employees are passionate about AI, HPC , VISUAL, GAMING. Our SA team is more focusing to bring NVIDIA new technology into difference industries. We help to

Nvidia  16 days ago
Nvidia jobs

NVIDIA has been redefining computer graphics, PC gaming, and accelerated computing for more than 30 years. It’s a unique legacy of innovation that’s fueled by great technology—and amazing people. Today, we’re tapping into the unlimited potential

Nvidia  16 days ago
Nvidia jobs

NVIDIA has been defining computer graphics, PC gaming, and accelerated computing for more than 25 years. With an outstanding legacy of innovation, driven by phenomenal technology, and extraordinary people, NVIDIA is looking for a strong technical

Nvidia  16 days ago
Nvidia jobs

NVIDIA has been redefining computer graphics, PC gaming, and accelerated computing for more than 25 years. Today, we lead in artificial intelligence, driving advances in natural language processing, computer vision, autonomous systems, and scientific research. We

Nvidia  16 days ago
Li Auto jobs

智能车控软件架构师 北京 全职 生产 / 制造 / 加工 - 汽车制造 职位描述 工作职责: Ø 负责智能车控(智能能源,智能底盘,智能环境等)功能的平台化软件架构设计和落地实施 - 支持不同硬件加速器和智能化算法的平台化开发框架设计 - 结合不同硬件架构,深度学习框架和AI编译等相关技术,加速智能车控算法的推理,部署的落地Ø 负责智能化软件性能和资源使用的优化方案制定和落地实施Ø 负责根据实际业务情况制定智能化软件开发和分工流程Ø 负责分析智能功能对芯片资源的需求,支撑控制器芯片选型 职位要求 任职要求: Ø 在智能算法架构设计,开发,集成,部署领域有8年以上工作经历,有产品量产开发经验Ø 熟悉至少一种主流深度学习算法开发框架(TensorFlow, PyTorch)和性能调优Ø 熟练掌握模型部署时的压缩技巧(模型剪枝、量化和蒸馏等)Ø 熟悉AI编译器相关技术,至少熟悉一种片上的主流算力芯片的编译(地平线,昇腾等)和性能调优Ø 熟悉 ARM 体系架构,熟悉DSP, GPU, NPU等硬件加速器的特性和性能调优Ø 熟悉至少一种并行计算编程框架(OpenCL,CUDA)和性能调优者Ø 熟悉智能软件全开发环节,有平台化软件架构的设计能力和成功经历Ø 可以根据智能化功能需求,完成功能部署分配和资源消耗的预估Ø

Premium Full-time
Li Auto  15 days ago
XPENG jobs

【27届校招】 软件工程师(自动驾驶仿真)-北京 北京 正式 研发 - 算法 职位描述 岗位职责研发和优化小鹏汽车核心自动驾驶仿真模拟器平台,为算法研发、模型训练、评测验证提供高效迭代的平台能力和工程支撑;面向下一代基于人工智能的全套自动驾驶系统,建设模拟器训练与评测支撑平台,支撑模型迭代和系统验证;负责仿真引擎功能开发,搭建和维护大模型推理链路,提升仿真链路的稳定性、吞吐效率和易用性;基于 Python / C++ 开发仿真平台工具链、自动化流程、数据处理与分析工具,提升研发效率和问题定位效率;探索并落地 Agent 在自动驾驶仿真研发中的应用,包括仿真任务自动提交、结果自动分析、问题归因、报告生成和研发流程自动化等方向; 职位要求 职位要求:计算机、软件工程、自动化、电子工程等相关专业,本科及以上学历,硕士优先;熟悉 Linux 系统,具备扎实的 C++ 面向对象编程基础,理解常见工程设计模式和性能优化方法;熟悉 Python 开发,能够使用 Python 完成工具链开发、数据处理、自动化脚本、服务接口开发或算法工程辅助开发;具备一定的软件工程能力,熟悉调试、性能分析、问题定位、代码优化和工程化交付流程;了解模型推理部署与优化相关技术者优先,包括 ONNX、TensorRT、PyTorch、CUDA、GPU 推理性能优化、批处理、并发调度等;了解 Agent、LLM 应用开发、RAG、工具调用、自动化工作流等相关技术,并有实际落地经验者优先;具有自动驾驶、仿真平台、机器人、控制、规划、感知、电子工程相关背景者优先;具备较强的问题分析能力、工程落地能力和跨团队沟通协作能力。 投递...

XPENG  12 days ago
千寻智能(杭州)科技有限公司 jobs

【2027 届校招】AI Infra工程师 北京、杭州 正式 互联网 / 电子 / 网游 - 研发 【千寻智能2027届秋季校园招聘】 职位描述 1、负责具身智能大模型千卡大规模训练系统性能优化及MFU优化。2、负责多模态大模型(VLM)在云端的高性能分布式推理系统设计、开发与全链路端到端部署。3、负责具身智能VLA模型在端侧的推理系统的研发和模型加速算法研究。 职位要求 1、熟悉GPU体系结构,熟练掌握CUDA/triton,熟练掌握C++或Python语言。2、深入了解PyTorch等深度学习框架的架构和运行原理,深入理解大模型训练多维并行架构,如Tensor并行、流水线并行、序列并行等。3、深入理解多模态模型结构,如ViT、DiT等,了解开源多模态大模型结构,如qwen-vl、llama等。4、熟悉至少一种主流开源推理引擎(如 vLLM、SGLang、TensorRT-LLM、Nvidia Dynamo等)的底层机制与源码魔改。5、熟悉量化、剪枝、蒸馏、投机推理、步数蒸馏等前沿推理加速及模型小型化技术方案。 投递...

Premium Full-time
千寻智能(杭州)科技有限公司  12 days ago

Subscribe for job alerts and resources to make your job search easier!

Confirmation email sent to

Check your email and click on the link to start receiving your job alerts

Receive the latest job openings for:

cuda jobs in beijing

You also might be interested in:

实习生

AI

Computing

Python

C++

Confirmation email sent to

Check your email and click on the link to start receiving your job alerts

All Filters Apply
Sort by
Company
Job Title
Employer/Recruiter