Refine Reset All
Sort by
Company
Employer/Recruiter
Salary Estimate
Date Posted
Company
Location
Job Type
Employer/Recruiter
Experience
Salary Estimate
All Filters

Cuda Jobs In China - 158 Job Positions Available

Top Cities:
1 – 20 of 158 jobs
Nvidia jobs

NVIDIA is the world leader in GPU Computing. We are passionate about markets including Data centers, Gaming, Professional vision, Automotive, HPC and networking. We are well positioned as the “AI Computing Company”, and our GPUs are

Nvidia  3 days ago
Nvidia jobs

NVIDIA is the world leader in GPU Computing. We are passionate about markets including Data centers, Gaming, Professional vision, Automotive, HPC and networking. We are well positioned as the “AI Computing Company”, and our GPUs are

Nvidia  3 days ago
Nvidia jobs

NVIDIA has been transforming computer graphics, PC gaming, and accelerated computing for more than 25 years. It’s a unique legacy of innovation that’s fueled by great technology—and amazing people. Today, we’re tapping into the unlimited potential

Nvidia  3 days ago
Nvidia jobs

NVIDIA is the world leader in GPU Computing. We are passionate about four markets: Gaming, Automotive, Enterprise Graphics and HPC/Cloud Datacenters; in addition to our traditional OEM business. We are well positioned as the ‘AI Computing

Nvidia  3 days ago
Nvidia jobs

NVIDIA is the world leader in GPU Computing. We are passionate about four markets: Gaming, Automotive, Enterprise Graphics, and HPC/Cloud Datacenters, in addition to our traditional OEM business. We are well positioned as the AI Computing

Nvidia  3 days ago
Nvidia jobs

NVIDIA is the world leader in GPU Computing. We are passionate about markets including Data centers, Gaming, Professional vision, Automotive, HPC and networking. We are well positioned as the “AI Computing Company”, and our GPUs are

Nvidia  3 days ago
Automatically Get Matched to cuda Jobs Let our AI agent search and match you to the best jobs from across the web
Try it now
XPENG jobs

具身软件系统实习生 深圳、上海 实习 互联网 / 电子 / 网游 职位描述 负责人形机器人本体软件系统的设计与开发,将 AI 算法落地为可靠运行的机器人软件。1、与算法团队紧密协作,将强化学习、VLA、大语言模型等 AI 能力集成到机器人系统中,开发并优化 C++ 推理管道;2、设计并实现机器人核心软件架构,包括功能状态机、资源编排、任务调度,控制机器人自主完成复杂任务;3、开发高性能中间件(通信、监控、日志),确保多模块间低延迟、高可靠的数据交换;4、负责机器人数据采集、录制、回放及云端同步的全链路开发,保障数据闭环;5、参与嵌入式层开发,包括传感器(IMU、摄像头、力传感器)和执行器驱动,打通 AI 算法到底层硬件的完整链路。 职位要求 1、本科及以上学历,计算机、自动化、电子工程等相关专业;2、 熟悉 C++(C++17 及以上),具备 Linux 环境下系统级软件开发经验;3、 具备基本代码调试能力,逻辑思维清晰,有良好的沟通能力和团队协作意识;4、踏实好学,对人形机器人、机器人底层软件有浓厚兴趣,能保证连续实习6个月;5、具备良好的系统设计能力,能完成模块架构设计和跨团队技术对接。【加分项】1、有人形机器人或足式机器人的软件系统开发经验;2、熟悉 Bazel 构建系统;3、有 CUDA 编程或 GPU 加速经验;4、了解 MuJoCo/Isaac Gym 等仿真平台与真机部署的对接;5、机器人中间件开发(ROS2/DDS/自研通信框架);6、深度学习推理引擎集成(TensorRT/ONNX Runtime/MNN);7、嵌入式驱动开发(EtherCAT/CAN/SPI);8、熟悉实时系统开发,了解 PREEMPT_RT

XPENG  27 days ago
XPENG jobs

具身大模型部署与优化实习生 深圳 实习 互联网 / 电子 / 网游 职位描述 负责将大语言模型、多模态模型和具身智能模型高效部署到机器人端侧芯片和云端,实现低延迟实时推理。1、负责VLA(操作模型)等大模型在自研芯片上的端侧部署,完成模型量化(INT8/INT4/FP8)、图优化和推理加速;2、设计和优化模型推理服务(基于 vLLM/TensorRT-LLM),支撑 VLA 推理的低延迟需求;3、建立模型部署的标准化流程:模型转换→量化→性能基准测试→端侧验证→上线发布;4、模型优化,参与大模型的量化部署工作,探索模型在嵌入式端侧的高效运行;5、与算法团队协作,从模型设计阶段介入,提供部署可行性评估和性能预估。6、实验验证: 协助将算法部署至真实人形机器人平台,进行效果调试与性能评估。 职位要求 1、计算机、人工智能、自动化、机器人等相关专业在读硕士、博士、优秀本科生;2、 具备扎实的深度学习基础,熟悉 Transformer 架构,对 VLA 等主流模型有深入理解;3、熟悉 C++/Python,具备良好的代码风格和算法实现能力;4、有以下至少一项经验:-模型量化(PTQ/QAT/混合精度)与精度-速度 trade-off 调优;-CUDA 编程与 GPU kernel 优化;-嵌入式 NPU 部署(高通/联发科/NVIDIA Orin);-熟悉至少一种推理框架:TensorRT / ONNX Runtime / vLLM /

Premium Full-time AI Kernel
XPENG  27 days ago
上海得物信息集团有限公司 jobs

【27届校招】算法工程师(C++方向)-杭州 杭州 正式 技术类 2027届秋季校园招聘项目 职位描述 1、负责参与得物搜推引擎系统、特征存储和服务系统、预估推理框架、AI训练框架和机器学习平台的研发,重点研发搜推引擎、GPU分布式训练系统、预估服务系统、AI推理框架,支持搜广推生成式召回, 大模型探索等前沿工程挑战方向.2、深度参与性能优化, 对业界搜推工程链路所需 GPU训练和推理性能优化,自定义GPU算子的cuda kernel开发和优化, 打造性能卓越的搜广推工程基建.3、参与特征平台、索引平台、模型训练,模型服务等重要方向的研发,提升平台的效率和易用性,加速得物算法团队的模型迭代效率.4、深度参与AI 建设(如AI搜索, AI推荐等方向), 利用AI 解决和提效当前链路, 打造AI时代下搜推广工程链路. 职位要求 1、2027届毕业生,本科及以上学历,基础扎实, 精通数据结构/算法,操作系统,网络通信等核心理论知识;2 、有较好的AI 兴趣, 对业界大模型, Agent 编排, AI Loop, AI Harness 等Agent 框架和AI工程有不错理解和使用, 学习意愿.3 、有较强的动手能力,具备优秀的编码能力,熟练掌握C/C++编程语言,ACM参赛者优先,有搜推引擎和深度学习框架开发的优先.4、有较好的逻辑思考能力, 快速识别关键问题, 清晰描述问题和沟通解决方案, 有一个或者多个技术点深入思考者优先;5、有较好的主动性,开放心态,能大胆,主动问问题,思考问题,大胆提出自己的想法和建议,开源社区积极参与者或者活跃者优先; 投递...

Premium Full-time Harness AI
上海得物信息集团有限公司  27 days ago
XPENG jobs

【27届校招】算子库开发培训生 武汉、上海 正式 研发 - 电子 / 半导体 职位描述 1、基于类 cuda 环境, 设计并实现高性能算子, 例如 gemm, Attention, FFN, CNN 等.2、结合芯片微架构特性进行极致调优, 优化核心算子性能逼近理论设计上限.3、开发性能评估工具, 并总结性能测试报告.4、编写算子设计文档与交付文档,保障算子库的稳定性与可维护性。 职位要求 1、精通 C/C++, 熟悉 Linux 开发环境, 掌握 CMake, Git 等工程化工具, 必须具备良好的代码风格与调试能力.2、深入理解 CPU/GPU 并行计算原理(如 SIMD/SIMT 架构), 有

XPENG  27 days ago
XPENG jobs

【27届校招】IP设计工程师 上海、深圳 正式 研发 - 电子 / 半导体 职位描述 1、负责超大规模AI芯片中IP设计,包括矩阵计算、向量计算、视觉处理、存储/互联/调度/同步/集成等;2、负责系统需求分解、微架构设计与PPA评估,撰写设计文档;3、负责RTL开发与子系统集成;4、协同各团队完成IP/子系统的PPA优化;5、指导和支持中后端设计团队完成IP/子系统的物理实现;6、支持芯片回片后的测试、性能/功耗调教等。 职位要求 1、计算机、电子、通信等相关专业硕士或以上学历;2、良好的学习能力、团队协作能力和解决问题能力;3、参加过电赛,机器人大赛者优先;4、熟悉TensorCore/NVDLA/MMA等高性能计算架构;5、或者熟悉OpenMP/CUDA等并行计算架构;6、或者熟悉AXI、CHI等总线协议,UMA/NUMA等存储架构;7、或者熟悉ISP/CV等视觉加速; 投递...

Premium Full-time
XPENG  27 days ago
XPENG jobs

【27届校招】AI Infra部署工程师 广州、北京、上海 正式 研发 - 算法 职位描述 职位描述:设计、实现与维护自动驾驶软件系统框架,优化系统的性能、延时、稳定性与算法工程师合作,完成端到端大模型的转换与部署,以及模型的预处理/后处理等开发工作负责模型的KPI评测与对齐工作负责功能开发完成后的实车联调、测试及迭代优化等工作 职位要求 岗位要求:计算机、电子信息等相关专业的硕士或博士精通C++、Python,具有良好的代码书写规范和文档编写能力熟悉多线程编程,深入理解计算机体系结构和高性能计算有Linux系统性能优化经验,熟悉常用调试工具具备优秀的问题分析、沟通及协作能力 加分项:熟悉 CUDA 内核与 TensorRT有实际的深度学习模型部署、性能优化经验有自动驾驶或机器人行业相关经验 投递...

Premium Full-time CUDA
XPENG  27 days ago
XPENG jobs

【27届校招】世界模型AI算法工程师/研究员 深圳、上海 正式 研发 - 算法 职位描述 【关于机器人中心】小鹏机器人中心专注于构建面向未来的人形机器人系统,融合先进的人工智能、控制、机械与系统工程,打造能感知、理解、操作并与现实世界交互的下一代机器人。【关于世界模型团队】我们相信,让机器真正在物理世界里泛化的钥匙,不是记住一个个任务,而是让模型学会世界如何运转——这就是世界模型(World Model)。我们要构建的,是一个能理解当下、预见未来、并据此行动的模型:它不再是面向单一任务的策略,而是一个吸收了海量物理动力学知识、能想象未来、能跨场景泛化的具身基础模型。我们的目标是超越现有操作模型的泛化边界,做出可泛化、可落地、可 scaling 的世界模型,并在真实机器人闭环上验证它的价值。团队精悍、扁平,成员分布于深圳、上海与美国硅谷,聚集了一批世界一流的研究者与工程师。在这里,你将:站在具身智能最前沿,啃通用泛化这个最硬、也最值得啃的问题;打通 数据 → 预训练 → 仿真 → 部署 → 真机 的全栈链路,亲眼看着自己的模型在真实机器人上跑起来;与来自顶级高校与工业界的同伴并肩,快速试错、快速迭代。【我们在做什么】围绕世界模型,我们打通从数据到真机的全栈:训练 World Action Model(WAM)统一理解世界—预测演化—生成动作、突破泛化边界;训练 World Simulation Model(WSM)做长时序、物理一致的生成式仿真,用于策略评估与合成数据;从互联网规模的视频中蒸馏世界知识;并以大规模分布式训练、推理优化与端侧部署的基建,让 scaling 真正跑得起来、落得下去;同时在世界模型的 loop 里探索强化学习,让策略在想象中自我提升。 职位要求 1、计算机、人工智能、电子工程、自动化等相关专业应届毕业生,硕士及以上学历,对世界模型、具身智能、大模型交叉方向有强烈热情;2、扎实的机器学习与深度学习基础,熟悉 Transformer / Diffusion

XPENG  27 days ago
XPENG jobs

【27届校招】大模型训练推理框架工程师 深圳、北京 正式 研发 - 算法 职位描述 负责大模型训练、推理和评测的基础设施研发,为算法团队提供高效稳定的工程底座。1、训练系统:设计和优化大规模分布式训练架构(Pretrain/SFT/RL),解决千卡级训练的通信、调度、容错问题;2、推理部署:基于 vLLM 等框架优化大模型推理性能,支撑 VLT/Omni 等模型在 XP5 端侧和云端的部署;3、评测平台:开发 DeepInsight 评测系统,支持 LLM/VLM/WBC/VLA 多类模型的自动化评测、报告生成和 CI/CD 集成;4、MLOps 工具链:构建模型版本管理、实验追踪、数据管理、资源调度等基础设施,提升研发效率;5、RL 训练环境:构建分布式强化学习训练系统,支持 Agent-环境大规模并行交互。 职位要求 1、硕士及以上学历,计算机、软件工程等相关专业;2、 精通 Python,熟练掌握 C++/Go 至少一门;3、在以下至少一个方向有丰富以上经验:- 分布式训练系统(Megatron-LM/DeepSpeed/FSDP);- GPU 编程与高性能计算(CUDA/NCCL/RDMA);- ML 平台开发(Kubernetes/Ray/Airflow);- 模型推理优化(TensorRT/vLLM/量化部署);4、理解大模型训练和 RL 训练的基本流程。

Premium Full-time Ml
XPENG  27 days ago
XPENG jobs

【27届校招】具身智能模型部署工程师 深圳 正式 研发 - 算法 职位描述 负责具身智能模型在机器人端和小鹏自研芯片平台上的适配、优化与部署,参与模型转换、量化、性能评测、精度验证和上线发布全流程。通过工程优化提升模型推理性能、资源利用率和运行稳定性,推动算法能力高效落地到机器人产品。岗位职责1、负责 VLM、VLA、多模态及其他具身智能模型在小鹏自研芯片平台上的转换、适配、量化与部署;2、开展端侧推理性能评测与优化,分析时延、内存、功耗和算力利用率等关键指标;建立模型精度对齐与自动化回归能力,定位模型转换、量化及算子适配过程中的精度问题;3、参与模型部署工具链建设,完善模型转换、性能基准、端侧验证和发布流程;与算法和芯片团队协作,从模型设计阶段参与部署可行性评估,推动模型在机器人端稳定运行。 职位要求 1、计算机、人工智能、电子工程、自动化等相关专业本科及以上学历,面向应届毕业生;2、熟练掌握 C++ 或 Python,具备良好的数据结构、算法和软件工程基础;3、理解深度学习基本原理,熟悉 Transformer、视觉或多模态模型的基本结构与计算特点;4、熟悉 PyTorch 等训练框架,了解模型导出、转换和推理部署的基本流程;5、对模型性能优化有兴趣,能够结合日志、性能数据和实验结果分析定位问题;6、具备良好的学习能力和动手能力,有相关课程设计、实习、科研或个人项目经验。加分项:1、有 LLM、VLM、VLA 或多模态模型部署与优化项目经验;2、熟悉 ONNX、TensorRT、llama.cpp、MLC LLM 或芯片推理 SDK;3、了解 PTQ、QAT、混合精度等量化方法,并有精度对齐实践;4、有 CUDA、NPU、嵌入式 Linux 或开发板模型部署经验;5、在 AI 系统、编译器、并行计算相关竞赛、开源项目或论文中有突出成果。我们期望你具备的特质:1、学习能力:愿意持续学习模型、运行时和芯片平台知识,能够快速进入新的技术领域;2、工程思维:重视数据、实验和代码质量,能够把想法转化为可验证、可复现的工程结果;3、探索精神:对模型如何在真实机器人上高效运行保持好奇,愿意深入定位和解决复杂问题。 投递...

XPENG  27 days ago
XPENG jobs

【27届校招】 软件工程师(自动驾驶仿真)-广州 广州 正式 研发 - 算法 职位描述 岗位职责研发和优化小鹏汽车核心自动驾驶仿真模拟器平台,为算法研发、模型训练、评测验证提供高效迭代的平台能力和工程支撑;面向下一代基于人工智能的全套自动驾驶系统,建设模拟器训练与评测支撑平台,支撑模型迭代和系统验证;负责仿真引擎功能开发,搭建和维护大模型推理链路,提升仿真链路的稳定性、吞吐效率和易用性;基于 Python / C++ 开发仿真平台工具链、自动化流程、数据处理与分析工具,提升研发效率和问题定位效率;探索并落地 Agent 在自动驾驶仿真研发中的应用,包括仿真任务自动提交、结果自动分析、问题归因、报告生成和研发流程自动化等方向; 职位要求 职位要求:计算机、软件工程、自动化、电子工程等相关专业,本科及以上学历,硕士优先;熟悉 Linux 系统,具备扎实的 C++ 面向对象编程基础,理解常见工程设计模式和性能优化方法;熟悉 Python 开发,能够使用 Python 完成工具链开发、数据处理、自动化脚本、服务接口开发或算法工程辅助开发;具备一定的软件工程能力,熟悉调试、性能分析、问题定位、代码优化和工程化交付流程;了解模型推理部署与优化相关技术者优先,包括 ONNX、TensorRT、PyTorch、CUDA、GPU 推理性能优化、批处理、并发调度等;了解 Agent、LLM 应用开发、RAG、工具调用、自动化工作流等相关技术,并有实际落地经验者优先;具有自动驾驶、仿真平台、机器人、控制、规划、感知、电子工程相关背景者优先;具备较强的问题分析能力、工程落地能力和跨团队沟通协作能力。 投递...

XPENG  27 days ago
XPENG jobs

【27届校招】 软件工程师(自动驾驶仿真)-北京 北京 正式 研发 - 算法 职位描述 岗位职责研发和优化小鹏汽车核心自动驾驶仿真模拟器平台,为算法研发、模型训练、评测验证提供高效迭代的平台能力和工程支撑;面向下一代基于人工智能的全套自动驾驶系统,建设模拟器训练与评测支撑平台,支撑模型迭代和系统验证;负责仿真引擎功能开发,搭建和维护大模型推理链路,提升仿真链路的稳定性、吞吐效率和易用性;基于 Python / C++ 开发仿真平台工具链、自动化流程、数据处理与分析工具,提升研发效率和问题定位效率;探索并落地 Agent 在自动驾驶仿真研发中的应用,包括仿真任务自动提交、结果自动分析、问题归因、报告生成和研发流程自动化等方向; 职位要求 职位要求:计算机、软件工程、自动化、电子工程等相关专业,本科及以上学历,硕士优先;熟悉 Linux 系统,具备扎实的 C++ 面向对象编程基础,理解常见工程设计模式和性能优化方法;熟悉 Python 开发,能够使用 Python 完成工具链开发、数据处理、自动化脚本、服务接口开发或算法工程辅助开发;具备一定的软件工程能力,熟悉调试、性能分析、问题定位、代码优化和工程化交付流程;了解模型推理部署与优化相关技术者优先,包括 ONNX、TensorRT、PyTorch、CUDA、GPU 推理性能优化、批处理、并发调度等;了解 Agent、LLM 应用开发、RAG、工具调用、自动化工作流等相关技术,并有实际落地经验者优先;具有自动驾驶、仿真平台、机器人、控制、规划、感知、电子工程相关背景者优先;具备较强的问题分析能力、工程落地能力和跨团队沟通协作能力。 投递...

XPENG  27 days ago
XPENG jobs

【27届校招】AI软件工程师 上海 正式 研发 - 电子 / 半导体 职位描述 1. 高性能计算核心开发:针对自研芯片架构,设计、开发并优化高性能的CUDA及DSP算子,以支撑大模型推理、实时图像处理等关键业务。2. AI系统集成与验证:负责自研芯片上AI加速器系统的集成与验证,并搭建与完善算子自动化测试验证平台,确保代码的工程化质量与高效落地。3. 嵌入式与算法软件交付:参与高实时性、高算力的嵌入式软件平台与通用机器人操作系统的设计与交付。 4. 前沿算法探索与实现:参与自动驾驶/机器人算法(如识别、规划、导航、多模态大模型等)的设计、交付与优化。 5. 全栈生态建设:深度参与从芯片需求到架构设计的转换,并为建设高性能计算软件栈的生态做出贡献。 职位要求 1. 硕士及以上学历,计算机、电子、软件、通信、自动化、数学等相关专业。2. 精通 C/C++ 与 Python,熟悉Linux开发环境,掌握gprof/perf等性能剖析工具,具备扎实的数据结构与算法基础和良好的软件工程习惯。 3. 具备极强的学习能力、良好的沟通协调能力和团队合作精神。4. 核心技术要求 (满足以下至少一项): * 高性能计算:理解GPU架构(如SM/Tensor Core/Memory Hierarchy)及CUDA编程模型(Kernel/Thread Hierarchy/Stream),了解并行计算、缓存优化、向量化指令集(AVX/NEON)等知识。* 深度学习工程化:熟悉深度学习模型从训练到部署的全流程,对CUDA、PyTorch/TensorFlow、ONNX Runtime以及Transformer、VLM等流行模型架构有一定了解。 * 底层系统软件:对CPU体系结构、操作系统原理、Linux驱动和应用有较深入的理解。加分项 (有以下经验者优先):1. 有CUDA/OpenCL/ROCm等异构计算平台的算子开发与性能优化经验(课程设计、实验室项目、相关竞赛或开源贡献。2. 熟悉深度学习框架底层,如PyTorch

XPENG  27 days ago
XPENG jobs

【27届校招】AI Infra工程师(具身智能方向) 广州、北京、上海 正式 研发 - 算法 职位描述 岗位职责 负责大模型推理服务的车端部署、上线,保障服务的高可用、低延迟与稳定性;构建和优化推理框架,提升吞吐、降低时延与显存占用;参与模型量化、压缩、KV Cache 优化等推理加速工作,推动硬件资源的高效利用;与算法、模型团队紧密协作,推动模型从训练到生产环境的高效落地;跟进业界推理优化与部署前沿技术,并在生产环境中落地实践。 职位要求 基本要求 计算机、软件工程、人工智能等相关专业本科及以上学历;熟练掌握 PyTorch熟悉 C++/CUDA 者优先;熟悉主流推理框架(vLLM、SGLang、TensorRT-LLM 等)及其部署优化;熟悉模型量化/压缩技术(GPTQ、AWQ、SmoothQuant、FP8 等); 加分项 熟悉 CUDA 编程、算子优化或 Triton 开发;熟悉模型剪枝,蒸馏等技术有推理成本优化、性能压测或可观测性体系建设经验;对 LLM 推理底层原理(Attention、KV Cache、PagedAttention 等)有深入理解。 投递...

Premium Full-time CUDA
XPENG  27 days ago
XPENG jobs

VLA大模型算法实习生 深圳 实习 研发 - 算法 职位描述 1、负责VLA自动驾驶大模型的研发及在车端量产落地等工作;2、解决VLA在实际量产项目中的问题,基于 Agent 开发自动化问题分析工具;3、参与构建高质量 VLA Benchmark 系统,包括场景挖掘、难例挖掘及模型评测(Reward Model)等。 职位要求 1、学历与专业: 计算机、自动化、机器人、人工智能、数学等相关专业,硕士及以上学历2、有端到端自动驾驶(如UniAD)或VLA模型(如RT-2)等在机器人/自动驾驶领域的应用经验;3、具备良好的数理功底以及代码能力;4、熟悉强化学习、模仿学习、扩散策略在自动驾驶/机器人中的应用;5、有大规模分布式训练、模型量化、端侧部署(TensorRT/ONNX/CUDA)经验优先;6、有自动驾驶世界模型(预测或生成方向)研发经验优先。 投递...

Premium Full-time
XPENG  27 days ago

Subscribe for job alerts and resources to make your job search easier!

Confirmation email sent to

Check your email and click on the link to start receiving your job alerts

Receive the latest job openings for:

cuda

You also might be interested in:

Software Engineer

AI

Computing

Engineer

Deep Learning

Solution Architect

实习生

C++

PyTorch

Python

Confirmation email sent to

Check your email and click on the link to start receiving your job alerts

All Filters Apply
Sort by
Company
Employer/Recruiter
Salary Estimate