Refine Reset All
Sort by
Company
Employer/Recruiter
Experience
Date Posted
Company
Location
Job Type
Employer/Recruiter
Experience
All Filters

Nvidia Gpu Jobs In China - 128 Job Positions Available

Top Cities:
1 – 20 of 128 jobs
Nvidia jobs

The NVIDIA GPU Architecture group is looking for world class architects and software developers to join and lead our various architecture efforts. A key part of NVIDIAs strength is to innovate in the graphics and parallel computing fields delivering

Nvidia  11 days ago
Nvidia jobs

At NVIDIA, we build groundbreaking products for the following sectors: Deep Learning, High Performance Computing, Gaming, VR, and Automotive. See your efforts in action as developers use your tools to debug, profile and analyze the performance of

Nvidia  11 days ago
Nvidia jobs

A key part of NVIDIAs strength is our sophisticated development tools and modelling environments that enable our incredible pace of delivering new technology to market. We are looking for forward-thinking, hard-working, and creative people to join a

Nvidia  11 days ago
Nvidia jobs

NVIDIA has been defining computer graphics, PC gaming, and accelerated computing for more than 25 years. With an outstanding legacy of innovation, driven by phenomenal technology, and extraordinary people, NVIDIA is looking for a strong technical senior architect

Nvidia  11 days ago
Nvidia jobs

NVIDIA has continuously reinvented itself over two decades. NVIDIA’s invention of the GPU in 1999 sparked the growth of the PC gaming market, redefined modern computer graphics, and revolutionized parallel computing. More recently, GPU deep learning ignited modern AI —

Nvidia  11 days ago
Meshy LLC jobs

About Meshy Headquartered in Silicon Valley, Meshy is the leading 3D generative AI company on a mission to Unleash 3D Creativity by transforming the content creation pipeline. Meshy makes it effortless for both professional artists and

Meshy LLC  28 days ago
NIO jobs

高性能计算实习生 北京 实习 数字技术 职位 ID:A148157 职位描述 基于 Nvidia GPU/ARM CPU 等架构特性完成深度学习算子、CV 算法及计算库的开发及优化;与深度学习引擎前端团队一起,共同完成深度学习引擎在端侧落地,保证算法运行的高效性及实时性。 职位要求 岗位职责:基本要求:熟悉 ARM/DSP/CUDA 并行编程模型;熟悉 C/C++ 编程,了解常用算法及数据结构;了解 Nvidia GPU/ARM CPU 处理器体系结构,理解软件与硬件底层映射关系。加分项:熟悉程序性能分析、问题定位及调试方法熟悉深度学习算法或常见 CV 算法;熟悉深度学习量化方法。 投递...

Premium Full-time
NIO  26 days ago
北京智谱华章科技有限公司 jobs

26届校招-推理Infra工程师 北京 正式 互联网 / 电子 / 网游 职位描述 1. 参与大模型推理框架的设计与开发​:协助团队进行支撑大语言模型、图像生成等复杂模型推理的高性能框架研发,推动算法到产品落地的全链路优化,确保推理的高效性、稳定性和低延迟。2. 性能优化与调优​:在资深工程师指导下,参与优化内存管理、计算资源分配与调度策略,提升模型推理速度和资源利用率。学习并使用性能分析工具(如Nvidia Nsight)进行瓶颈定位和优化。3. 模型推理加速技术探索​:学习并应用业界前沿的推理优化技术,KV Cache优化、模型量化(Quantization)、剪枝(Pruning),跨机分布式推理优化等。 职位要求 1. 基础技能​: - 熟练掌握 C++ 和 Python 编程语言,具备扎实的数据结构、算法和操作系统基础。 - 熟悉至少一种主流的深度学习框架(如 PyTorch、TensorFlow),了解其基本实现原理。 - 了解GPU编程​(如 CUDA)或并行计算,有相关的课程项目或实验经验。2. 专业知识​: - 对 Transformer 架构及主流大模型(如GPT、Llama、Qwen等)的推理特性有基本理解。 - 了解大模型推理的基本流程和常见挑战(如延迟、吞吐、内存占用)。3. 加分之项(满足以下任一即可)​​:

Premium Full-time C++ Python
北京智谱华章科技有限公司  24 days ago
Google jobs

Minimum qualifications: Bachelors degree in Computer Science, Mathematics, a related technical field, or equivalent practical experience. 10 years of experience with cloud native architecture in a customer-facing or support role. Experience in developing and deploying models

Google  20 days ago
NIO jobs

Super Sparks-校招-AI推理引擎算法工程师 北京、上海 校招 正式 数字技术 - 算法 博士及以上 Super Sparks 招聘计划 职位 ID:A169287 职位描述 1. 参与大模型推理引擎的设计和研发,支撑自研以及开源模型的快速部署和高性能推理;2. 通过各种技术手段持续优化性能,降低推理成本,包括但不限于:算子/编译优化、异构推理、分布式并行等;3. 学习并应用业界前沿的推理优化技术,KV Cache优化、模型量化(Quantization)、剪枝(Pruning),跨机分布式推理优化等;4. 对 Transformer 架构及主流大模型(如GPT、Llama、Qwen等)的推理特性有基本理解,了解大模型推理的基本流程和常见挑战(如延迟、吞吐、内存占用);5. 在资深工程师指导下,参与优化内存管理、计算资源分配与调度策略,提升模型推理速度和资源利用率。学习并使用性能分析工具(如Nvidia Nsight)进行瓶颈定位和优化。 职位要求 1. 熟练掌握 C++ 和 Python 编程语言,具备扎实的数据结构、算法和操作系统基础熟悉至少一种主流的深度学习框架(如 PyTorch、TensorFlow),了解其基本实现原理了解GPU编程(如 CUDA)或并行计算,有相关的课程项目或实验经验;2. 有开源大模型推理框架(vllm/sglang/trt-llm)使用和优化经验者优先;3. 有cuda或triton开发优化gpu算子经验者优先;4. 有NVIDIA 等算力芯片优化经验者优先。 投递...

NIO  19 days ago
Hp jobs

Sr. Manager, Future Computing Prototyping Studio Description - The Opportunity HP is creating a Shanghai-based Future Computing Prototyping Studio to make the next generation of personal computing tangible on real HP hardware. We are seeking a

Hp  18 days ago
Roche jobs

At Roche you can show up as yourself, embraced for the unique qualities you bring. Our culture encourages personal expression, open dialogue, and genuine connections, where you are valued, accepted and respected for who you are,

Roche  16 days ago
Nvidia jobs

The NVIDIA GPU clocks group is looking for an excellent Senior ASIC Design Engineer to join the team. The Team is responsible for crafting all aspects of GPU clocking. We collaborate with the frontend design team to understand the

Nvidia  13 days ago
Qualcomm jobs

Company: Qualcomm China Job Area:Sales, Business Development & Marketing Group, Sales, Business Development & Marketing Group Product Marketing - SIP General Summary: Qualcomm is a leading supplier of chipset platforms for automotive infotainment. In this role,

Qualcomm  13 days ago
千寻智能(杭州)科技有限公司 jobs

【校招实习】AI Infra工程师 北京 实习 互联网 / 电子 / 网游 - 研发 千寻智能2027届校招实习招聘项目 职位描述 1、负责具身智能大模型千卡大规模训练系统性能优化及MFU优化。2、负责多模态大模型(VLM)在云端的高性能分布式推理系统设计、开发与全链路端到端部署。3、负责具身智能VLA模型在端侧的推理系统的研发和模型加速算法研究。 职位要求 1、熟悉GPU体系结构,熟练掌握CUDA/triton,熟练掌握C++或Python语言。2、深入了解PyTorch等深度学习框架的架构和运行原理,深入理解大模型训练多维并行架构,如Tensor并行、流水线并行、序列并行等。3、深入理解多模态模型结构,如ViT、DiT等,了解开源多模态大模型结构,如qwen-vl、llama等。4、熟悉至少一种主流开源推理引擎(如 vLLM、SGLang、TensorRT-LLM、Nvidia Dynamo等)的底层机制与源码魔改。5、熟悉量化、剪枝、蒸馏、投机推理、步数蒸馏等前沿推理加速及模型小型化技术方案。 投递...

Premium Full-time
千寻智能(杭州)科技有限公司  12 days ago
Anker Innovations jobs

具身智能-运动智能体 深圳、上海 社招 全职 智能制造 / 工业互联网 / 工业自动化 - 研发 职位描述 【具身端到端规划算法工程师/资深/专家/TL】(深圳/上海/北京)岗位职责:1. 负责研发基于深度学习的四足/人形等机器人的全身状态规划控制,实现灵活自然的动态环境的避障和通过2. 设计实现鲁棒高效的 感知-规划-控制 端到端方案,实现鲁棒高效精准的机器人动作规划3. 设计构建模型训练数据集和标注方法,支持大批量自动化的标注构建4. 应用模仿学习,在/离线强化学习进行模型训练提升模型性能,开发高效的模型评测方法提高迭代效率5. 解决模型评测/部署/真机测试中遇到的问题,满足项目交付指标要求6. 跟踪前沿技术方案,持续迭代升级方案 岗位要求:满足3条及以上1. 人工智能、计算机、机器人、自动驾驶、控制等相关专业硕士或博士学位2. 熟练掌握主流深度学习的时序规划方法如transformer,生成式方法 diffusion policy,掌握主流端到端架构方案如BEV-tranformer/diffusion架构。3. 熟悉基于采样/搜索/优化的决策规划算法,熟悉机器人全身控制。4. 具有模仿学习或强化学习训练经验,熟悉PPO/GRPO/DPO等5. 有实际的端到端系统开发经验,如智能驾驶的E2E。6. 熟练使用PyTorch/TensorFlow深度学习框架,熟练使用Python/C++语言编程,有实际项目开发经验7. 熟悉机器人常用开发环境Mojuco/NVIDIA Isaac/gazebo,有 ROS2/DDS下的开发经验,,能够在Linux环境下独立进行开发和调试; 加分项:8. 有智能驾驶/机器人领域的工程落地经验者优先9. 在机器人顶会(SR/IJRR/TRO/RSS/ICRA/IROS等)或AI顶会(CVPR/NeurIPS/ICML/ICLR等)发表论文者优先 【具身运动控制算法工程师/资深/专家/TL】(深圳/上海)职位描述1.

Anker Innovations  12 days ago
Anker Innovations jobs

机器人专项-软件系统方向 深圳、上海、杭州 社招 全职 智能制造 / 工业互联网 / 工业自动化 职位描述 1.开发并优化机器人通信中间件(ROS 2/DDS),提升节点通信效率,降低延迟。2.部署大模型(VLA/LLM)到机器人端侧硬件(如NVIDIA ORIN、地平线),优化推理速度。3.设计低延迟通信接口,连接模型服务与机器人控制系统(如导航、人机交互)。4.优化系统资源调度(CPU/GPU/内存),确保实时性和稳定性。 职位要求 1.熟练掌握 C++/Python,有 Rust 经验更佳。2.熟悉 ROS 2/DDS 或 深度学习推理优化(TensorRT/ONNX Runtime)。3.了解 Linux 系统调优(内核参数、实时调度)或 模型量化部署(INT8/FP16)。4.有机器人/自动驾驶 相关开发经验者优先。 投递...

Premium Full-time Rust Linux
Anker Innovations  12 days ago
Desay SV jobs

算法模型部署优化(具身) 惠州 全职 职位描述 1. 负责自感知系统中深度学习模型的压缩/量化/优化/加速/性能评估2. 负责模型对车规级嵌入式计算平台的适配3. 负责模型在硬件平台上的推理加速4. 参与推理引擎、模型加速库和算子开发,提升模型推理效率 职位要求 1. 1.计算机/机器人/统计/自动化等相关专业,硕士及以上学历,博士优先2. C++和Python, 扎实的算法和数据结构知识3. 熟练掌握模型压缩、加速,如剪枝、量化等方面知识4. 具有Nvidia GPU及相关框架(如TensorRT等)知识和开发经验5. 有适配车规级嵌入式计算平台经验者优先6. 具有并行编程(GPU并行编程以及CPU多核并行编程)经验者优先7. 有大模型推理优化经验优先,包括并行计算、图优化、内存管理及低比特计算等技术 投递...

Premium Full-time
Desay SV  11 days ago
Desay SV jobs

MLOps工程师 - 模型部署 上海 全职 算法类 职位描述 1. 负责机器学习模型的生产化部署、上线及运维,确保模型服务的高可用性和低延迟2. 设计并实现模型训练到部署的自动化流水线(CI/CD),提升模型迭代效率3. 搭建和维护模型监控体系,实时追踪模型性能、数据漂移及业务指标4. 编写高效、可复用的Python脚本,实现数据预处理、特征工程、模型推理等流程的自动化5. 优化模型推理性能,包括模型量化、剪枝、蒸馏及GPU/CPU资源调度6. 与算法团队紧密协作,将研究成果转化为稳定、可扩展的生产系统 职位要求 1. 模型部署经验:熟悉至少一种主流模型部署框架(如NVIDIA-TensorRT, ONNX Runtime, Qualcomm QNN, Horizon OpenExplorer等),有大规模模型服务化实战经验2. Python脚本能力:精通Python编程,能够独立编写高质量、可维护的自动化脚本,熟悉常见库(FastAPI/Flask、Celery、Pandas、NumPy等)3. 熟悉容器化技术(Docker、Kubernetes),具备云原生环境(AWS/GCP/Azure/阿里云)下的ML系统搭建经验4. 了解MLOps工具链(如MLflow、Kubeflow、Airflow、DVC等),有端到端ML Pipeline构建经验5. 掌握模型版本管理、A/B测试、灰度发布等工程实践6. 具备良好的工程素养,熟悉Git、Linux、Shell脚本及基础网络知识 投递...

Premium Full-time Horizon
Desay SV  11 days ago
Desay SV jobs

AI智算平台工程师(DMC) 惠州 全职 职位描述 1.算力平台规划与建设:主导GPU集群、InfiniBand/RoCE高速网络及分布式存储的架构设计、部署与硬件调优。2.资源调度与效能提升:基于K8s/Volcano/Slurm优化调度策略,提升GPU利用率与集群整体MFU。3.算力成本与运营:建立FinOps成本模型,通过弹性伸缩与闲时资源整合,降低单位算力成本。4.智能化运维体系:构建全链路监控(Prometheus),利用AIOps实现故障预测与自动化运维。5.模型部署与推理优化:使用vLLM/Triton/TensorRT部署大模型,实施量化(INT8/FP8)、动态批处理等优化技术。6.混合云管理:维护公有云与私有云的混合云架构,确保资源统一调度与数据一致性。7.服务稳定性保障:确保在线推理服务的高可用与低延迟,设计熔断、降级、限流策略。 职位要求 一、核心要求1.技术栈深度:精通 Linux、K8s、Python/Go 自动化,熟悉 GPU 硬件与 NVIDIA 生态(CUDA、DCGM)。2.算力平台经验:3年以上云计算或AI基础设施经验,具备百卡级GPU集群的运维、调优实战经验。3.高性能网络:熟练掌握 InfiniBand/RoCE 网络配置与 NCCL 通信问题排查。4.模型工程化能力:熟悉大模型本地化部署流程,有 vLLM、TensorRT-LLM 等推理框架的生产环境优化经验。5.云原生与监控:深入理解云原生架构,能熟练搭建Prometheus/Grafana 全链路监控体系。加分项1.大规模集群经验:有千卡级别训练集群的运维优化或故障治理经验。2.国产化生态:熟悉华为昇腾、海光DCU等国产AI芯片的适配与开发生态。3.开源贡献:在 vLLM、TensorRT-LLM 等主流推理框架有代码贡献。4.前沿技术实践:对 MoE 模型、多模态大模型的端侧部署与优化有实际探索。 投递...

Desay SV  11 days ago

Subscribe for job alerts and resources to make your job search easier!

Confirmation email sent to

Check your email and click on the link to start receiving your job alerts

Receive the latest job openings for:

nvidia gpu

You also might be interested in:

Software Engineer

AI

Engineer

Computing

Architect

Solution Architect

Deep Learning

Python

Development Engineer

Eras

Confirmation email sent to

Check your email and click on the link to start receiving your job alerts

All Filters Apply
Sort by
Company
Employer/Recruiter
Experience