2027校招-GPU驱动软件工程师(北京/上海/成都) 北京、上海、成都 校招 正式 职位描述 负责GPU驱动开发,包括UMD、KMD、FW驱动开发 职位要求 1. 计算机,电子工程,通信或相关专业,本科及以上2. 有嵌入式驱动开发经验3. 熟悉C/C++4. 熟悉操作系统架构(Linux/Unix)5. 了解设备驱动开发,如内存管理, 任务调度等, 有GPU驱动经验尤佳6. 有cuda/hip/opencl/vulkan/opengl/directx等AI驱动或图形驱动开发经验是加分项 投递...
Company: Qualcomm China Job Area:Engineering Group, Engineering Group Software Engineering General Summary: Interested in enabling next generation graphics, games, ray tracing, machine learning, image and video processing, even Mars drones? In the GPU Developer Tools team, you
A key part of NVIDIAs strength is our sophisticated development tools and modelling environments that enable our incredible pace of delivering new technology to market. We are looking for forward-thinking, hard-working, and creative people to join
NVIDIA is the world leader in GPU Computing. We are passionate about markets including Data centers, Gaming, Professional vision, Automotive, HPC and networking. We are well positioned as the “AI Computing Company”, and our GPUs are the
NVIDIA is the world leader in GPU Computing. We are passionate about markets including Data centers, Gaming, Professional vision, Automotive, HPC and networking. We are well positioned as the “AI Computing Company”, and our GPUs are the
NVIDIA has been defining computer graphics, PC gaming, and accelerated computing for more than 25 years. With an outstanding legacy of innovation, driven by phenomenal technology, and extraordinary people, NVIDIA is looking for a strong technical
At NVIDIA, we build groundbreaking products for the following sectors: Deep Learning, High Performance Computing, Gaming, VR, and Automotive. See your efforts in action as developers use your tools to debug, profile and analyze the performance
NVIDIA has been transforming computer graphics, PC gaming, and accelerated computing for more than 25 years. It’s a unique legacy of innovation that’s fueled by great technology—and amazing people. Today, we’re tapping into the unlimited potential
NVIDIA is the world leader in GPU Computing. We are passionate about four markets: Gaming, Automotive, Enterprise Graphics and HPC/Cloud Datacenters; in addition to our traditional OEM business. We are well positioned as the ‘AI Computing Company’,
NVIDIA is the world leader in GPU Computing. We are passionate about four markets: Gaming, Automotive, Enterprise Graphics, and HPC/Cloud Datacenters, in addition to our traditional OEM business. We are well positioned as the AI Computing Company,
By submitting your resume, you’re expressing interest in one of our 2027 GPU Architecture Engineer – New College Grad roles. We’ll review resumes on an ongoing basis, and a recruiter may reach out if your experience fits
NVIDIA is the world leader in GPU Computing. We are passionate about markets including Data centers, Gaming, Professional vision, Automotive, HPC and networking. We are well positioned as the “AI Computing Company”, and our GPUs are the
NVIDIA has continuously reinvented itself over two decades. NVIDIA’s invention of the GPU in 1999 sparked the growth of the PC gaming market, redefined modern computer graphics, and revolutionized parallel computing. More recently, GPU deep learning ignited modern
AI院-推理Infra工程师(量化算法研究/推理框架优化/GPU优化) 北京、上海 全职 互联网 / 电子 / 网游 职位描述 【方向一】量化算法研究员-职位描述通过前沿的模型量化、压缩与推理加速技术,显著降低大语言模型及多模态模型的存储占用与计算成本,推动 LLM 的大规模部署。-工作内容1、研发及改进 PTQ(训练后量化)、QAT(量化感知训练)、混合精度量化等核心算法,针对LLM/VLM(大语言模型/视觉语言模型)设计定制化量化方案,持续优化模型精度与推理效率的平衡;2、探索并实践低比特量化(如INT8/INT4/FP8/FP4)、权重稀疏化、知识蒸馏等协同压缩技术,提升压缩率同时控制精度损失;3、开发及优化量化工具链,完成对 GLM 系列模型的转换、量化校准及部署集成;4、 跟踪学术界与工业界前沿量化技术,通过论文复现、实验对比推动技术迭代。-职位要求1、计算机科学、电子工程、数学等相关专业硕士及以上学历,3 年以上模型量化或推理加速经验;或优秀本科生具备扎实项目履历;2、深入理解 Transformer 架构及 LLM 推理流程,精通 Python,熟悉常见的开源 LLM 推理框架(sglang/vllm/trtllm 等);3、掌握量化原理(校准策略、量化粒度、误差分析)及主流算法(如GPTQ、AWQ);4、具有 CUDA/Triton 编程经验,能自主实现高性能算子或优化内核计算加分。【方向二】推理框架优化工程师-职位描述1、高性能算子开发与优化:负责AI模型(尤其是大语言模型及多模态模型)在GPU上的核心算子(Kernel)的设计、开发与极致性能优化,支撑训练和推理场景的高效运行。2、性能分析与调优:深入分析GPU应用程序的性能瓶颈,通过优化内存访问模式、线程调度、执行效率等手段,显著提升计算密集型任务的吞吐量和降低延迟。3、技术集成与应用:研究并应用业界前沿的优化技术(如模型量化QAT/PTQ、算子融合、动态形状支持、FlashAttention等),并将其集成至推理/训练引擎。-职位要求1、编程能力:具备3年及以上GPU编程与高性能计算优化经验,深入理解GPU架构、并行计算原理、计算机体系结构,具备高性能计算内核的开发与优化经验。2、精通C/C++,具备扎实的编程基础、良好的编程风格和丰富的调试经验;熟练掌握Python;熟悉Linux开发环境。3、性能优化经验:能够熟练使用Nsight Compute、Nsight Systems等GPU性能分析工具,有实际的性能优化案例和成果,能独立定位和解决复杂的性能问题。4、算法基础:熟悉基础数学函数、线性代数、矩阵运算、数值计算等数学库相关算法,了解深度学习常见算子的计算方式。【方向三】GPU优化工程师-职位描述利用对 cuda 生态软件和底层体系结构的了解,帮助团队优化训练和推理的计算效率。-工作内容1、高性能算子开发与优化:负责AI模型(尤其是大语言模型及多模态模型)在GPU上的核心算子(Kernel)的设计、开发与极致性能优化,支撑训练和推理场景的高效运行。2、性能分析与调优:深入分析GPU应用程序的性能瓶颈,通过优化内存访问模式、线程调度、执行效率、多流并行协同等手段,显著提升计算密集型任务的吞吐量和降低延迟。3、技术选型:对 GPU 领域相关的 DSL/编译器(例如 triton/cuteDSL/tilelang)等进行尝试和了解,确定团队内的 DSL/编译器的技术选型,为未来的迭代做好技术储备。-职位要求1、编程能力:具备3年及以上GPU编程与高性能计算优化经验,深入理解GPU架构、并行计算原理、计算机体系结构,具备高性能计算内核的开发与优化经验。2、精通C/C++,具备扎实的编程基础、良好的编程风格和丰富的调试经验;熟练掌握Python;熟悉Linux开发环境。3、性能优化经验:能够熟练使用Nsight Compute、Nsight Systems等GPU性能分析工具,有实际的性能优化案例和成果,能独立定位和解决复杂的性能问题。4、算法基础:熟悉基础数学函数、线性代数、矩阵运算、数值计算等数学库相关算法,了解深度学习常见算子的计算方式。 职位要求 - 投递...
AI Infra 工程师 北京 技术 - 算法 本科及以上 职位描述 1、负责大模型推理框架的开发与优化,包括算子优化、显存/KV Cache 管理优化、分布式加速等技术方向; 2、参与高并发场景下的推理性能分析与瓶颈定位,推动改进方案落地; 3、探索低资源下的轻量化推理方案:量化、投机采样、Sparse Attention 等; 4、参与 Disaggregated Serving / PD 分离等新型推理架构的设计与实现; 5、与算法、业务团队协作,推动优化技术在业务中的规模化应用。 职位要求 1、计算机、人工智能、软件工程等相关专业本科及以上; 2、熟悉大模型推理优化方法,对主流开源推理框架(TensorRT-LLM、vLLM、SGLang 等)有开发或深度使用经验; 3、精通 Python/C++ 编程,有 CUDA 开发及 GPU 调优经验者优先; 4、具备良好的系统性能分析能力,熟悉 nsight/nvidia-smi/py-spy 等分析工具者优先。加分项:1、有国产 GPU(如昇腾、昆仑、PPU等)适配与优化经验;2、有 Mooncake
C++开发工程师 上海 正式 软件类 职位描述 1、负责Kosmo Pipeline PC端客户端的核心架构设计与开发2、实现SceneFeasibilityChecker(本地硬件扫描+输入分析+资源估算)3、开发AlgoConfigAdapter,实现算法参数根据硬件自动适配4、实现运行中VRAM/RAM动态控制、OOM捕获与自动降级链5、开发本地与云端协同功能:一键上传、断点续传、任务状态同步6、设计PC端统一任务面板,支持本地和云端任务进度实时查看 职位要求 1、C++客户端开发经验,熟悉Qt或Electron跨平台框架2、熟悉GPU资源监控(nvidia-smi、NVML API),有CUDA程序调试经验3、熟悉Python与C++混合开发,了解PyTorch模型推理部署4、有跨平台桌面应用(Windows/Linux/macOS)开发经验加分项:1、有三维重建/计算机视觉领域PC端工具开发经验2、熟悉FFmpeg、OpenCV等多媒体处理库3、有大型文件断点续传、P2P传输开发经验4、了解3DGS、NeRF等生成式3D技术 投递...
具身大模型加速优化工程师-深圳/上海 深圳 校招 正式 智能制造 / 工业互联网 / 工业自动化 职位描述 你将参与:1. 模型架构设计与模型训练方向2. - 多模型分布式训练的研发工作,在导师指导下解决训练过程中的基础冲突问题3. - 高效数据加载与数据增强策略的设计工作,共同优化模型训练与实验迭代效率4. - 参与优化全流程训练 Pipeline ,参与混合精度、梯度检查点、显存优化等方案的落地实践,提升训练吞吐量与资源利用率5. 数据工程与研发效能体系建设方向6. - 参与完成联合训练、评测样本的制作,参与联合标注 / 自标注自动化框架的搭建工作,支撑数据集的规模化构建7. - 参与大规模数据闭环驱动体系的搭建工作,参与完成场景挖掘、失败案例分析、主动学习相关的数据自动筛选、标注增强与策略迭代优化工作8. - 参与研发数据全流程研发效能工具,包括 process agent 、数据处理性能工具、端侧性能 / 精度分析工具等,支撑标注、数据流转、样本生成等全流程自动化,提升数据研发全链路效率9. 模型部署与性能优化方向10. -
表征算法研究员 北京 全职 博士及以上 职位描述 1. 负责开展表征算法模拟数值优化工作,运用先进算法和模型,不断提升模拟计算的准确性和效率;2. 进行各类复杂的计算任务,为物理研究和项目推进提供精确的数据支持;3. 参与并主导基于原子物理和分子动力学结合先进表征的相关研究课题,深入探索微观世界的物理规律;4. 优化电镜成像模拟算法,提升模拟精度和计算效率。 职位要求 1. 物理学相关领域专业的博士学历,具备扎实的计算能力;2. 精通编程,如 Python、Fortran、C++、CUDA 等编程语言,熟悉GPU加速,可编写大型的计算程序;3. 对原子物理有深入的理解和研究,熟悉相关理论和实验方法;4. 精通第一性原理计算方法和软件,掌握分子动力学基本原理,能够运用分子动力学模拟软件进行相关模拟和分析。5. 有散射物理、高性能计算、并行计算经验者优先。 职位信息 部门: 表征 投递...
AI推理引擎/模型部署实习生 北京、深圳、上海 校招 实习 智能制造 / 工业互联网 / 工业自动化 职位描述 安克实习生项目是面向正式校招岗位的人才培养与选拔通道。实习期间将按照校招标准进行系统的培养与综合评估,表现优秀者可直接获得校招转正机会,提前锁定正式校招席位。我们以严肃、长期的视角对待每一位实习生,也期待与你共同成长。【你将参与】1.参与 AI 模型在 CPU / GPU / NPU / DSP 等异构计算平台上的部署与推理优化工作;2.参与模型从 PyTorch / ONNX 等训练框架到端侧推理引擎的转换、编译、部署及调试;3.参与推理引擎的算子适配、算子性能优化、内存管理及数据传输优化;4.参与模型 FP32 / FP16 / INT8 等量化与精度验证,分析模型精度、性能及资源占用;5.参与端侧推理性能分析,包括 Latency、FPS、CPU/GPU/NPU利用率、内存、DDR带宽等指标;6.参与机器人感知、VLM/LLM等 AI 模型的端侧部署及工程化落地;7.配合完成推理引擎、Runtime、异构资源调度等相关基础软件开发与问题定位。 职位要求 任职要求1.计算机、软件工程、自动化、电子信息等相关专业,本科及以上学历;2.熟悉 C/C++ 或
AI推理引擎开发工程师(上海) 上海 算法类 硕士及以上 2027届算法人才专项招聘 职位描述 1、主导端侧AI推理引擎的架构设计与研发开发工作,支撑各类深度学习模型、大模型在嵌入式及车载端侧平台的高效落地部署。2、负责Qwen、DeepSeek、Llama等主流大模型的端侧全链路推理加速优化,落地量化压缩、算子加速、投机采样、动态批处理、运行时调度等核心加速技术。3、深入研究TensorRT、vLLM、llama.cpp、SGLang等主流推理引擎底层机制,结合业务需求完成框架二次开发、定制改造与性能专项优化。4、基于CUDA、HVX等硬件加速能力,完成异构计算资源的统筹调度与深度榨取,持续提升端侧大模型推理速度、降低延时与显存占用。5、输出标准化的推理引擎架构设计文档、性能分析报告、端侧部署方案,保障引擎迭代规范、可落地、可复用。 职位要求 1、硕士及以上学历,计算机、人工智能、电子信息、自动化、软件工程等相关专业,基础理论扎实。2、精通C/C++、Python编程语言,深入理解计算机体系结构,熟悉CPU、GPU、NPU硬件特性,具备跨平台推理调度与计算加速开发能力。3、熟悉TensorRT、vLLM、llama.cpp、SGLang等至少一种推理引擎底层原理,具备推理引擎定制开发、改造优化实战经验。4、熟练掌握大模型端侧推理加速核心技术,熟悉INT4/INT8量化、KV Cache优化、动态批处理、投机采样等主流优化方案。5、具备扎实的CUDA编程与GPU性能优化能力,了解DSP(HVX)、NPU开发技术者优先。6、具备优秀的工程实践、问题攻坚与技术沉淀能力,学习能力强,善于跟进端侧大模型前沿技术,具备良好的团队协作与技术落地推进能力。 职位信息 招聘数量: 3 投递...