NVIDIA is the world leader in GPU Computing. We are passionate about markets including Data centers, Gaming, Professional vision, Automotive, HPC and networking. We are well positioned as the “AI Computing Company”, and our GPUs are
Job Description SummaryWe are seeking an experienced CT Reconstruction Software Architect to lead the architecture and development of next-generation CT reconstruction platforms. The successful candidate will be responsible for defining software architecture, driving image reconstruction innovations,
【校招实习】AI Infra工程师 北京 实习 互联网 / 电子 / 网游 - 研发 千寻智能2027届校招实习招聘项目 职位描述 1、负责具身智能大模型千卡大规模训练系统性能优化及MFU优化。2、负责多模态大模型(VLM)在云端的高性能分布式推理系统设计、开发与全链路端到端部署。3、负责具身智能VLA模型在端侧的推理系统的研发和模型加速算法研究。 职位要求 1、熟悉GPU体系结构,熟练掌握CUDA/triton,熟练掌握C++或Python语言。2、深入了解PyTorch等深度学习框架的架构和运行原理,深入理解大模型训练多维并行架构,如Tensor并行、流水线并行、序列并行等。3、深入理解多模态模型结构,如ViT、DiT等,了解开源多模态大模型结构,如qwen-vl、llama等。4、熟悉至少一种主流开源推理引擎(如 vLLM、SGLang、TensorRT-LLM、Nvidia Dynamo等)的底层机制与源码魔改。5、熟悉量化、剪枝、蒸馏、投机推理、步数蒸馏等前沿推理加速及模型小型化技术方案。 投递...
Map算法实习生 - 多模态大模型和静态元素感知模型研发 广州、北京、上海 实习 职位描述 基于点云、图片、语义等多模态数据,创建高精度地图自动标注agent,包括但不限于agent搭建、强化学习、VLM model training等工作 职位要求 1. 计算机或相关专业本科以上学历;2. 熟练掌握深度学习及计算机视觉相关的基本算法;3. 熟悉agent构建逻辑,对深度学习有深入了解和工作热情;4. 优秀的编程能力,熟悉C/C++或Python;5. 有较强的独立解决问题能力,学习能力及沟通能力;若能满足如下条件的其中一个,会适当加分:1. 熟悉大模型SFT、LORA、PO类算法优先;2. 有较强的研究能力优先,如发表过第一作者CCF A类会议或期刊等论文;3. 熟悉并行计算或cuda编程,或图像处理方面经验的优先;4. 具备高精地图算法和量产地图工程实现相关开发经验;5. 具备一定的计算几何功底。 投递...
软件实习生 - 端到端模型性能优化 北京 实习 职位描述 1. 负责AI端到端模型的性能分析与优化;2. 负责CUDA算子开发与维护。 职位要求 1. 计算机或相关专业本科及以上学历;2. 扎实的软件工程能力,熟练掌握计算机基础知识;3. 有CUDA编程经验,熟悉TensorRT或其它AI加速库;4. 熟悉至少一种深度学习框架(Pytorch优先)。加分项:1. 熟练掌握CUDA编程,有CUDA优化经验;2. 有算法竞赛经历;3. 有基于TensorRT的模型优化经验;4. 有模型量化、蒸馏、剪枝等工程经验。 投递...
深圳/广州算法实习生 - 多模态感知模型 广州 实习 职位描述 1. 负责研发面向高精度静态环境感知的端到端深度学习模型,重点覆盖交通标识、车道线、路缘、静态障碍物等关键元素的检测与识别。2. 探索前沿的在线静态环境感知架构,拓展无图自动驾驶的能力边界。3. 负责算法在自动驾驶实际产品中的落地和优化提升,解决实际问题。 职位要求 1. 计算机或相关专业本科以上学历;2. 熟练掌握深度学习及计算机视觉相关的基本算法;3. 熟悉掌握基于Transformer的感知算法;4. 优秀的编程能力,熟悉C/C++或Python;5. 有较强的独立解决问题能力,学习能力及沟通能力;若能满足如下条件的其中一个,会适当加分:1. 有较强的研究能力优先,如发表过第一作者CCF A类会议或期刊等论文;2. 熟悉某种深度学习框架,如Pytorch等,对深度学习有深入的了解;3. 熟悉并行计算或cuda编程,或图像处理方面经验的优先;4. 在自动驾驶行业有实习经验;5. 能实习6个月及以上。 投递...
上海Perception - 感知算法实习生 上海 实习 职位描述 1. 开发和优化基于Camera/Lidar/Fusion的感知算法,包括但不限于检测、分割、目标跟踪和三维重建等方向。2. 设计和实现高效、可靠的算法,在各种天气和路况条件下实现准确的感知。 职位要求 1. 计算机或相关专业本科以上学历;2. 熟练掌握深度学习及计算机视觉相关的基本算法;3. 熟悉基于CNN的图像检测、跟踪、识别等算法流程;4. 优秀的编程能力,熟悉C/C++或Python;5. 有较强的独立解决问题能力,学习能力及沟通能力;若能满足如下条件的其中一个,会适当加分:1. 有较强的研究能力优先,如发表过第一作者CCF A类会议或期刊等论文;2. 熟悉某种深度学习框架,如Pytorch等,对深度学习有深入的了解;3. 熟悉并行计算或cuda编程,或图像处理方面经验的优先;4. 在自动驾驶行业有实习经验;5. 能实习6个月及以上。 投递...
算法实习生-多模态感知大模型 北京 实习 职位描述 1. 负责基于 Camera、LiDAR 及多模态融合的感知算法开发与优化,工作方向包括但不限于动态目标检测与追踪、3D occ、在线地图感知等。2. 负责研发面向高精度静态环境感知的端到端深度学习模型,重点覆盖交通信号灯(红绿灯)、交通标识、车道线、路缘、静态障碍物等关键元素的检测与识别。3. 设计端到端模型架构(如BEV感知、Transformer-based模型),实现从原始数据到结构化静态场景输出的高效映射4. 负责算法在自动驾驶实际产品中的落地和优化提升,解决实际问题。 职位要求 1. 计算机或相关专业本科以上学历;2. 熟练掌握深度学习及计算机视觉相关的基本算法;3. 熟悉基于CNN的图像检测、跟踪、识别等算法流程;4. 优秀的编程能力,熟悉C/C++或Python;5. 有较强的独立解决问题能力,学习能力及沟通能力;若能满足如下条件的其中一个,会适当加分:1. 有较强的研究能力优先,如发表过第一作者CCF A类会议或期刊等论文;2. 熟悉某种深度学习框架,如Pytorch等,对深度学习有深入的了解;3. 熟悉并行计算或cuda编程,或图像处理方面经验的优先;4. 在自动驾驶行业有实习经验;5. 能实习6个月及以上。 投递...
感知算法实习生-广州 广州 实习 职位描述 1. 负责基于相机(Camera)、激光雷达(LiDAR)及多模态融合的感知算法研发与优化,研究方向包括但不限于目标检测、语义/实例分割、目标跟踪、占据(occupancy)预测与三维重建等。2. 跟踪并探索 Gaussian Splatting、self‑supervised learning(自监督学习)等前沿技术,评估并研究其在感知与占据预测等任务中的应用,关注算法的实时性与边缘端推理性能优化。3. 探索基于 Gaussian Splatting 与自监督学习的感知能力提升方案,推动模型在实际场景中的工程化落地与性能验证。 职位要求 1. 计算机或相关专业本科以上学历;2. 熟练掌握深度学习及计算机视觉相关的基本算法;3. 熟悉基于CNN的图像检测、跟踪、识别等算法流程;4. 优秀的编程能力,熟悉C/C++或Python;5. 有较强的独立解决问题能力,学习能力及沟通能力;若能满足如下条件的其中一个,会适当加分:1. 有较强的研究能力优先,如发表过第一作者CCF A类会议或期刊等论文;2. 熟悉某种深度学习框架,如Pytorch等,对深度学习有深入的了解;3. 熟悉并行计算或cuda编程,或图像处理方面经验的优先;4. 在自动驾驶行业有实习经验;5. 能实习6个月及以上。 投递...
AIGC算法工程师 长沙、深圳 社招 全职 互联网 / 电子 / 网游 职位描述 面向AIGC领域,研发前沿的视频生成与处理算法,结合短视频、电商、品牌创意等具体业务场景,进行系统性算法设计,推动自动化剪辑、视频生成、动作迁移、语义驱动等能力落地;针对当前大模型视频生成中的痛点(如帧一致性、时空建模、长视频连贯性、跨模态对齐等),优化扩散/生成架构、设计稀疏高效推理策略,提高生成质量和响应速度;开发用于视频创作的底层算法与工具链,包括视频分镜生成、关键帧补全、文本驱动编辑(text-driven editing)、镜头分割与结构化剪辑等能力模块;持续追踪业界前沿(如Sora、Runway、Kling、Veo等),快速完成benchmark与迁移落地;深度理解视频内容生产到多渠道分发的完整链路,与产品、运营、创意团队协同,构建适配业务的AI视频引擎与应用原型。 职位要求 计算机视觉、人工智能、多模态生成或相关专业硕士及以上学历,具备视频、图像、三维方向的研究或实战经验;有电商、广告、品牌内容等业务背景者优先;精通扩散模型(Diffusion)、Transformers(ViT、TimeSformer)、Temporal U-Net、Conditioned Video Generation 等框架;熟悉Motion Module、Video Composer、Latent Consistency Models、Flow-guided Generation、ControlNet等新一代技术模块; 具备以下至少两个方向的经验优先:文本转视频(Text-to-Video)生成与控制图像序列生成与视频补全(inpainting, extrapolation)视频风格迁移/风格保持(Style Transfer / Identity Preservation)多模态驱动编辑(音频/动作/语义控制)长视频建模与镜头结构生成熟悉主流AI视频工具链,如Diffusers、ComfyUI插件体系,掌握FFmpeg、OpenCV、PyTorch等开源工具与部署环境;具备工程化建模与高性能推理经验(如CUDA优化、TensorRT加速、多线程分布式部署);熟悉视频内容生产流程,了解不同业务场景(如短视频种草、品牌TVC、电商展示、KOC内容)的创意逻辑与交付需求,具备跨团队协作能力与业务理解力;强烈的自驱力、好奇心和技术热情,愿意持续探索视频生成的边界,追求工程与算法的高融合与高价值交付。 投递...
中间件软件开发专家-具身智能 北京、上海 社招 全职 智能制造 / 工业互联网 / 工业自动化 职位描述 岗位职责:1. 负责通信与调度中间件架构与研发2. 负责端侧推理引擎与模型部署优化3. 负责系统性能分析与优化 职位要求 任职要求:1.计算机、电子信息或软件相关专业本科及以上学历;2.熟悉Linux 系统软件与驱动开发,拥有扎实大规模C/C++开发调试技能与经验;3.熟悉主流端侧AI计算平台并有相关算法部署与优化经验;4.熟悉模型端侧推理部署与优化,有TVM/TensorRT/Cuda经验优先;5.熟悉系统性能分析与优化,有大规模高性能高可靠代码设计与实现经验; 投递...
机器人智能体-模型框架算法工程师/专家 深圳、上海 社招 全职 互联网 / 电子 / 网游 职位描述 职责:负责端侧具身智能体业务模型中的:数据清洗/标注,模型架构设计与联合训练,模型部署优化一个或多个方向:1. 对多个模型进行分布式高效联合训练,解决联合训练冲突, 1. 高效的数据加载/增强策略,加速模型训练与实验迭代。 2. 优化训练Pipeline(混合精度/梯度检查点/显存优化)2. 制作联合标注训练和评测样本,根据模型功能搭建联合标注/自标注的自动化框架,支持大规模批量自动化标注和构建。3. 大规模数据闭环构建与驱动:实现基于场景挖掘、失败案例分析、主动学习的数据自动筛选、标注增强与策略迭代优化。4. 模型部署与性能优化: 1. 通过模型剪枝/蒸馏/量化等实现提升业务模型部署推理效率 2. 优化主干网络,和模型结构 3. 解决模型在端侧部署时的精度和性能问题。 4. 训练和推理的对齐 职位要求 要求:1. 人工智能、计算机、机器人、自动驾驶等相关专业硕士或博士学位2. 熟练掌握C++/Python/脚本编程,有Linux下开发经验,具备优秀的开发和调试能力;3. 熟悉Pytorch、TensorFlow等AI框架,了解TensorRT、TVM;4. 如下一个或多个方向经验 1. 有实际模型压缩、剪枝、蒸馏、量化技术等轻量化经验; 2.
AI Infra实习生(日常实习) 北京 实习 研发 - 基础架构 千寻智能2025年秋季校园招聘项目 职位描述 1、负责构建支撑具身智能体的核心机器学习系统,开发面向机器人场景的VLA大模型训练与推理系统,支撑多模态感知、运动控制、任务规划等核心能力的持续进化;2、研发新一代具身智能系统工具链,涵盖数据采集、仿真训练、物理部署、持续优化全生命周期。 职位要求 1、计算机、人工智能、软件工程等相关专业,硕士及以上学历,2026年及之后毕业; 2、熟练使用C++/Python/Pytorch/CUDA开发生态,具有嵌入式系统开发经验者优先;3、能至少保障3个月以上的实习时间,每周4天以上出勤;4、加分项:在以下一个或多个领域有深度实践: a. 大模型训练推理:多模态大模型分布式训练、端上推理加速、Transformer模型优化; b. 高性能计算:GPU Kernel编写,高性能通信(NCCL、RDMA),AI编译器(TVM、Triton),模型量化等; c. 机器人系统:ROS2、运动控制算法、传感器数据处理pipeline。 投递...
3D重建算法高级工程师(博士) Shenzhen, Hangzhou Intelligent manufacturing / Industrial Internet / Industrial automation 26届航海计划 Responsibilities 职位描述:1. 3D 重建算法研发与优化基于无人机俯视图、室内 roomtour 视频、全景相机等多视角数据,设计与实现高效的 3D重建算法,聚焦 3D Gaussian Splatting (3DGS)、多视图立体视觉 (MVS)、结构自运动 (SfM)、深度估计 (Depth Estimation) 等前沿方法的工程落地与创新2. 重建速度与点云精简优化针对大规模场景优化重建流程,提升重建速度,实现近实时或高效建模,研究并实现实时高斯重建、高斯增量更新等算法,满足在线 / 流式数据重建需求,研究点云 / 高斯模型精简策略,在有限点数下保持高保真重建3. 几何准确性与结构约束针对建筑物、房间等场景,提升直线、轮廓等几何结构特征的还原度,引入几何先验、结构约束方法,提升模型的工程可用性4. 算法调研与论文复现跟踪最新 3D
slam算法工程师 深圳 社招 全职 研发 - 算法 职位描述 岗位职责:1、负责视觉高精度三维重建相关算法预研和开发,基于传统的几何或深度学习的高精度三维重建算法,熟悉了解激光雷达三维重建应用开发;2、算法产品化推进,包括性能优化,移动端移植,熟悉高性能计算,如多线程,CUDA;3、解决项目落地中遇到的稳定性、精度等实际问题; 职位要求 任职要求:1、硕士及以上学历,计算机、电子信息、自动化等相关专业; 2、有基于单/双目对物体进行三维建模的算法开发或研究经验优先,对摄像机标定原理有深入理解,并有在线标定经验优先;3、熟练掌握三维重建、SLAM等算法知识;掌握对极约束、多视图几何、图优化等相关算法;4、熟练掌握常见开源离线三维重建框架,例如:Colmap,OpenMVS,OpenMVG等;5、熟悉了解常见开源在线三维重建框架,例如:ElasticFusion,BundleFusion,InfiniTAM,SurfelWarp 等;6、熟悉常见开源工具库,例如 Ceres、g2o、Eigen、OpenCV,Open3d 等;7、编程功底扎实,熟悉Python、C++和Linux开发环境、熟悉C/C++编程,能够独立调研、验证及测试相关算法;8、良好的解决问题能力、沟通和英文文献阅读能力; 投递...
具身智能-运动智能体 深圳、上海 社招 全职 智能制造 / 工业互联网 / 工业自动化 - 研发 职位描述 【具身端到端规划算法工程师/资深/专家/TL】(深圳/上海/北京)岗位职责:1. 负责研发基于深度学习的四足/人形等机器人的全身状态规划控制,实现灵活自然的动态环境的避障和通过2. 设计实现鲁棒高效的 感知-规划-控制 端到端方案,实现鲁棒高效精准的机器人动作规划3. 设计构建模型训练数据集和标注方法,支持大批量自动化的标注构建4. 应用模仿学习,在/离线强化学习进行模型训练提升模型性能,开发高效的模型评测方法提高迭代效率5. 解决模型评测/部署/真机测试中遇到的问题,满足项目交付指标要求6. 跟踪前沿技术方案,持续迭代升级方案 岗位要求:满足3条及以上1. 人工智能、计算机、机器人、自动驾驶、控制等相关专业硕士或博士学位2. 熟练掌握主流深度学习的时序规划方法如transformer,生成式方法 diffusion policy,掌握主流端到端架构方案如BEV-tranformer/diffusion架构。3. 熟悉基于采样/搜索/优化的决策规划算法,熟悉机器人全身控制。4. 具有模仿学习或强化学习训练经验,熟悉PPO/GRPO/DPO等5. 有实际的端到端系统开发经验,如智能驾驶的E2E。6. 熟练使用PyTorch/TensorFlow深度学习框架,熟练使用Python/C++语言编程,有实际项目开发经验7. 熟悉机器人常用开发环境Mojuco/NVIDIA Isaac/gazebo,有 ROS2/DDS下的开发经验,,能够在Linux环境下独立进行开发和调试; 加分项:8. 有智能驾驶/机器人领域的工程落地经验者优先9. 在机器人顶会(SR/IJRR/TRO/RSS/ICRA/IROS等)或AI顶会(CVPR/NeurIPS/ICML/ICLR等)发表论文者优先
机器学习势函数工程研发实习生 北京 实习 本科及以上 职位描述 1. 计算机、软件工程、人工智能、计算科学或相关专业本科及以上学历;2. 熟练使用 Python,具备 C/C++ 基础,能够阅读和调试工程代码;3. 熟悉 PyTorch及常见模型训练、测试和性能评测流程;4. 熟悉 Linux、Git及常用开发工具,能够根据日志定位和解决实验问题;5. 具备良好的代码规范、测试意识和实验复现意识;6. 了解 CUDA、Triton、GPU性能分析或分布式训练者优先;7. 有 DeePMD-kit、分子动力学、机器学习势函数或科学计算经验者优先;8. 大四即以上211,985在读优先;9. 善于独立思考,灵活使用各类AI工具。 职位要求 1. 根据既定方案配置、提交和监控机器学习势函数训练及测试任务;2. 整理实验数据与结果,完成精度、速度和资源消耗等指标的对比分析;3. 参与 DeePMD-kit 的功能开发、问题排查、单元测试和文档维护;4. 协助开展关键计算流程和算子的性能分析与优化;5. 完善实验脚本及自动化工具,保障实验流程稳定、可复现。 职位信息 部门: OpenLAM 投递...
机器人多模态算法专家 上海 全职 研发 - 算法 职位描述 1.负责VTLA模型研发与优化,视觉、触觉、语言等多模态统一表示建模。2.研究World Model、Diffusion Policy、模仿学习等机器人基础模型3.设计机器人Manupullation Primitive,并支持复杂操作任务组合4.建设机器人数据闭环、包括数据采集、自主标注、训练与评估5.与机器人控制团队协同完成模型部署与性能优化 职位要求 学历要求:硕士及以上学历(计算机、机器人、自动化、AI 相关专业)基本能力: 2 年以上机器人、多模态或具身智能研发经验。专业能力:1. 熟悉一下方向中的多个:Transformer、CLIP、SigLIP 等对比学习模型、多模态学习(Vision-Touch)、Diffusion Policy、IL/RL2. 熟悉 至少一种机器人基础模型:OpenVLA、SmolVLA、π0、Groot3. 熟练掌握 Python、PyTorch、CUDA 、Linux 等;4. 具备车载Haptic、力控传感器、机器人控制相关嵌入式开发经验者优先,熟悉传感器数据采集、滤波、校准算法落地;5. 参与过机器人数据采集、Sim2Real、模型部署流程、有开源项目贡献的优先。 投递...
NVIDIA is looking for a talented Performance Research and Analysis Engineer to join our Performance group. The ideal candidate will profile and analyze AI workloads on large GPUs and CPUs scale clusters for distributed Deep Learning
高性能计算工程师-Genie业务部 北京、上海 校招 正式 技术族 - 算法类 职位 ID:A200131 职位描述 负责 HPC 核心算法设计开发,优化 CPU/GPU/ASIC 多芯片性能,追求极致吞吐量与延迟;对接业务场景,定位并解决计算性能瓶颈,提升业务运行效率;参与异构计算集群的构建,推进异构计算方案落地与迭代。 职位要求 有高性能计算(HPC)或 AI 优化加速相关工作经验;精通 CUDA 生态,熟悉编译流程,深入理解 GPU 架构、内存模型及并行计算原理,具备扎实的 CUDA 编程功底,能独立编写、调试并优化 CUDA Kernel;熟练使用 Triton、CUTLASS 等工具,有基于这些工具进行算子开发、模型加速的实战经验;理解 PyTorch/TensorFlow 等 AI 框架及常见 AI 模型(VLA, LLM等);熟悉Nsys, NCU 等性能分析工具,能精准定位并解决 GPU