Refine Reset All
Sort by
Job Type
Employer/Recruiter
Date Posted
Location
Job Type
Employer/Recruiter
All Filters

Cpp Ai Jobs In Shanghai - 9 Job Positions Available

1 – 9 of 9 jobs
智元创新(上海)科技有限公司 jobs

优才-模型推理AI Infra开发工程师-中央研发部 上海、北京 正式 职位描述 1. 设计面向具身机器人本体亲和的轻量化、高性能推理框架,支持CNN、Transformer、Mamba、GNN等主流网络结构;2. 面向GPU/NPU的具身多模态算子开发与性能优化,实现内存复用、算子融合、数据排布优化、多流并行等通用加速策略;3.对模型推理过程进行时间、功耗、内存占用分析,定位瓶颈并设计软硬协同优化策略;4. 实现支持 PTQ/QAT 的量化工具链(INT8/INT4/FP8/MXFP8等浮点混合精度);5. 跟进VLA、世界模型、空间智能等最新算法架构趋势,及时洞察捕捉低精度量化、AI KernelGen、投机推理等在具身本体上的模型高效推理适配技术 职位要求 1. 熟练掌握C/C++/Python/Go至少一种编程语言,具备CUDA/OpenCL/CANN优化经验;2. 深入理解至少一种推理引擎架构(如tensorrt/vllm/sglang/ktransformer/llama-cpp)推理框架架构;3. 熟悉模型量化原理(KL 散度、MinMax、LSQ、AWQ、GPTQ等)及相关工具链;4. 熟悉常见典型算子实现与优化(卷积、矩阵乘、激活、LayerNorm、Softmax、flashattention等);5. 熟悉MLIR、IREE、Triton、TileLang等至少一中AI编译框架 投递...

智元创新(上海)科技有限公司  27 days ago
智元创新(上海)科技有限公司 jobs

模型推理AI Infra开发工程师 上海 校招 正式 技术族 - 算法类 职位 ID:A125373 职位描述 1. 设计面向具身机器人本体亲和的轻量化、高性能推理框架,支持CNN、Transformer、Mamba、GNN等主流网络结构;2. 面向GPU/NPU的具身多模态算子开发与性能优化,实现内存复用、算子融合、数据排布优化、多流并行等通用加速策略;3.对模型推理过程进行时间、功耗、内存占用分析,定位瓶颈并设计软硬协同优化策略;4. 实现支持 PTQ/QAT 的量化工具链(INT8/INT4/FP8/MXFP8等浮点混合精度);5. 跟进VLA、世界模型、空间智能等最新算法架构趋势,及时洞察捕捉低精度量化、AI KernelGen、投机推理等在具身本体上的模型高效推理适配技术; 职位要求 1. 熟练掌握C/C++/Python/Go至少一种编程语言,具备CUDA/OpenCL/CANN优化经验;2. 深入理解至少一种推理引擎架构(如tensorrt/vllm/sglang/ktransformer/llama-cpp)推理框架架构;3. 熟悉模型量化原理(KL 散度、MinMax、LSQ、AWQ、GPTQ等)及相关工具链;4. 熟悉常见典型算子实现与优化(卷积、矩阵乘、激活、LayerNorm、Softmax、flashattention等);5. 熟悉MLIR、IREE、Triton、TileLang等至少一中AI编译框架; 投递...

智元创新(上海)科技有限公司  7 days ago
NIO jobs

Super Sparks-校招-高性能AI推理平台研究员/工程师 上海、圣何塞 校招 正式 数字技术 - 算法 硕士及以上 Super Sparks 招聘计划 职位 ID:A47632 职位描述 AI 推理引擎与模型优化-在车规级 SoC(含 NPU、DSP、GPU 等异构计算单元)上进行大模型(LLM/VLM/VLA)的推理部署与极致性能调优,包括低功耗优化、模型量化(INT4/INT8)、剪枝、蒸馏、算子融合等;-针对 RTOS/Linux/QNX 等操作系统及中间件层深度优化 AI 推理引擎(如 TensorRT、ONNX Runtime、llama.cpp 等),提升端侧推理的实时性与稳定性;-参与具身智能场景下的端到端模型推理链路设计,将 VLA 大模型的推理能力高效部署到车端嵌入式平台,支撑物理世界精准闭环操作。AI 原生的车控与 SOA 场景-将 AI 推理能力原生融入车控系统、车身控制等业务场景,设计 AI 驱动的智能控制策略;-参与 SOA 架构下的 AI 原生智能服务开发,将算法模型封装为标准化的服务组件,支持多场景动态调度;-探索 AI Agent 在车控场景中的应用,实现基于大模型的智能决策与实时控制闭环。车云协同与数据智能-设计并优化车云协同 AI 推理架构,包括端侧推理与云端大模型协同调度、通信协议优化、数据传输效率与安全性保障;-参与车端数据上云后的 AI 智能分析与挖掘(如故障预测、驾驶行为分析、能耗优化等),构建数据驱动的

NIO  6 days ago
ModelBest jobs

端云协同 AI Infra 专家 / 工程师 上海 社招 全职 技术 - 基础架构 职位 ID:A41424 职位描述 1. 负责端云协同 AI 架构设计,明确云侧模型、私有化服务、边缘节点、端侧设备之间的职责边界、数据流、控制流和安全边界。2. 围绕面壁miniCPM等系列产品,面向运营商营业厅、客服坐席、现场运维、企业办公终端、边缘网关等场景,建设端云协同的数字员工能力。3. 与 Infra 团队协作,打通云侧模型服务、RAG、Workflow、权限审计、日志监控和端侧运行环境。4. 负责端侧资源约束下的性能优化,包括量化、KV Cache、批处理、缓存策略、网络降级、异构算力调度和功耗控制。5. 沉淀端云协同部署规范、设备适配清单、性能 benchmark、故障排查手册和行业交付模板。 职位要求 1. 本科及以上学历,计算机、电子信息、自动化、通信、人工智能等相关专业。2. 3 年以上端侧 AI、边缘计算、推理优化、嵌入式系统、客户端基础架构或云边端协同系统经验。3. 熟悉 C/C++、Python,了解端侧或边缘设备上的性能调优、资源管理和系统问题排查。4. 熟悉至少一种推理框架或部署工具,如 llama.cpp、ONNX Runtime、TensorRT、SGLang 等。5. 理解模型量化、剪枝、蒸馏、KV

ModelBest  1 day ago
Qualcomm jobs

Company: Qualcomm China Job Area:Sales, Business Development & Marketing Group, Sales, Business Development & Marketing Group Product Marketing - SIP General Summary: Qualcomm is a leading supplier of chipset platforms for automotive infotainment. In this role,

Qualcomm  26 days ago
智元创新(上海)科技有限公司 jobs

vla模型部署优化实习生 上海 实习 职位描述 - 参与PC和端侧AI应用的原型开发与测试,包括数据采集,标注,预处理、模型选型适配、模型训练加速、推理性能调优;- 协助团队完成基于PC和Jetson系列开发板(如Jetson Nano、Orin、Thor等)的模型训练、部署、优化工作;- 配合完成相关技术文档的撰写,如部署手册、测试报告、技术总结等;- 协助解决项目中遇到的PC端和端侧部署相关技术问题,跟进技术方案的落地验证;- 完成领导交办的其他模型部署与开发相关的辅助工作。 职位要求 - 在读本科及以上学历,计算机相关专业(计算机科学与技术、电子信息工程、自动化、人工智能等);- 具备扎实的Python/C++编程基础,了解Linux操作系统(Ubuntu优先)的基本使用;- 对模型量化,剪枝,蒸馏有一定了解的优先。- 了解深度学习基础理论,熟悉至少一种深度学习框架(PyTorch、TensorFlow等);- 对Jetson端侧部署有一定了解,熟悉TensorRT、ONNX等模型优化与转换工具者优先;-了解vla模型,熟悉cuda编程,熟悉vllm, trtllm, llama.cpp的优先- 具备良好的学习能力、问题解决能力和团队协作精神,工作积极主动,责任心强; 投递...

Premium Full-time
智元创新(上海)科技有限公司  21 days ago
智元创新(上海)科技有限公司 jobs

具身大模型推理性能优化实习生 上海 实习 职位描述 1. 参与到面向具身机器人本体亲和的轻量化、高性能推理框架模块化开发;2. 基于GPU/NPU的具身多模态算子开发与性能优化,实现内存复用、算子融合、数据排布优化、多流并行等通用加速策略; 3. 开发模型解析、转换、性能剖析、可视化profiling工具;4. 洞察算子融合、低精度量化、AI KernelGen、投机推理等在具身本体上的模型高效推理适配技术并复现开发;5. 调研VLA、世界模型、空间智能等最新算法架构趋势; 职位要求 1. 熟练掌握C/C++,具备汇编(ARM/x86)或CUDA/OpenCL优化经验;2. 深入理解至少一种推理引擎架构(如tensorrt/vllm/sglang/ktransformer/llama-cpp);3. 熟悉模型量化原理(KL 散度、MinMax、LSQ、AWQ、GPTQ 等)及相关工具链;4. 熟悉常见算子实现与优化(卷积、矩阵乘、激活、LayerNorm、Softmax 等);5. 具备端上 profiling 能力(perf、简单性能计数器、硬件事件、功耗测量); 投递...

智元创新(上海)科技有限公司  21 days ago
XPENG jobs

【27届校招】大模型端侧Infra工程师 北京、上海、广州 正式 研发 - 算法 通用智能板块 职位描述 1.负责支持小鹏VLA2.0、智能座舱、具身等新一代大模型的部署架构设计和开发,不同芯片上架构统一。2.负责新一代大模型的端侧量产部署,解决各种端侧实际部署问题。3.负责在大模型自驾芯片上的性能优化,充分挖掘芯片性能,确保大模型的端侧软件性能表现满足量产需求。4.探索未来大模型和推理芯片上的新一代的软件架构和部署方案。 职位要求 1.2027届应届毕业生,计算机科学与技术、电子工程、自动化及相关领域专业。2.熟练掌握C/C++编程、熟悉Linux操作系统、熟悉各种AI生产力工具。3.熟悉并行计算概念、熟悉一门并行编程框架(如CUDA)、有TensorRT或其他深度学习高性能推理框架的使用经验。4.熟悉各种大模型基本框架优先,有基于CPP的嵌入式芯片模型部署经验优先。5.责任心强,具备优秀的学习能力、独立分析能力和良好的团队沟通能力,有良好的工作文档习惯。 投递...

Premium Full-time
XPENG  18 days ago
NIO jobs

Super Sparks-校招-智能体原生OS研究员/工程师 上海、圣何塞 校招 正式 数字技术 - 算法 硕士及以上 Super Sparks 招聘计划 职位 ID:A211923 职位描述 职位介绍 (Position Overview)我们正在定义和构建下一代智能体原生操作系统(Agent Native OS),致力于将操作系统的核心服务对象从“传统应用”向“AI 智能体”转移。由于该前沿领域横跨底层系统架构(OS Internals)与人工智能基础设施(AI Infra)两大硬核学科。我们正在寻找在 操作系统底层 或 AI 基础设施 (MLSys) 任意一端具备深厚学术积累的顶尖博士人才。您将在我们拥有互补背景的跨学科团队中,主导前沿技术的探索与原型验证,攻坚大模型运行时调度、原生 AI 内存管理以及系统级安全隔离等底层基座难题,逐步跨界成长为下一代 Agent OS 的核心架构领军者。岗位职责 (Responsibilities)下一代智能体系统基座验证: 针对多智能体高并发与强隔离的需求,在系统架构(如基于 seL4 等微内核及其 User-mode VMM

NIO  6 days ago

Subscribe for job alerts and resources to make your job search easier!

Confirmation email sent to

Check your email and click on the link to start receiving your job alerts

Receive the latest job openings for:

cpp ai jobs in shanghai

Confirmation email sent to

Check your email and click on the link to start receiving your job alerts

All Filters Apply
Sort by
Job Type
Employer/Recruiter