优才-模型推理AI Infra开发工程师-中央研发部 上海、北京 正式 职位描述 1. 设计面向具身机器人本体亲和的轻量化、高性能推理框架,支持CNN、Transformer、Mamba、GNN等主流网络结构;2. 面向GPU/NPU的具身多模态算子开发与性能优化,实现内存复用、算子融合、数据排布优化、多流并行等通用加速策略;3.对模型推理过程进行时间、功耗、内存占用分析,定位瓶颈并设计软硬协同优化策略;4. 实现支持 PTQ/QAT 的量化工具链(INT8/INT4/FP8/MXFP8等浮点混合精度);5. 跟进VLA、世界模型、空间智能等最新算法架构趋势,及时洞察捕捉低精度量化、AI KernelGen、投机推理等在具身本体上的模型高效推理适配技术 职位要求 1. 熟练掌握C/C++/Python/Go至少一种编程语言,具备CUDA/OpenCL/CANN优化经验;2. 深入理解至少一种推理引擎架构(如tensorrt/vllm/sglang/ktransformer/llama-cpp)推理框架架构;3. 熟悉模型量化原理(KL 散度、MinMax、LSQ、AWQ、GPTQ等)及相关工具链;4. 熟悉常见典型算子实现与优化(卷积、矩阵乘、激活、LayerNorm、Softmax、flashattention等);5. 熟悉MLIR、IREE、Triton、TileLang等至少一中AI编译框架 投递...
模型推理AI Infra开发工程师 上海 校招 正式 技术族 - 算法类 职位 ID:A125373 职位描述 1. 设计面向具身机器人本体亲和的轻量化、高性能推理框架,支持CNN、Transformer、Mamba、GNN等主流网络结构;2. 面向GPU/NPU的具身多模态算子开发与性能优化,实现内存复用、算子融合、数据排布优化、多流并行等通用加速策略;3.对模型推理过程进行时间、功耗、内存占用分析,定位瓶颈并设计软硬协同优化策略;4. 实现支持 PTQ/QAT 的量化工具链(INT8/INT4/FP8/MXFP8等浮点混合精度);5. 跟进VLA、世界模型、空间智能等最新算法架构趋势,及时洞察捕捉低精度量化、AI KernelGen、投机推理等在具身本体上的模型高效推理适配技术; 职位要求 1. 熟练掌握C/C++/Python/Go至少一种编程语言,具备CUDA/OpenCL/CANN优化经验;2. 深入理解至少一种推理引擎架构(如tensorrt/vllm/sglang/ktransformer/llama-cpp)推理框架架构;3. 熟悉模型量化原理(KL 散度、MinMax、LSQ、AWQ、GPTQ等)及相关工具链;4. 熟悉常见典型算子实现与优化(卷积、矩阵乘、激活、LayerNorm、Softmax、flashattention等);5. 熟悉MLIR、IREE、Triton、TileLang等至少一中AI编译框架; 投递...
Super Sparks-校招-高性能AI推理平台研究员/工程师 上海、圣何塞 校招 正式 数字技术 - 算法 硕士及以上 Super Sparks 招聘计划 职位 ID:A47632 职位描述 AI 推理引擎与模型优化-在车规级 SoC(含 NPU、DSP、GPU 等异构计算单元)上进行大模型(LLM/VLM/VLA)的推理部署与极致性能调优,包括低功耗优化、模型量化(INT4/INT8)、剪枝、蒸馏、算子融合等;-针对 RTOS/Linux/QNX 等操作系统及中间件层深度优化 AI 推理引擎(如 TensorRT、ONNX Runtime、llama.cpp 等),提升端侧推理的实时性与稳定性;-参与具身智能场景下的端到端模型推理链路设计,将 VLA 大模型的推理能力高效部署到车端嵌入式平台,支撑物理世界精准闭环操作。AI 原生的车控与 SOA 场景-将 AI 推理能力原生融入车控系统、车身控制等业务场景,设计 AI 驱动的智能控制策略;-参与 SOA 架构下的 AI 原生智能服务开发,将算法模型封装为标准化的服务组件,支持多场景动态调度;-探索 AI Agent 在车控场景中的应用,实现基于大模型的智能决策与实时控制闭环。车云协同与数据智能-设计并优化车云协同 AI 推理架构,包括端侧推理与云端大模型协同调度、通信协议优化、数据传输效率与安全性保障;-参与车端数据上云后的 AI 智能分析与挖掘(如故障预测、驾驶行为分析、能耗优化等),构建数据驱动的
端云协同 AI Infra 专家 / 工程师 上海 社招 全职 技术 - 基础架构 职位 ID:A41424 职位描述 1. 负责端云协同 AI 架构设计,明确云侧模型、私有化服务、边缘节点、端侧设备之间的职责边界、数据流、控制流和安全边界。2. 围绕面壁miniCPM等系列产品,面向运营商营业厅、客服坐席、现场运维、企业办公终端、边缘网关等场景,建设端云协同的数字员工能力。3. 与 Infra 团队协作,打通云侧模型服务、RAG、Workflow、权限审计、日志监控和端侧运行环境。4. 负责端侧资源约束下的性能优化,包括量化、KV Cache、批处理、缓存策略、网络降级、异构算力调度和功耗控制。5. 沉淀端云协同部署规范、设备适配清单、性能 benchmark、故障排查手册和行业交付模板。 职位要求 1. 本科及以上学历,计算机、电子信息、自动化、通信、人工智能等相关专业。2. 3 年以上端侧 AI、边缘计算、推理优化、嵌入式系统、客户端基础架构或云边端协同系统经验。3. 熟悉 C/C++、Python,了解端侧或边缘设备上的性能调优、资源管理和系统问题排查。4. 熟悉至少一种推理框架或部署工具,如 llama.cpp、ONNX Runtime、TensorRT、SGLang 等。5. 理解模型量化、剪枝、蒸馏、KV
Company: Qualcomm China Job Area:Sales, Business Development & Marketing Group, Sales, Business Development & Marketing Group Product Marketing - SIP General Summary: Qualcomm is a leading supplier of chipset platforms for automotive infotainment. In this role,
vla模型部署优化实习生 上海 实习 职位描述 - 参与PC和端侧AI应用的原型开发与测试,包括数据采集,标注,预处理、模型选型适配、模型训练加速、推理性能调优;- 协助团队完成基于PC和Jetson系列开发板(如Jetson Nano、Orin、Thor等)的模型训练、部署、优化工作;- 配合完成相关技术文档的撰写,如部署手册、测试报告、技术总结等;- 协助解决项目中遇到的PC端和端侧部署相关技术问题,跟进技术方案的落地验证;- 完成领导交办的其他模型部署与开发相关的辅助工作。 职位要求 - 在读本科及以上学历,计算机相关专业(计算机科学与技术、电子信息工程、自动化、人工智能等);- 具备扎实的Python/C++编程基础,了解Linux操作系统(Ubuntu优先)的基本使用;- 对模型量化,剪枝,蒸馏有一定了解的优先。- 了解深度学习基础理论,熟悉至少一种深度学习框架(PyTorch、TensorFlow等);- 对Jetson端侧部署有一定了解,熟悉TensorRT、ONNX等模型优化与转换工具者优先;-了解vla模型,熟悉cuda编程,熟悉vllm, trtllm, llama.cpp的优先- 具备良好的学习能力、问题解决能力和团队协作精神,工作积极主动,责任心强; 投递...
具身大模型推理性能优化实习生 上海 实习 职位描述 1. 参与到面向具身机器人本体亲和的轻量化、高性能推理框架模块化开发;2. 基于GPU/NPU的具身多模态算子开发与性能优化,实现内存复用、算子融合、数据排布优化、多流并行等通用加速策略; 3. 开发模型解析、转换、性能剖析、可视化profiling工具;4. 洞察算子融合、低精度量化、AI KernelGen、投机推理等在具身本体上的模型高效推理适配技术并复现开发;5. 调研VLA、世界模型、空间智能等最新算法架构趋势; 职位要求 1. 熟练掌握C/C++,具备汇编(ARM/x86)或CUDA/OpenCL优化经验;2. 深入理解至少一种推理引擎架构(如tensorrt/vllm/sglang/ktransformer/llama-cpp);3. 熟悉模型量化原理(KL 散度、MinMax、LSQ、AWQ、GPTQ 等)及相关工具链;4. 熟悉常见算子实现与优化(卷积、矩阵乘、激活、LayerNorm、Softmax 等);5. 具备端上 profiling 能力(perf、简单性能计数器、硬件事件、功耗测量); 投递...
【27届校招】大模型端侧Infra工程师 北京、上海、广州 正式 研发 - 算法 通用智能板块 职位描述 1.负责支持小鹏VLA2.0、智能座舱、具身等新一代大模型的部署架构设计和开发,不同芯片上架构统一。2.负责新一代大模型的端侧量产部署,解决各种端侧实际部署问题。3.负责在大模型自驾芯片上的性能优化,充分挖掘芯片性能,确保大模型的端侧软件性能表现满足量产需求。4.探索未来大模型和推理芯片上的新一代的软件架构和部署方案。 职位要求 1.2027届应届毕业生,计算机科学与技术、电子工程、自动化及相关领域专业。2.熟练掌握C/C++编程、熟悉Linux操作系统、熟悉各种AI生产力工具。3.熟悉并行计算概念、熟悉一门并行编程框架(如CUDA)、有TensorRT或其他深度学习高性能推理框架的使用经验。4.熟悉各种大模型基本框架优先,有基于CPP的嵌入式芯片模型部署经验优先。5.责任心强,具备优秀的学习能力、独立分析能力和良好的团队沟通能力,有良好的工作文档习惯。 投递...
Super Sparks-校招-智能体原生OS研究员/工程师 上海、圣何塞 校招 正式 数字技术 - 算法 硕士及以上 Super Sparks 招聘计划 职位 ID:A211923 职位描述 职位介绍 (Position Overview)我们正在定义和构建下一代智能体原生操作系统(Agent Native OS),致力于将操作系统的核心服务对象从“传统应用”向“AI 智能体”转移。由于该前沿领域横跨底层系统架构(OS Internals)与人工智能基础设施(AI Infra)两大硬核学科。我们正在寻找在 操作系统底层 或 AI 基础设施 (MLSys) 任意一端具备深厚学术积累的顶尖博士人才。您将在我们拥有互补背景的跨学科团队中,主导前沿技术的探索与原型验证,攻坚大模型运行时调度、原生 AI 内存管理以及系统级安全隔离等底层基座难题,逐步跨界成长为下一代 Agent OS 的核心架构领军者。岗位职责 (Responsibilities)下一代智能体系统基座验证: 针对多智能体高并发与强隔离的需求,在系统架构(如基于 seL4 等微内核及其 User-mode VMM