优才-模型推理AI Infra开发工程师-中央研发部 上海、北京 正式 职位描述 1. 设计面向具身机器人本体亲和的轻量化、高性能推理框架,支持CNN、Transformer、Mamba、GNN等主流网络结构;2. 面向GPU/NPU的具身多模态算子开发与性能优化,实现内存复用、算子融合、数据排布优化、多流并行等通用加速策略;3.对模型推理过程进行时间、功耗、内存占用分析,定位瓶颈并设计软硬协同优化策略;4. 实现支持 PTQ/QAT 的量化工具链(INT8/INT4/FP8/MXFP8等浮点混合精度);5. 跟进VLA、世界模型、空间智能等最新算法架构趋势,及时洞察捕捉低精度量化、AI KernelGen、投机推理等在具身本体上的模型高效推理适配技术 职位要求 1. 熟练掌握C/C++/Python/Go至少一种编程语言,具备CUDA/OpenCL/CANN优化经验;2. 深入理解至少一种推理引擎架构(如tensorrt/vllm/sglang/ktransformer/llama-cpp)推理框架架构;3. 熟悉模型量化原理(KL 散度、MinMax、LSQ、AWQ、GPTQ等)及相关工具链;4. 熟悉常见典型算子实现与优化(卷积、矩阵乘、激活、LayerNorm、Softmax、flashattention等);5. 熟悉MLIR、IREE、Triton、TileLang等至少一中AI编译框架 投递...
Company: Qualcomm China Job Area:Sales, Business Development & Marketing Group, Sales, Business Development & Marketing Group Product Marketing - SIP General Summary: Qualcomm is a leading supplier of chipset platforms for automotive infotainment. In this role,
vla模型部署优化实习生 上海 实习 职位描述 - 参与PC和端侧AI应用的原型开发与测试,包括数据采集,标注,预处理、模型选型适配、模型训练加速、推理性能调优;- 协助团队完成基于PC和Jetson系列开发板(如Jetson Nano、Orin、Thor等)的模型训练、部署、优化工作;- 配合完成相关技术文档的撰写,如部署手册、测试报告、技术总结等;- 协助解决项目中遇到的PC端和端侧部署相关技术问题,跟进技术方案的落地验证;- 完成领导交办的其他模型部署与开发相关的辅助工作。 职位要求 - 在读本科及以上学历,计算机相关专业(计算机科学与技术、电子信息工程、自动化、人工智能等);- 具备扎实的Python/C++编程基础,了解Linux操作系统(Ubuntu优先)的基本使用;- 对模型量化,剪枝,蒸馏有一定了解的优先。- 了解深度学习基础理论,熟悉至少一种深度学习框架(PyTorch、TensorFlow等);- 对Jetson端侧部署有一定了解,熟悉TensorRT、ONNX等模型优化与转换工具者优先;-了解vla模型,熟悉cuda编程,熟悉vllm, trtllm, llama.cpp的优先- 具备良好的学习能力、问题解决能力和团队协作精神,工作积极主动,责任心强; 投递...
具身大模型推理性能优化实习生 上海 实习 职位描述 1. 参与到面向具身机器人本体亲和的轻量化、高性能推理框架模块化开发;2. 基于GPU/NPU的具身多模态算子开发与性能优化,实现内存复用、算子融合、数据排布优化、多流并行等通用加速策略; 3. 开发模型解析、转换、性能剖析、可视化profiling工具;4. 洞察算子融合、低精度量化、AI KernelGen、投机推理等在具身本体上的模型高效推理适配技术并复现开发;5. 调研VLA、世界模型、空间智能等最新算法架构趋势; 职位要求 1. 熟练掌握C/C++,具备汇编(ARM/x86)或CUDA/OpenCL优化经验;2. 深入理解至少一种推理引擎架构(如tensorrt/vllm/sglang/ktransformer/llama-cpp);3. 熟悉模型量化原理(KL 散度、MinMax、LSQ、AWQ、GPTQ 等)及相关工具链;4. 熟悉常见算子实现与优化(卷积、矩阵乘、激活、LayerNorm、Softmax 等);5. 具备端上 profiling 能力(perf、简单性能计数器、硬件事件、功耗测量); 投递...
【27届校招】大模型端侧Infra工程师 北京、上海、广州 正式 研发 - 算法 通用智能板块 职位描述 1.负责支持小鹏VLA2.0、智能座舱、具身等新一代大模型的部署架构设计和开发,不同芯片上架构统一。2.负责新一代大模型的端侧量产部署,解决各种端侧实际部署问题。3.负责在大模型自驾芯片上的性能优化,充分挖掘芯片性能,确保大模型的端侧软件性能表现满足量产需求。4.探索未来大模型和推理芯片上的新一代的软件架构和部署方案。 职位要求 1.2027届应届毕业生,计算机科学与技术、电子工程、自动化及相关领域专业。2.熟练掌握C/C++编程、熟悉Linux操作系统、熟悉各种AI生产力工具。3.熟悉并行计算概念、熟悉一门并行编程框架(如CUDA)、有TensorRT或其他深度学习高性能推理框架的使用经验。4.熟悉各种大模型基本框架优先,有基于CPP的嵌入式芯片模型部署经验优先。5.责任心强,具备优秀的学习能力、独立分析能力和良好的团队沟通能力,有良好的工作文档习惯。 投递...
高级广告销售经理(亚欧) 上海 社招 全职 互联网 / 电子 / 网游 职位描述 1.客户开发与维护负责传音旗下媒体资源(如TECNO/Infinix/itel手机预装App、Eagllwin、品牌广告等)的广告销售,客户类型包括:电商平台/DTC电商、支付公司、游戏、社交、工具类应用开发者快消品、电信、金融等行业品牌。挖掘潜在客户需求,制定定制化广告方案(CPP、CPM、CPCCPA等)。2.业绩目标达成。完成季度/年度广告销售指标,管理客户从签约到回款的全流程。3.市场洞察与策略分析本地市场广告需求(如非洲斋月、南亚排灯节等节点),制定行业解决方案。监测竞品动态(其他手机厂商的广告政策),优化传音广告产品品竞争力4跨部门协作与产品、运营、设计团队协作,推动广告资源优化。 职位要求 1.基本要求本科及以上学历,2年以上互联网广告销售经验(程序化广告、效果广告优先)熟悉中国出海业务和新兴市场,能适应出差。英语流利。2.技能要求熟悉移动广告生态。擅长客户谈判,具备大客户管理能力(如年框合约)。数据敏感,能分析投放数据和整理结案报告。优先条件手机厂商广告销售经验。 投递...
间接采购技术员 上海 全职 智能制造 / 工业互联网 / 工业自动化 职位描述 日常采购执行 (40%)- 负责激光雷达委外试验类采购订单的发起、跟踪与关闭。- 维护采购主数据(物料、BOM、供应商、价格)。- 处理发票匹配、付款流程异常等日常事务。- 高效协同研发工程师、品质工程师及 NPI 项目经理,确保按时交付。 供应商管理 (30%)- 协助完成委外试验供应商的寻源、评估与引入。- 维护供应商档案、资质证书及年度评估记录。- 推动供应商绩效评估(QCD:质量、成本、交付)。- 配合优化合格供应商名录(AVL)。 商务谈判与成本管控 (20%)- 独立完成中小额( 50 万)项目的议价。- 制定并跟踪年度降价目标的达成。- 参与框架协议、价格协议的谈判。- 推动试验费用标准化、套餐化采购。 流程优化与跨部门协作 (10%)- 梳理委外试验采购流程,提升端到端效率。- 推动电子化采购平台的使用。- 对接质量部门处理供应商质量问题。-
模型推理AI Infra开发工程师 上海 校招 正式 技术族 - 算法类 职位 ID:A125373 职位描述 1. 设计面向具身机器人本体亲和的轻量化、高性能推理框架,支持CNN、Transformer、Mamba、GNN等主流网络结构;2. 面向GPU/NPU的具身多模态算子开发与性能优化,实现内存复用、算子融合、数据排布优化、多流并行等通用加速策略;3.对模型推理过程进行时间、功耗、内存占用分析,定位瓶颈并设计软硬协同优化策略;4. 实现支持 PTQ/QAT 的量化工具链(INT8/INT4/FP8/MXFP8等浮点混合精度);5. 跟进VLA、世界模型、空间智能等最新算法架构趋势,及时洞察捕捉低精度量化、AI KernelGen、投机推理等在具身本体上的模型高效推理适配技术; 职位要求 1. 熟练掌握C/C++/Python/Go至少一种编程语言,具备CUDA/OpenCL/CANN优化经验;2. 深入理解至少一种推理引擎架构(如tensorrt/vllm/sglang/ktransformer/llama-cpp)推理框架架构;3. 熟悉模型量化原理(KL 散度、MinMax、LSQ、AWQ、GPTQ等)及相关工具链;4. 熟悉常见典型算子实现与优化(卷积、矩阵乘、激活、LayerNorm、Softmax、flashattention等);5. 熟悉MLIR、IREE、Triton、TileLang等至少一中AI编译框架; 投递...
Super Sparks-校招-高性能AI推理平台研究员/工程师 上海、圣何塞 校招 正式 数字技术 - 算法 硕士及以上 Super Sparks 招聘计划 职位 ID:A47632 职位描述 AI 推理引擎与模型优化-在车规级 SoC(含 NPU、DSP、GPU 等异构计算单元)上进行大模型(LLM/VLM/VLA)的推理部署与极致性能调优,包括低功耗优化、模型量化(INT4/INT8)、剪枝、蒸馏、算子融合等;-针对 RTOS/Linux/QNX 等操作系统及中间件层深度优化 AI 推理引擎(如 TensorRT、ONNX Runtime、llama.cpp 等),提升端侧推理的实时性与稳定性;-参与具身智能场景下的端到端模型推理链路设计,将 VLA 大模型的推理能力高效部署到车端嵌入式平台,支撑物理世界精准闭环操作。AI 原生的车控与 SOA 场景-将 AI 推理能力原生融入车控系统、车身控制等业务场景,设计 AI 驱动的智能控制策略;-参与 SOA
Super Sparks-校招-智能体原生OS研究员/工程师 上海、圣何塞 校招 正式 数字技术 - 算法 硕士及以上 Super Sparks 招聘计划 职位 ID:A211923 职位描述 职位介绍 (Position Overview)我们正在定义和构建下一代智能体原生操作系统(Agent Native OS),致力于将操作系统的核心服务对象从“传统应用”向“AI 智能体”转移。由于该前沿领域横跨底层系统架构(OS Internals)与人工智能基础设施(AI Infra)两大硬核学科。我们正在寻找在 操作系统底层 或 AI 基础设施 (MLSys) 任意一端具备深厚学术积累的顶尖博士人才。您将在我们拥有互补背景的跨学科团队中,主导前沿技术的探索与原型验证,攻坚大模型运行时调度、原生 AI 内存管理以及系统级安全隔离等底层基座难题,逐步跨界成长为下一代 Agent OS 的核心架构领军者。岗位职责 (Responsibilities)下一代智能体系统基座验证: 针对多智能体高并发与强隔离的需求,在系统架构(如基于