AI模型部署与性能优化工程师 深圳 社招 全职 数字技术 - 芯片研发 本科及以上 3-5 年 职位描述 1. 负责将客户常见辅助驾驶算法模型(CNN,Transformer,LLM,多模态等)部署到公司大算力芯片平台,解决过程中可能涉及的算子不支持、模型规格不匹配的兼容性问题。2. 运用性能分析工具对模型进行全栈性能剖析,识别计算、内存、调度瓶颈,通过图融合、算子替换、内存优化以及其他软硬件优化技术,提升推理速度和吞吐量。3. 配合客户实施PTQ/QAT量化方案,定位并解决量化或其他过程引入的精度损失问题。4. 系统性地诊断并解决单模型部署和多模型并发场景下的稳定性问题。深入定位Core Dump / Crash的根本原因(内存越界、资源竞争等)并推动解决。5. 深入理解客户需求,提供部署、性能调优方案和建议。建设并维护车载/机器人场景 Model Zoo,输出最佳实践案例文档,降低客户使用门槛。 职位要求 1. 硕士以上学历,具备2年以上AI模型在端/边/云平台部署优化经验。有车载或机器人芯片平台项目经验者优先。2. 精通Python和C++编程,熟悉PyTorch、TensorFlow、ONNX等深度学习框架中的一种或多种。3. 熟悉TensorRT、TVM、ONNX Runtime、vLLM、llama.cpp等主流推理引擎中的一种或多种。4. 熟悉常见网络模型结构和算子,具备模型部署、算子开发和调优经验。掌握系统级别和算子级别 Debug & Profiling 实战技能,熟悉Nsight Systems、perf、Vtune等性能分析工具。5. 熟悉GPGPU或NPU等AI加速芯片硬件特性、了解AI软件栈,有软硬协同经验者优先。6. 积极主动,勇于承担, 具备良好的团队合作精神、沟通协调能力和技术推动力。
高性能计算工程师 深圳 社招 全职 职位描述 1.负责AI及传统图像、视频算法工程化2.负责各个算法在特定处理器上的极致优化,包括但不限于指令集、cache、带宽、GPU优化3.负责分析各个算法的性能瓶颈点,并与算法同事进行反馈,进一步保效提速降负载4.负责算法SDK的封装,输出到下游部门进行集成,并进行性能和效果对齐 职位要求 1.统招本科及以上学历,计算机、软件工程、通信工程、电子信息工程、自动化等专业优先2.精通计算机体系结构,精通c++,并且有3年以上的c++开发经验3.掌握simd/asm/gpu/cache等优化技巧,能熟练使用其中一种或者多种优化技术4.熟练使用intel vtune profile/perf等一种或者多种性能分析工具的优先5.熟练掌握tensorrt,openvino,onnx等推理框架开发的优先 投递...
SOC性能分析工程师/专家 上海、杭州 全职 研发 - 电子 / 半导体 职位描述 熟悉以下技能中的2项及以上:1、熟悉计算机体系结构(x86/ARM64/RISC-V)、操作系统原理、C/Python语言;2、熟悉x86/ARM64/RISC-V指令集,对开源指令社区有一定的了解;3、熟悉基本的性能分析技术、方法、与工具,如PMU/PEBS/LBR/PT、Roofline/Top-down、VTune/Perf/ebpf/DynamoRIO,有性能分析工具平台开发经验者优先;4、熟悉芯片性能仿真建模的基本原理和方法,如Qemu/NVMain/SystemC等;5、熟悉软硬件协同设计整体流程,包括需求分析、收益分析、方案设计、仿真验证等;加分项:1、对云终端、视频视觉、边缘计算或高性能计算场景有一定的了解,有相关应用的分析和优化经验;2、有参与过实际的芯片设计项目,对芯片架构和性能分析有深入了解。3、有大型SoC性能验证分析与Benchmark开发经验者。 职位要求 1、负责云终端、视频视觉、边缘计算或高性能计算场景的性能分析及优化,推进性能分析与优化工具平台的构建;2、推进自研Benchmark体系的构建,负责大型SoC性能验证方案的设计与实施;3、负责软硬协同方案的需求分析及方案设计验证,推进相关工具链的建设;4、负责大型SoC子系统或全系统性能仿真平台的构建。 投递...
C++ 软件工程师 深圳 全职 研发 - 算法 职位描述 岗位职责1. 负责运动规划软件框架搭建,日志系统开发等工作2. GPU 并行采样、批量梯度下降、约束求解等计算密集模块的工程实现与性能优化3. 维护底层数据结构(ESDF / K-D Tree / 碰撞表达等),关注 cache locality 与 SIMD 利用4. 性能 Profiling 与瓶颈分析,确保规划器满足实时性要求5. 编写高质量单元测试与 benchmark 套件,保障数值稳定性 职位要求 任职要求- 本科及以上,计算机 / 软件工程 / 数学等相关专业-
系统集成工程师 上海 全职 职位描述 工作职责:1、 负责自动驾驶算法、功能模块的集成实现、工程化改造与实车部署,开发支持跨平台(x86/arm)的统一工程链路,并确保链路可快速调试与部署。2、负责车云链路集成架构的设计、开发与迭代,优化链路时延、吞吐与稳定性,解决高并发、数据一致性等工程难题。3、负责构建稳定可靠的CI/CD流程与自动化质量体系,设计多层级的质量拦截系统与工程质量度量体系,提升团队交付效率与代码质量。4、推进工程规范、性能优化、内存与日志管理等专项工作,定位并解决系统级崩溃、性能瓶颈、线程安全等复杂问题,主导关键模块的工程重构。 职位要求 职位要求:1、具有计算机、电子信息、自动化、软件工程等相关学科本科/硕士学历。2、熟练掌握Linux开发环境,熟悉常用构建、调试与性能工具;熟练使用Git/GitLab CI等研发流程。3、扎实掌握C++编程,熟悉C++11/14/17/20标准,理解内存模型、智能指针、多线程编程,熟悉STL与现代模板编程。4、扎实掌握Python编程,熟悉多进程/多线程/协程模型,理解Python虚拟机、GIL、对象模型及内存管理机制。5、具有良好的工作态度、团队合作精神、主观能动性和沟通能力。符合以下条件者优先:1、具备高性能计算、CUDA或GPU加速相关经验;2、拥有大规模C++工程架构设计与模块化开发经验;3、熟悉JPerf、SonarQube、ASan/TSan、Perf、VTune等性能与质量工具;4、熟悉视频编解码、图像传输链路优化;5、了解LLM或多模态模型在自动驾驶中的应用;6、具有自动驾驶、机器人或实时系统项目经验。 投递...