NVIDIA, a world-class technology company, is looking for an exceptional and ambitious individual to join our team as a Product Engineer. This role offers a unique opportunity to be part of a company that has revolutionized
At Cadence, we hire and develop leaders and innovators who want to make an impact on the world of technology. # About the role We build the finite-element engine behind our electrothermal and thermomechanical simulation products
2027校招-算子开发工程师(上海/北京/成都) 上海、北京、成都 校招 正式 职位描述 岗位职责- 负责公司自研 AI 加速芯片上的 算子库设计与实现,覆盖训练与推理核心算子(如 GEMM/Conv/Attention/LayerNorm/Softmax/Reduce/Scatter-Gather 等)。- 基于芯片计算单元、片上存储(SRAM/Cache)、HBM 带宽、NoC 拓扑、DMA/异步拷贝能力,进行 算子性能建模与瓶颈分析(roofline、访存/计算比、流水并行),制定优化策略。- 设计并落地 kernel 调度与 tiling 策略:多级分块、数据布局(layout/packing)、向量化/张量化、双缓冲/多缓冲、算子融合(fusion)等。- 建设算子库工程化体系:算子接口规范、版本管理、性能回归、单测/对齐验证、精度与数值稳定性、跨平台兼容- 参与端到端模型性能优化:对接 PyTorch/TensorFlow/ONNX Runtime 等前端(或公司自研框架),完成算子覆盖、性能调优和线上问题定位(profiling/trace)。 职位要求 (优秀应届可放宽)。- 计算机/电子/自动化/数学等相关专业;- 熟悉深度学习常见算子与数值实现(GEMM/Conv/Attention/Norm/Reduce),理解训练/推理的差异(激活、梯度、混合精度、量化)。- 扎实的 C/C++ 能力,良好的工程习惯;能熟练使用性能分析工具(profiling、trace、perf、火焰图或自研工具)。- 熟悉至少一种加速器编程模型或并行体系(CUDA/OpenCL/ROCm/Metal/TVM/Triton/oneDNN/CUTLASS 等)并能迁移到自研 ISA/Runtime。- 具备系统级性能意识:理解存储层次、带宽/延迟、cache/预取、NUMA、DMA、并行同步等,对算子优化有方法论。加分项-
新业务部-芯片验证工程师(高速接口方向) 上海、西安 社招 全职 职位 ID:G9016 职位描述 1. 负责高速接口子系统(DDR/LPDDR/HBM/USB/PCIE/MIPI等)从方案制订到验证交付、回片测试支持的全流程;2. 制定接口验证计划及策略,搭建验证环境,提取验证特性,完成覆盖率收敛;3. 参与接口验证相关工具和脚本开发,提升验证自动化水平和效率;4. 与芯片设计、系统软件团队协同,确保接口子系统验证质量和回片支撑;5. 跟踪高速接口技术演进(如LPDDR5X/HBM3E/USB4/PCIE5.0等)及AI芯片对接口带宽的需求,输出验证技术规划; 职位要求 1. 微电子/计算机等相关专业,硕士3年+/本科4年+验证经验;2. 有流片经验,熟悉芯片开发/验证流程和EDA工具;3. 熟悉UVM等主流验证方法学;4. 熟悉DDR/LPDDR/GDDR/HBM等一种或多种内存接口协议;5. 有内存接口IP验证经验者优先;6. 有SoC内存子系统集成验证经验或了解AI芯片对HBM带宽需求者优先。 投递...