硬件专家 上海 全职 研发 - 硬件开发 职位描述 硬件专家1、负责域控制器平台硬件需求开发,相关域控控制器的硬件功能定义,负责完成硬件架构设计;2、负责调研/跟踪域控制器硬件产品主流技术路线,完成域控制器硬件平台的技术路线设定;3、负责竞品benchmark,产品技术降本方案研究;4、负责供应商的对接和沟通;5、负责域控制器平台硬件需求开发,相关域控控制器的硬件功能定义,负责完成硬件架构设计;6、负责域控制器信号链路设计,核心芯片选型;7、负责域控制器系统级功能安全、DFMEA设计;8、负责域控制器网络方案、传感器接入、电源管理等方案设计和对接;9、负责硬件系统调试和核心问题组织解决;10、负责硬件架构相关文档和标准的撰写;11、负责供应商的对接和沟通。 职位要求 职位要求1、大学本科及以上学历,电子/电气,自动化,仪器仪表,通信,计算机,车辆工程等相关专业 ;2、至少8年服务器电子系统设计相关经验,5年以上AI服务器开发经验 ;3、精通主流高端SOC的设计,包括英伟达,高通、AMD等 ;4、有高速信号和大功率电源设计经验优先;5、强有力的自驱力,责任心和团队合作精神。 投递...
Sr. Manager, Future Computing Prototyping Studio Description - The Opportunity HP is creating a Shanghai-based Future Computing Prototyping Studio to make the next generation of personal computing tangible on real HP hardware. We are seeking a
Overview Rambus, a premier chip and silicon IP provider making data faster and safer, is seeking to hire an Principal FAE in China. In this role, you will be working with some of the brightest inventors
NVIDIA is looking for a talented Performance Research and Analysis Engineer to join our Performance group. The ideal candidate will profile and analyze AI workloads on large GPUs and CPUs scale clusters for distributed Deep Learning
大模型infra工程师 (VLM训练) 北京 全职 互联网 / 电子 / 网游 职位描述 负责支撑百亿/千亿级 VLM 从零开始的预训练。直面万卡级集群的通信瓶颈与显存墙,深入分布式训练内核,从第一性原理出发设计并落地业界领先的并行策略与通信调度方案。1. 分布式并行架构设计与演进:主导设计并持续优化 4D 并行(DP/PP/TP/CP)策略。深入理解并落地 DeepEP、Dual Pipe、ZeRO 等核心机制,在多机多卡环境下实现通信与计算的高度重叠,逼近集群线性加速比。2. 集群通信效率极致优化:从拓扑亲和性与通信原语调度层面,对分布式训练中的集体通信模式进行深度调优。通过计算通信重叠、通信分组优化等手段,将集群通信效率逼近硬件带宽上限。3. 显存与算力利用率的极致压榨:围绕 MFU(Model FLOPS Utilization) 和显存利用率两大核心指标,持续进行系统级调优。结合 Context Parallelism 等并行策略,在多卡环境下实现显存、带宽、算力三者之间的最优平衡。4. 训练稳定性与全链路 Profiling:建立系统级性能看护体系,通过端到端 Profiling 精准定位慢节点、通信拥塞及负载不均等系统性瓶颈。从集群调度、存储 I/O 到计算图执行进行全链路分析,保障数月级长稳训练及故障快速恢复。 职位要求 1.
Locations: Shenzhen, China Categories: Sales / Marketing Req ID: 89626 WHAT YOU DO AT AMD CHANGES EVERYTHING At AMD, our mission is to build great products that accelerate next-generation computing experiences—from AI and data centers, to PCs, gaming