Refine Reset All
Sort by
Company
Location
Job Type
Employer/Recruiter
Experience
Date Posted
Company
Job Title
Location
Job Type
Employer/Recruiter
Experience
All Filters

Cache Jobs In China - 69 Job Positions Available

Top Cities:
1 – 20 of 69 jobs
Coupang jobs

Please complete the attached Internal TransferRequest Formand submit. Please make sure to apply with your Coupang e-mail address. Company Introduction We exist to wow our customers. We know we’re doing the right thing when we hear

Coupang  29 days ago
XSKY Data Technology jobs

AI推理部署工程师 深圳 全职 销售 - 销售支持 职位描述 1、推理服务部署运维:负责GPU服务器、AI算力集群环境部署调试,管理NVIDIA驱动/CUDA/NCCL/容器工具链版本兼容;基于 vLLM / SGLang / LMCache搭建推理服务,部署 Qwen / DeepSeek / GLM / MiniMax 等主流大模型(单机/多节点),支持私有化内网交付。2、推理性能优化:评测 TTFT、TPOT、吞吐量、显存占用等指标;设计 TP/PP/DP/EP 并行方案;围绕 KV cache、量化(FP16/BF16/FP8/AWQ/GPTQ/GGUF/INT4/INT8)、长上下文、MoE 路由等方向,持续优化推理吞吐与延迟。3、工程化交付:完成从裸机环境到模型API的完整交付链路;将推理系统部署进客户受控内网;协同网络工程师调试 NCCL 跨节点通信。4、文档与监控:输出部署文档、API手册、测试报告、故障复盘;搭建 Prometheus/Grafana 监控体系,实现异常告警与自动恢复。 职位要求 必备条件:1、计算机、AI 等相关专业,本科及以上,2年以上 GPU 服务器 /

XSKY Data Technology  28 days ago
北京思朗科技有限责任公司 jobs

2027校招-NPU/GPGPU验证工程师(北京/西安/上海) 北京、西安、上海 校招 正式 职位描述 岗位职责1. 聚焦自研高端NPU/GPGPU算力内核,负责张量计算阵列、指令调度、并行流水线、片上缓存、访存控制、算力调度等核心模块的全流程验证,深度参与芯片从研发、仿真迭代到流片量产的完整过程;2. 基于UVM验证方法论,搭建标准化、可复用的内核验证平台,依据模块规格书设计常规功能、边界场景、异常场景测试方案,独立开发测试用例、激励序列及参考模型;3. 负责功能仿真、波形分析、日志排查,精准定位RTL功能Bug,跟进问题迭代修复,完成问题闭环;主导代码覆盖率、功能覆盖率收集与收敛,保障验证完备性;4. 学习并维护芯片仿真编译、自动化回归测试流程,协助团队优化VCS仿真脚本、验证测试流程;配合团队完成日常版本迭代、回归测试及功能验收工作,保障芯片研发迭代高效有序推进,助力项目顺利交付。 职位要求 任职要求1. 本科、硕士应届生、微电子、集成电路、电子信息、计算机、自动化等相关专业,认同芯片行业发展,愿意长期深耕IC验证赛道;2. 熟练掌握Verilog/SystemVerilog语法,精通时序逻辑、状态机、流水线等数字电路核心原理;了解UVM验证体系,熟悉Testbench搭建、激励生成、覆盖率收敛等核心验证流程;3. 熟悉Linux开发环境,掌握基础命令操作;了解Shell、Python脚本编写,可独立完成简单仿真脚本优化、批量回归任务优先;4. 逻辑思维清晰,具备较强的问题分析和Debug排查能力,工作细心严谨、主动性强,具备良好的团队协作能力;5. 拥有NPU/GPU/AI加速器/处理器内核相关项目、课设、竞赛或科研经历;熟练使用VCS、Verdi工具,有独立搭建UVM验证环境经验;熟悉脉动阵列、张量计算、指令流水线、Cache、片上总线等算力芯片架构者优先。 投递...

Premium Full-time
北京思朗科技有限责任公司  25 days ago
北京思朗科技有限责任公司 jobs

2027校招-模拟器开发工程师(北京/西安) 北京、西安 校招 正式 职位描述 岗位职责负责模拟器内核模块的开发。 职位要求 任职要求1. 全日制本科及以上学历,计算机科学与技术、软件工程、电子信息工程、自动化等相关专业;2. 基础知识:具备计算机体系结构相关知识;3. 编程语言:精通 C/C++,具备编写Python/shell脚本的能力,具备扎实的编程基础;4. 仿真技术:了解常用的仿真原理和技术,有相关仿真框架(如 QEMU、Gem5、 GPGPU-Sim 等)使用或二次开发经验者优先;具有Cache相关开源模型预研或开发经验者优先;​5. 开发工具:了解 Git、SVN 等版本控制工具,具备良好的代码调试和问题排查能力;​6. 通信协议:了解 TCP/IP等常用通信协议,具备协议仿真开发经验者优先。 投递...

Premium Full-time
北京思朗科技有限责任公司  25 days ago
北京思朗科技有限责任公司 jobs

2027校招-推理框架工程师(上海/成都/北京) 北京、上海、成都 校招 正式 职位描述 分布式推理系统开发1、设计并实现大规模AI模型(如LLM、多模态模型)的分布式推理框架,优化吞吐量(Throughput)和延迟(Latency)。2、开发模型并行(Tensor/Pipeline Parallelism)、动态批处理(Dynamic Batching)和连续批处理(Continuous Batching)策略。3、解决多节点、多GPU环境下的负载均衡和通信瓶颈问题。4、优化计算图执行(如使用TensorRT、ONNX Runtime、vLLM等工具)。5、实现量化(FP8/INT8)、KV Cache优化、Flash Attention等加速技术。 职位要求 精通 Python/C++,熟悉PyTorch/TensorFlow推理生态。深入理解分布式系统(NCCL/RPC通信、GPU Direct RDMA)和 并行计算(CUDA、OpenMP)。熟悉推理加速技术(量化、剪枝、算子融合)和框架(TensorRT、vLLM 、Sglang)。 投递...

Premium Full-time
北京思朗科技有限责任公司  25 days ago
北京思朗科技有限责任公司 jobs

2027校招-算子开发工程师(上海/北京/成都) 上海、北京、成都 校招 正式 职位描述 岗位职责- 负责公司自研 AI 加速芯片上的 算子库设计与实现,覆盖训练与推理核心算子(如 GEMM/Conv/Attention/LayerNorm/Softmax/Reduce/Scatter-Gather 等)。- 基于芯片计算单元、片上存储(SRAM/Cache)、HBM 带宽、NoC 拓扑、DMA/异步拷贝能力,进行 算子性能建模与瓶颈分析(roofline、访存/计算比、流水并行),制定优化策略。- 设计并落地 kernel 调度与 tiling 策略:多级分块、数据布局(layout/packing)、向量化/张量化、双缓冲/多缓冲、算子融合(fusion)等。- 建设算子库工程化体系:算子接口规范、版本管理、性能回归、单测/对齐验证、精度与数值稳定性、跨平台兼容- 参与端到端模型性能优化:对接 PyTorch/TensorFlow/ONNX Runtime 等前端(或公司自研框架),完成算子覆盖、性能调优和线上问题定位(profiling/trace)。 职位要求 (优秀应届可放宽)。- 计算机/电子/自动化/数学等相关专业;- 熟悉深度学习常见算子与数值实现(GEMM/Conv/Attention/Norm/Reduce),理解训练/推理的差异(激活、梯度、混合精度、量化)。- 扎实的 C/C++ 能力,良好的工程习惯;能熟练使用性能分析工具(profiling、trace、perf、火焰图或自研工具)。- 熟悉至少一种加速器编程模型或并行体系(CUDA/OpenCL/ROCm/Metal/TVM/Triton/oneDNN/CUTLASS 等)并能迁移到自研 ISA/Runtime。- 具备系统级性能意识:理解存储层次、带宽/延迟、cache/预取、NUMA、DMA、并行同步等,对算子优化有方法论。加分项- 有自研芯片/FPGA/NPU/GPU

北京思朗科技有限责任公司  25 days ago
Automatically Get Matched to cache Jobs Let our AI agent search and match you to the best jobs from across the web
Try it now
HSBC Group jobs

Some careers have more impact than others. If you’re looking for a career where you can make a real impression, join HSBC and discover how valued you’ll be. We are currently seeking an experienced professional to

HSBC Group  25 days ago
AMD jobs

Locations: Shanghai, China Categories: Engineering Req ID: 89499 WHAT YOU DO AT AMD CHANGES EVERYTHING At AMD, our mission is to build great products that accelerate next-generation computing experiences—from AI and data centers, to PCs, gaming

AMD  23 days ago
NIO jobs

SoC性能架构与建模工程师 上海、合肥 社招 全职 工程技术 本科及以上 工作年限不限 职位描述 岗位概述参与高性能智能辅助驾驶 SoC 的性能建模、架构分析与性能优化。通过 Cycle-Accurate / Transaction-Level 性能模型,对 CPU、NPU、NoC/总线互联、Cache/SLC、DDR 及典型 workload 进行端到端分析,识别系统瓶颈,为芯片的性能规格、互联架构、存储层次及关键微架构参数提供量化决策依据。模型是手段,架构决策是目标。核心职责使用 C++ / Python 搭建和维护 SoC 级性能模型,对 NoC/总线、Cache/SLC、DDR 等关键模块进行参数化建模。分析典型 AI / 智能辅助驾驶 workload 的计算、访存和通信特征,开展 trace 采集、回放及性能分析。分析带宽、延迟、Outstanding、Queue、Cache 命中率、DDR 效率及 NoC 拥塞等关键指标,定位系统性能瓶颈。参与 NoC

NIO  18 days ago
NIO jobs

芯片设计工程师(总线) 合肥、上海 社招 全职 数字技术 - 芯片研发 本科及以上 3-5 年 职位描述 岗位职责● 负责SoC芯片片上总线与互联子系统的微架构设计与RTL实现,涵盖从架构方案到流片交付的全流程● 参与片上网络的拓扑定义、路由策略设计与流控机制实现,满足多核/多子系统的互联需求● 负责Cache一致性协议的微架构设计与实现,如:Snoop Filter、 一致性域划分与跨域互联方案、DVM● 完成总线的性能分析与调优,包括带宽、延迟、Outstanding等关键指标的优化● 编写设计文档,配合验证团队完成功能验证与覆盖率收敛● 协同前端综合、后端实现团队完成时序收敛与物理约束对接● 跟踪行业前沿技术与竞品方案,参与下一代总线架构的预研与规划 职位要求 基本要求● 硕士及以上学历,微电子、集成电路工程、计算机体系结构、电子工程等相关专业● 1-5年数字IC前端设计经验,具有总线/互联/NoC/Cache子系统相关项目经历● 熟练掌握Verilog/SystemVerilog,具备独立完成模块级RTL设计与调试的能力● 深入理解ARM AMBA协议体系,至少精通AXI4协议,对CHI协议有实际项目经验者优先● 熟悉Cache一致性原理,理解Snoop、Directory等一致性维护机制● 熟悉数字电路设计方法学,具备良好的时序意识与面积/功耗/性能权衡能力加分项● 有完整SoC芯片流片经验,参与过从定义到Tapeout的全流程● 具备NoC设计经验,了解主流NoC IP(如Arteris FlexNoC)的架构与应用● 有CHI协议实际开发或集成经验,了解CHI Issue B/E等演进方向● 了解UALink、CXL等新兴互联协议者优先 投递...

Premium Full-time
NIO  18 days ago
HSBC Group jobs

Some careers have more impact than others. If you’re looking for a career where you can make a real impression, join HSBC and discover how valued you’ll be. We are currently seeking an experienced professional to

HSBC Group  17 days ago
ModelBest jobs

端侧全模态大模型工程专家 北京、上海、深圳 社招 全职 技术 - 基础架构 职位 ID:A133605 职位描述 1. 端侧语言模型 / 多模态模型 / 全模态模型推理部署;2. 深入全模态模型双工异步工作流推理开发与优化;3. 模型量化、KV Cache 管理与投机推理加速;4. 分析硬件性能调优与内存管理;5. 跟进主流芯片厂商技术栈演进; 职位要求 1. 了解主流模型架构,包括 Transformer 系列、LLaMA、Qwen、Whisper 等,能分析其计算与内存特点;2. 熟悉TensorRT,了解llama.cpp、vllm、sglang框架;3. 有Orin平台开发经验;4. 了解投机采样(Eagle2/Eagle3/MTP)等推理加速思路,能够分析其对端侧延迟、内存和工程复杂度的影响;5. 精通 C/C++/python;6. 具备 异步多线程计算、内存管理优化 实战经验;7. 熟悉

ModelBest  17 days ago
ModelBest jobs

大模型算法工程师-智能体方向 急招 北京、上海、成都 社招 全职 技术 - 算法 职位 ID:A22865 职位描述 1. 端到端智能系统构建与优化:覆盖意图识别、多轮对话改写、知识检索、内容生成与用户偏好对齐全链路,持续提升交互质量与系统稳定性;2. Agent Harness 设计与建设:设计并实现稳定可扩展的智能体运行框架(Agent Harness),负责工具调用编排、上下文与记忆管理、执行循环控制、错误恢复与重试、沙箱化执行环境等核心能力,为上层 Agent 提供可靠的运行底座;3. Agent 能力与范式演进:实现具备任务规划、工具调用、自我反思能力的 Agent;探索规划执行、反思迭代等范式的工程落地,以及多 Agent 协作机制在复杂任务分解中的应用;推动 Agent 长程任务执行的稳定性与可观测性建设;4. 垂直领域大模型应用落地:参与教育等场景对话式 AI 产品的全流程研发,探索长上下文、结构化推理与多模态能力在真实业务中的创新应用;5. 模型能力与评测体系:结合业务数据开展指令微调、偏好对齐及 Prompt 工程;推动 Agent 轨迹(trajectory)评测、工具调用成功率、端到端任务完成率等指标体系建设,构建覆盖准确性、可靠性与安全性的自动化评测框架。 职位要求 1.

ModelBest  17 days ago
RoboScience jobs

云端训推优化负责人 北京、深圳 全职 智能制造 / 工业互联网 / 工业自动化 职位描述 负责云端训练与推理优化团队整体建设和管理,对模型训推效率负责;负责大模型、VLM / VLA、机器人模型等训练任务的性能优化,包括:训练吞吐、GPU 利用率、Tensor Core 利用率、显存利用率、多机多卡扩展效率负责分布式训练优化,包括 Data Parallel、Tensor Parallel、Pipeline Parallel、FSDP / ZeRO 等方案设计与落地;负责模型推理优化,包括算子优化、KV Cache、Batching、量化、并行推理及服务化性能优化;针对模型结构和训练流程进行 Profiling,定位通信、计算、显存、IO 等性能瓶颈,并推动系统性优化;负责训练/推理框架和基础组件建设,沉淀可复用的性能优化能力;与模型算法团队协作,在保证模型效果的前提下优化模型结构、训练策略和推理方案;与智算平台团队协作,提升 GPU 集群整体资源利用率,降低单位训练与推理成本;建立训推性能指标体系和 Benchmark,持续跟踪不同模型、硬件和框架下的性能表现。 职位要求 5 年以上深度学习系统、训练加速、推理优化、AI Infra 或相关工作经验,有团队管理经验;熟悉 PyTorch 及主流深度学习训练框架,理解计算图、Autograd、CUDA 执行模型;熟悉大规模分布式训练,有 NCCL、FSDP、DeepSpeed、Megatron-LM

RoboScience  16 days ago
ZF Friedrichshafen AG jobs

Req ID 90929 | Shanghai, China, Capri (Shanghai) Automobile Technology Co., Ltd. About the Team This position is part of ZF’s ADAS & HPC business, which is entering an exciting new phase of growth and transformation

ZF Friedrichshafen AG  16 days ago
Nvidia jobs

We are looking for a GPU C++ Modeling Engineer intern – Performance/Functional Modeling, Validation and Analysis of Shader. TPC arch team is a fast-growing team which welcomes all level engineers to join. Our aim is to

Nvidia  15 days ago
Nvidia jobs

NVIDIA is leading company of AI computing. At NVIDIA, our employees are passionate about AI, HPC , VISUAL, GAMING. Our SA team is more focusing to bring NVIDIA new technology into difference industries. We help to

Nvidia  15 days ago
Nvidia jobs

NVIDIA are seeking dynamic Solution Architects with specialized expertise in training Large Language Models (LLMs), implementing RAG workflows, and agentic inference. You will leverage the full NVIDIA software & hardware ecosystem to design, optimize, and deliver

Nvidia  15 days ago
Nvidia jobs

NVIDIA are seeking dynamic Solution Architects with specialized expertise in training Large Language Models (LLMs), implementing RAG workflows, and agentic inference. You will leverage the full NVIDIA software & hardware ecosystem to design, optimize, and deliver

Nvidia  15 days ago
Nvidia jobs

NVIDIA’s Solution Architect team is looking for an AI-focused Solutions Architect specializing in Agentic AI inference. We work with the most advanced computing hardware and software, driving the latest breakthroughs in artificial intelligence. As AI applications

Nvidia  15 days ago

Subscribe for job alerts and resources to make your job search easier!

Confirmation email sent to

Check your email and click on the link to start receiving your job alerts

Receive the latest job openings for:

cache

You also might be interested in:

Engineer

AI

Solution Architect

Machine Learning

Software Engineering

Deep Learning

C++

Python

Kernel

Computing

Confirmation email sent to

Check your email and click on the link to start receiving your job alerts

All Filters Apply
Sort by
Company
Location
Job Type
Employer/Recruiter
Experience