At Roche you can show up as yourself, embraced for the unique qualities you bring. Our culture encourages personal expression, open dialogue, and genuine connections, where you are valued, accepted and respected for who you are,
高级存储研发专家(AI 训练数据缓存加速方向) 北京 全职 互联网 / 电子 / 网游 - 研发 职位描述 1.主导设计和研发下一代分布式多级分层缓存加速系统,基于 GPU 主机本地内存、NVMe SSD、远端并行文件系统构建大容量弹性扩缩容的多级缓存架构,实现数据按需与透明加速;2.参与设计和研发百 PB 规模的分布式文件缓存系统,支撑自动驾驶、大语言模型等业务的大规模分布式 AI 训练集群;3.设计并实现智能数据放置与生命周期管理策略(如基于访问热度的分层调度、TTL/LRU 淘汰、预取优化),降低 GPU 因存储 I/O 导致的停顿;4.参与研究和落地高性能存储软硬件技术栈,如 GPU Direct Storage、NVMe-oF、RDMA、Burst Buffer 等,持续优化端到端数据通路性能;5.参与元数据管理系统设计,实现高效的路径查找和缓存机制,保证元数据访问延迟在毫秒级。 职位要求 1.本科及以上学历,5 年以上分布式存储系统、缓存系统、文件系统或相关大规模系统软件研发经验;2.熟练掌握 Rust、C/C++、Golang 中至少一种系统编程语言,具备在大型软件项目中应用AI Coding 的经验;3.深入理解分布式系统设计原理(一致性、复制、分片、容错),有
高级存储研发高级工程师(AI 训练数据缓存加速方向) 北京 全职 互联网 / 电子 / 网游 - 研发 职位描述 1.主导设计和研发下一代分布式多级分层缓存加速系统,基于 GPU 主机本地内存、NVMe SSD、远端并行文件系统构建大容量弹性扩缩容的多级缓存架构,实现数据按需与透明加速;2.参与设计和研发百 PB 规模的分布式文件缓存系统,支撑自动驾驶、大语言模型等业务的大规模分布式 AI 训练集群;3.设计并实现智能数据放置与生命周期管理策略(如基于访问热度的分层调度、TTL/LRU 淘汰、预取优化),降低 GPU 因存储 I/O 导致的停顿;4.参与研究和落地高性能存储软硬件技术栈,如 GPU Direct Storage、NVMe-oF、RDMA、Burst Buffer 等,持续优化端到端数据通路性能;5.参与元数据管理系统设计,实现高效的路径查找和缓存机制,保证元数据访问延迟在毫秒级。 职位要求 1.本科及以上学历,5 年以上分布式存储系统、缓存系统、文件系统或相关大规模系统软件研发经验;2.熟练掌握 Rust、C/C++、Golang 中至少一种系统编程语言,具备在大型软件项目中应用AI Coding 的经验;3.深入理解分布式系统设计原理(一致性、复制、分片、容错),有