Refine Reset All
Sort by
Skills
Location
Job Type
Employer/Recruiter
Date Posted
Skills
Location
Job Type
Employer/Recruiter
All Filters

CNI Jobs In China - 5 Job Positions Available

Top Cities:
1 – 5 of 5 jobs
智元创新(上海)科技有限公司 jobs

共创-云原生开发工程师-觅蜂子公司 上海 校招 正式 技术族 - 软件类 职位 ID:A250462 职位描述 觅蜂科技(Maniformer)是全球领先的一站式物理AI数据服务平台,致力于打造具身智能数据的 “平台型供给” 基础设施,实现数据的体系化、标准化、规模化供给。1.负责公司 Kubernetes 集群的规划、部署、升级、监控与高可用保障,支撑数百节点规模的生产环境;2.设计并实施安全、稳定、高效的 CI/CD 流水线,集成 GitOps(如 Argo CD)、Helm、Kustomize 等工具;3.优化集群资源利用率,通过 HPA/VPA、Cluster Autoscaler、Cost Allocation 等手段实现成本可控;4.构建可观测性体系:基于 Prometheus + Grafana + Loki + Tempo 实现日志、指标、链路追踪一体化监控;5.制定并落地 K8s 安全策略:包括 Pod

智元创新(上海)科技有限公司  20 days ago
智元创新(上海)科技有限公司 jobs

云原生研发工程师-觅蜂子公司 上海、北京 校招 正式 技术族 - 系统架构类 职位 ID:A209974 职位描述 觅蜂科技(Maniformer)是全球领先的一站式物理AI数据服务平台,致力于打造具身智能数据的 “平台型供给” 基础设施,实现数据的体系化、标准化、规模化供给。1. 负责混合云场景下基于 Kubernetes 的 Genie Studio 平台核心系统的设计、开发和维护,包括多云管理、边缘集群管理、私有化部署、资源管理、GPU 设备管理及优化、容器编排调度、运行时优化等方向中的一项或多项,持续提升平台产品的资源利用率、稳定性和易用性。2. 负责混合云场景下基于 Kubernetes 的 Genie Studio 平台基础服务的搭建、开发和维护,如:a. 网络:容器网络、RDMA、API 网关等b. 存储:分布式文件存储、对象存储等c. 边缘节点:大规模机器人节点管理、网络通信优化等d. 调度编排:训练、推理、云边联合任务、工作流等3. 与实施交付的 SRE 沟通协调,参与系统优化及问题定位,保证项目顺利部署实施。4. 跟踪云原生生态发展趋势,推动云原生 Genie

智元创新(上海)科技有限公司  20 days ago
Momenta jobs

后端开发实习生(Golang) 北京 实习 互联网 / 电子 / 网游 日常实习生 职位描述 设计并落地大规模自动驾驶仿真平台能力,面向真实业务场景和用户需求交付高效产品。基于用户优先级与任务紧急程度进行资源分配和排队策略,规划仿真调度架构与策略,提升集群计算资源利用率。 职位要求 1. 计算机基础扎实:操作系统、并发/线程模型、网络协议(TCP/HTTP);能独立识别并解决线程交互与网络异常问题。2. 精通 Golang 与 Shell,具备生产级服务开发经验与性能调优能力。3. 熟练使用 git、make,具备良好的编码规范与文档能力。4. 熟悉 Kubernetes 及容器网络(CNI/Service/Ingress/DNS 等),能够排查调度与网络故障,保障集群稳定性。5. 自动驾驶行业经验,仿真平台或任务调度相关经验优先。6. GPU/CUDA 编程经验,或有 GPU 资源调度/优化实践优先。 投递...

Momenta  20 days ago
MiniMax jobs

K8S研发工程师-集群管理方向 北京、上海 社招 全职 研发 - 基础架构 职位描述 一、一句话定位参与建设服务大模型训练、推理与在线业务的 Kubernetes 集群管理平台,用自动化和软件工程手段解决集群创建、升级、扩缩容、节点管理与稳定性问题,让大规模集群可标准化交付、可观测、可恢复。二、为什么这个岗位重要Kubernetes 是承载训练、推理和在线业务的核心基础设施,集群稳定性直接影响业务连续性与研发效率。随着集群规模和异构资源类型增长,依靠人工操作无法支撑稳定交付,需要把集群生命周期管理做成平台和控制系统。你将深入 Kubernetes 控制面、节点生命周期与集群可靠性,在真实生产环境中理解大型分布式系统如何运行和演进。三、你将负责什么1. 参与研发 K8s 集群管理平台,覆盖集群创建、配置、升级、扩缩容、巡检、回收等生命周期。2. 基于 Operator / Controller、CRD 和声明式 API 建设自动化控制能力,减少人工操作与环境差异。3. 参与 apiserver、etcd、scheduler、controller-manager、kubelet 等核心组件的稳定性、容量和性能治理。4. 建设节点接入、状态管理、故障隔离和恢复能力,并与机器 / 网络底座团队协作完成问题定界。5. 参与多集群管理、版本治理、配置一致性、变更防护和灾备演练,提升集群服务的标准化与可靠性。6. 完善集群指标、日志、事件和 SLO,沉淀自动巡检、故障诊断和恢复工具。 职位要求 四、我们期望你具备1. 计算机、软件工程或相关专业本科及以上学历,具备扎实的计算机基础。2.

MiniMax  18 days ago
Merck Group jobs

Work Your Magic with us! Ready to explore, break barriers, and discover more? We know you’ve got big plans – so do we! Our colleagues across the globe love innovating with science and technology to enrich

Merck Group  12 hours ago

Subscribe for job alerts and resources to make your job search easier!

Confirmation email sent to

Check your email and click on the link to start receiving your job alerts

Receive the latest job openings for:

cni

You also might be interested in:

Kubernetes

Confirmation email sent to

Check your email and click on the link to start receiving your job alerts

All Filters Apply
Sort by
Skills
Location
Job Type
Employer/Recruiter