运维工程师 15-25K 北京 全职 互联网 / 电子 / 网游 本科及以上 3-5 年 职位描述 岗位职责1. 负责公司业务系统的日常运维管理、部署发布和稳定性保障。2. 负责 Kubernetes 集群的部署、维护和优化,保障容器平台稳定运行。3. 建设和维护 监控、告警、日志系统(如 Prometheus/Grafana/ELK等),提升系统可观测性。4. 参与系统稳定性建设,包括服务扩容、限流、降级、故障演练、故障复盘等。5. 负责CI/CD流水线建设与优化(如 GitLab CI / Jenkins 等),提升研发交付效率。6. 编写运维自动化脚本,参与系统架构优化,推动平台工程化建设。7. 负责公司办公IT环境维护,包括办公网络、终端基础设施的管理与技术支持。 职位要求 任职要求1. 计算机相关专业本科及以上学历,3年以上应用运维经验,具备良好故障排查能力。2. 至少掌握 Python 或 Go
SummaryDo you want to help build some of the largest and most consequential enterprise and customer technology systems in the world? Join Apple’s Information Systems and Technology (IS&T) organization. IS&T is the engine behind everything Apple
AI运维工程师 北京 全职 互联网 / 电子 / 网游 职位描述 职位描述1.负责公司IDC、公有云(火山云/腾讯云等)的规划、部署、监控与优化,保障业务高可用性(SLA ≥ 99.9%);2.负责管理公司GPU集群,调配训练平台资源;3.设计并实施自动化运维体系(Ansible/Terraform/Jenkins等),提升系统部署、监控告警、故障处理效率;4.维护大规模Linux服务器集群(CentOS/Ubuntu)、Kubernetes/Docker容器平台及中间件(Nginx/MySQL/Redis等)、大规模数据存储;5.建立全链路监控体系(Zabbix/Prometheus/Grafana),实时分析系统性能瓶颈,预防潜在风险;6.制定并执行容灾备份、安全加固及合规策略,响应安全事件;7.编写运维文档及技术方案,推动DevOps文化落地; 职位要求 职位要求硬性条件:1.本科及以上学历,计算机/通信相关专业,3年以上人工智能科技公司运维经验;2.具备GPU集群管理经验,了解ROS/ROS2生态;3.精通Linux系统管理、Shell/Python脚本开发,熟悉TCP/IP、HTTP等网络协议;4.熟练使用至少一种公有云(火山云/腾讯云/阿里云),有PB级存储搭建经验,具备云资源编排及成本优化经验;5.掌握容器化技术(Docker/K8s)及CI/CD工具链(GitLab/Jenkins);6.熟悉监控日志系统(ELK/Prometheus)及自动化运维工具(Ansible/SaltStack)。加分项:1.有高并发、分布式系统运维经验者优先;2.熟悉网络安全防护(WAF/防火墙/漏洞扫描);3.持有AWS/AliCloud/K8s认证证书;4.有大模型相关基础设施搭建经验;5.了解Infrastructure as Code(IaC)实践。。 投递...
GPU服务器运维实习生 北京 校招 实习 研发 - 基础架构 2028届实习生招聘 职位描述 一、为什么加入我们 1. 直面万卡级 GPU 集群 —— 你将接触到行业最前沿的 AI 算力基础设施,日常工作围绕大规模 GPU服务器展开,积累的经验在整个行业都是稀缺的; 2. 没有技术壁垒的团队 —— 你的主线是硬件运维,但我们团队内部不设方向墙。自动化开发、监控体系、服务器交付流程、带外管理……只要你有兴趣,都可以深入参与。我们希望你在实习期间能建立对团队整体业务的全局理解,而不是只做一个方向的螺丝钉; 3. 以转正为目标的培养 —— 这个岗位不是找人来打杂的。我们的目标是培养一位能长期服务于团队整体业务的正职同学,实习期间会有体系化的带教,帮你从单点执行逐步成长为能独立负责模块的工程师; 4. 扁平高效的协作方式 —— 团队决策链路短,技术讨论开放直接,好的想法不需要层层审批就能落地。 二、我们在做什么 MiniMax 正在构建驱动下一代 AGI 的算力基础设施。我们的团队负责管理数以万计的