系统运维工程师 北京 全职 金融 - 互联网金融 职位描述 保障生产环境系统网络的高可用性,确保业务稳定运作,迅速定位并解决故障。设计与开发自动化运维工具,推进运维工作的标准化、流程化与自动化,减少人工干预,降低误操作风险,提升运维工作效率。依据业务需求和技术发展趋势,设计具备高可靠性与可扩展性的系统网络架构方案,并持续优化现有架构以支持业务增长。评估系统性能和运行状态,建立量化指标,以数据为导向优化架构,提高资源利用率,降低成本。搭建运维管理平台,推动基础设施即代码和DevOps实践的实施。 具备强烈的责任心、自我驱动力强,关注细节,追求卓越。 职位要求 具备五年以上运维/DevOps工作经验,其中至少两年以上架构设计或运维开发经验,计算机相关专业者优先;熟练掌握Python、Shell,熟悉Django/Flask等框架,能够独立开发运维工具;熟练掌握Linux系统管理,熟悉内核调优、性能分析、安全加固等工作;熟练掌握虚拟化(KVM/VMware)、Docker、Kubernetes,具备大规模容器化集群管理经验;能够熟练运用负载均衡技术(HAProxy、Nginx、Keepalived、Pacemaker);具备两年网络维护经验。熟悉主流厂商路由器、交换机、防火墙配置,熟悉公有云网络相关服务。具备较强的排错能力,可以通过抓包分析定位业务问题。拥有高并发低时延系统网络架构设计经验,有开源社区贡献经验者优先;熟悉阿里云、华为云或者AWS 等云平台各类产品使用和维护管理工作优先。 投递...
AI运维工程师 北京 全职 互联网 / 电子 / 网游 职位描述 职位描述1.负责公司IDC、公有云(火山云/腾讯云等)的规划、部署、监控与优化,保障业务高可用性(SLA ≥ 99.9%);2.负责管理公司GPU集群,调配训练平台资源;3.设计并实施自动化运维体系(Ansible/Terraform/Jenkins等),提升系统部署、监控告警、故障处理效率;4.维护大规模Linux服务器集群(CentOS/Ubuntu)、Kubernetes/Docker容器平台及中间件(Nginx/MySQL/Redis等)、大规模数据存储;5.建立全链路监控体系(Zabbix/Prometheus/Grafana),实时分析系统性能瓶颈,预防潜在风险;6.制定并执行容灾备份、安全加固及合规策略,响应安全事件;7.编写运维文档及技术方案,推动DevOps文化落地; 职位要求 职位要求硬性条件:1.本科及以上学历,计算机/通信相关专业,3年以上人工智能科技公司运维经验;2.具备GPU集群管理经验,了解ROS/ROS2生态;3.精通Linux系统管理、Shell/Python脚本开发,熟悉TCP/IP、HTTP等网络协议;4.熟练使用至少一种公有云(火山云/腾讯云/阿里云),有PB级存储搭建经验,具备云资源编排及成本优化经验;5.掌握容器化技术(Docker/K8s)及CI/CD工具链(GitLab/Jenkins);6.熟悉监控日志系统(ELK/Prometheus)及自动化运维工具(Ansible/SaltStack)。加分项:1.有高并发、分布式系统运维经验者优先;2.熟悉网络安全防护(WAF/防火墙/漏洞扫描);3.持有AWS/AliCloud/K8s认证证书;4.有大模型相关基础设施搭建经验;5.了解Infrastructure as Code(IaC)实践。。 投递...
Senior Technical Specialist We are looking for a hardworking, intellectually curious individual to play the role of Senior Technical Specialist to design and implement innovative tech solutions for complex business problems. Role Summary: Key Accountabilities: Lead
Key responsibilities The Cloud and Data Engineer will be responsible for the development, implementation, operation, maintenance, and support of the data, middleware, and IT infrastructure used by R&D units across Novo Nordisk, both on-premises and in