IT基础架构服务管理 北京、上海 社招 全职 互联网 / 电子 / 网游 职位描述 -该职位负责服务器,操作系统和容器战略和架构主题,确保计划与IT业务优先事项保持一致。-参与或主导华为全栈技术架构的设计,调整与优化(如虚拟化资源池规划,超融合集群扩容,私有云平台性能调优),提升系统资源利用率与稳定性。-该职位负责管理IT基础架构运营相关主题的子项目,如技术可行性研究,技术解决方案设计和一般支持相关主题。-负责华为服务器(硬件/虚拟化),FusionCompute虚拟化平台,FusionCube/FastCube超融合平台,华为私有云平台等等的日常运维,监控,故障排查与优化,确保系统7×24小时稳定运行,在出现故障时恢复系统,并分析原因以进行优化,以获得较高的客户满意度。-制定技术运维的操作规范,流程与风险预案(如变更管理,故障恢复,数据备份),降低操作风险与业务中断概率, 持续改进,优化和稳定当前IT基础架构的操作和流程。-推动技术运维的自动化,智能化(如脚本开发,工具集成),提升运维效率与准确性。-配合软硬件研发,测试,业务等部门完成系统部署,变更与故障处理,提供技术支持与培训。-负责维护和评估外部服务提供商。 职位要求 -至少 8 年维护和支持 IT 基础设施和数据中心相关主题的经验-至少 5 年与基础设施相关的服务器,操作系统和容器化设计经验-至少 5 年硬件,虚拟化,操作系统,容器化,公共云,混合云管理方面的综合经验。-具备5年以上华为服务器,FusionCompute虚拟化平台,FusionCube/FastCube超融合平台及华为私有云平台的运维经验。 -熟悉华为服务器的硬件架构,性能参数与故障排查(如CPU,内存,硬盘,RAID卡故障定位),具备服务器硬件安装,调试与维护经验。-精通FusionCompute虚拟化平台的规划,部署,配置与运维(如虚拟机生命周期管理,资源调度,高可用配置),熟悉VMware虚拟化平台(如vSphere)的基本操作与故障排查,具备虚拟化资源池优化经验(如CPU/内存 overcommit 调整,存储多路径优化)。-熟悉华为FusionCube/FastCube超融合平台的架构,部署与运维(如节点扩容,存储卷管理,虚拟机迁移),具备超融合集群性能优化经验(如存储IOPS提升,网络延迟优化)。-熟悉华为私有云平台(如HCS,FusionSphere OpenStack)的架构,部署与运维(如租户管理,服务编排,镜像管理),具备私有云平台升级与扩容经验。-熟悉服务器硬件底层原理(如BIOS/UEFI设置,RAID配置,PCIe设备管理),虚拟化底层技术(如KVM,ESXi),超融合底层技术(如分布式存储,虚拟网络)及私有云底层架构(如OpenStack核心组件,容器技术)。-精通CentOS/Ubuntu/RedHat等主流Linux发行版的安装,配置,性能调优及故障排查(如内存泄漏分析,磁盘I/O优化)-掌握Linux内核参数调优(如sysctl.conf调整),文件系统管理(ext4/XFS),LVM逻辑卷管理及磁盘分区策略-熟练部署Nginx(负载均衡,反向代理,HTTPS配置),Redis(集群模式),PostgreSQL(主从复制,备份恢复)等核心服务-熟悉防火墙配置(iptables/firewalld),SSH安全加固,SELinux策略管理,具备安全漏洞修复经验-熟练使用Shell/Python编写运维脚本(如日志清理,服务监控),掌握Ansible实现批量配置管理-掌握K8s集群部署(kubeadm/kubespray/Rancher),高可用架构设计(多Master节点,ETCD集群),熟悉Pod/Deployment/Service/Ingress等核心资源对象-能通过kubectl进行资源排障(如Pod状态分析,事件日志追踪),优化容器资源配额(CPU/内存限制)及HPA自动扩缩容-具备华为全栈技术架构的设计能力(如虚拟化资源池规划,超融合集群架构设计,私有云平台分层架构设计),能根据业务需求优化架构(如提升资源利用率,降低延迟,增强高可用性),能设计混合云架构(华为云+K8S),实现物理机,虚拟机,容器化应用的统一纳管。-具备制定技术运维操作规范的经验(如变更管理流程,故障处理流程,数据备份流程),能确保操作的一致性与可追溯性。-具备技术配置优化经验(如FusionCompute虚拟机资源分配优化,FusionCube/FastCube超融合集群存储配置优化,私有云平台服务配置优化),能通过配置调整提升系统性能与稳定性。-具备华为全栈技术故障排查的能力(如服务器硬件故障,虚拟化平台故障,超融合集群故障,私有云平台故障),能快速定位问题并解决(如通过日志分析,监控工具,华为支持平台),快速定位跨平台问题(如华为虚拟化层与K8S网络冲突),制定应急预案(如节点宕机自动迁移)。-具备识别与控制华为全栈技术运维风险的能力(如变更风险,故障风险,数据安全风险),能制定风险预案(如变更回滚计划,故障恢复计划,数据备份计划),降低业务中断概率。-具备快速学习新技术,新知识的能力(如华为新版本技术,行业最佳实践),能快速适应技术变化(如华为全栈技术的升级,云原生技术的融合)。具备主动提升自身能力的意识(如学习华为认证,参与技术培训,研究行业文档),能不断提升自身技术水平与业务能力。-具备良好的沟通能力,能与开发,测试,业务等部门有效沟通,理解业务需求并提供技术支持。-具备良好的团队协作精神,能配合团队完成系统部署,变更与故障处理,分享技术经验与知识。-具备强烈的责任心,能认真负责地完成运维工作,确保系统稳定运行,对业务连续性负责。-具备良好的抗压能力,能在高压力环境下(如系统故障,紧急变更)保持冷静,快速解决问题。-具备虚拟化,超融合,私有云项目的实施或运维经验(如项目部署,优化,故障处理)-持有华为认证(如HCIP-Cloud Computing,HCIE-Cloud Computing,HCIP-Storage,HCIE-Storage)者优先。本岗位需具备较强的责任心与良好抗压能力,能适应偶尔的加班(如系统故障处理,紧急变更)。 投递...
【集团】资深运维工程师(Linux / 监控方向) 上海 全职 职位描述 岗位定位负责公司 Linux 基础设施、服务器运维及监控体系建设,保障业务系统稳定、安全、高效运行;主导监控平台、告警机制、自动化运维及故障治理能力的持续优化。该岗位需要能够从“日常运维”提升到“稳定性治理”和“平台化建设”层面,既能处理复杂故障,也能推动规范、工具、流程与自动化能力落地。岗位职责负责 Linux 服务器、虚拟机及云主机的日常运维、配置管理、容量管理与性能优化。负责业务系统运行环境的部署、变更、巡检、升级及故障处理,保障系统高可用。负责监控平台建设与持续优化,包括主机、应用、中间件、数据库、网络及业务指标监控。负责告警体系设计,包括告警分级、告警收敛、告警降噪、通知策略及升级机制。主导 Prometheus、Zabbix、Grafana、ELK、OpenSearch、日志平台等监控与日志体系建设。负责服务器性能分析与问题定位,包括 CPU、内存、磁盘、网络、IO、负载等指标排查。负责线上复杂故障应急响应、问题复盘及根因分析,推动问题闭环和长期治理。负责建立并持续完善巡检、备份、变更、发布、应急、故障处理等运维标准。推动自动化运维能力建设,包括 Shell、Python、Ansible 等工具开发与批量运维。参与系统架构评审,从运维和稳定性角度提出优化建议,包括高可用、容灾、容量与监控设计。建立 SLA、SLO、告警 MTTA、故障 MTTR 等稳定性指标,并持续跟踪优化。与开发、网络、安全、供应商等团队协作,推动跨团队问题解决。 职位要求 基础能力本科及以上学历,计算机、网络、软件等相关专业。5 年及以上 Linux 运维经验,具备中大型生产环境运维经验。熟悉 CentOS、Red Hat、Ubuntu 等 Linux 系统,能够独立完成安装、配置、排障及优化。熟悉 TCP/IP、DNS、HTTP、HTTPS、Nginx、Keepalived、LVS 等基础网络与高可用技术。熟悉 VMware、KVM 或云平台运维经验,了解阿里云、腾讯云、AWS、Azure 中至少一种。Linux 能力要求精通 Linux 常用命令、系统服务、systemd、用户权限、文件系统、计划任务、日志管理。能够熟练分析
【人才活水计划】澳洲-总部-信息科技部-运维岗 上海 全职 职位描述 岗位职责1、桌面终端管理1)负责公司桌面终端(PC、笔记本、移动设备等)的标准化部署、维护及优化,确保高可用性;2)主导操作系统、办公软件及集团专用系统的安装、配置、升级及故障排查;3)解决公司内高级别的桌面端技术问题(如域控集成、权限管理、数据迁移等),提供L3级技术支持;4)分析系统性故障,制定预防措施,编写技术文档和SOP;2、安全与合规性1)落实集团IT安全策略,包括终端安全防护(杀毒、加密、补丁管理)、合规审计及漏洞修复;2)协助应对安全事件(如病毒爆发、数据泄露)的终端端处置;3、自动化与流程优化1)通过脚本(PowerShell/Python等)或工具(SCCM/Intune/JAMF)实现运维自动化,提升效率。2)推动桌面运维流程标准化,优化IT服务管理(ITSM)流程。4、跨团队协作1)与网络、服务器、安全团队协作,参与IT基础架构项目(如AD升级、零信任部署)。5、网络运维1) 网络基础:精通TCP/IP协议,熟练掌握路由交换技术(OSPF, BGP, VLAN, STP等),熟悉主流厂商(Cisco, Huawei, H3C,等)设备配置。2)无线与监控:熟悉企业级无线控制器(AC/AP)配置,有Aruba, Cisco或类似产品经验者优先;熟练使用网络抓包工具(Wireshark)及网络监控软件。 职位要求 岗位对接人—J&T集团人资—吉轩正1、学历与专业:本科及以上学历,计算机相关专业;2、知识与能力:1)精通Windows/macOS系统管理、Active Directory、组策略、MDM(如Intune/JAMF);2)熟悉ITIL框架,具备ITSM工具(ServiceNow/Remedy等)使用经验;3)持有相关认证(如Microsoft 365认证、CompTIA A+/ITIL、CISSP等)优先;具备脚本开发能力(PowerShell/Python/Bash)优先;熟悉云桌面(VDI/Citrix/VMware Horizon)或终端安全解决方案(CrowdStrike/SentinelOne)优先;3、工作经历:5年以上大型企业桌面运维经验,有集团级或多分支机构支持经验优先;4、个性特征:1)优秀的沟通能力,能向非技术人员清晰解释技术问题;2)抗压能力强,适应集团化多任务并行处理;3)持续学习意识,关注行业新技术趋势。5、网络技能1) 持有CCNP、HCIP或同等水平认证。 投递...
Who We Are Zenni pioneered the online eyewear industry in 2003 with a mission to make eyewear affordable and accessible for everyone. With complete prescription pairs starting under $10, Zenni offers adults and children the freedom
NVIDIA is looking for a HPC and AI Cluster Engineer to join the Networking clusters solutions HPC/AI Infrastructure team. We are building supercomputers and AI clusters based on groundbreaking technologies. We are looking for a cluster