IT基础架构服务管理 北京、上海 社招 全职 互联网 / 电子 / 网游 职位描述 -该职位负责服务器,操作系统和容器战略和架构主题,确保计划与IT业务优先事项保持一致。-参与或主导华为全栈技术架构的设计,调整与优化(如虚拟化资源池规划,超融合集群扩容,私有云平台性能调优),提升系统资源利用率与稳定性。-该职位负责管理IT基础架构运营相关主题的子项目,如技术可行性研究,技术解决方案设计和一般支持相关主题。-负责华为服务器(硬件/虚拟化),FusionCompute虚拟化平台,FusionCube/FastCube超融合平台,华为私有云平台等等的日常运维,监控,故障排查与优化,确保系统7×24小时稳定运行,在出现故障时恢复系统,并分析原因以进行优化,以获得较高的客户满意度。-制定技术运维的操作规范,流程与风险预案(如变更管理,故障恢复,数据备份),降低操作风险与业务中断概率, 持续改进,优化和稳定当前IT基础架构的操作和流程。-推动技术运维的自动化,智能化(如脚本开发,工具集成),提升运维效率与准确性。-配合软硬件研发,测试,业务等部门完成系统部署,变更与故障处理,提供技术支持与培训。-负责维护和评估外部服务提供商。 职位要求 -至少 8 年维护和支持 IT 基础设施和数据中心相关主题的经验-至少 5 年与基础设施相关的服务器,操作系统和容器化设计经验-至少 5 年硬件,虚拟化,操作系统,容器化,公共云,混合云管理方面的综合经验。-具备5年以上华为服务器,FusionCompute虚拟化平台,FusionCube/FastCube超融合平台及华为私有云平台的运维经验。 -熟悉华为服务器的硬件架构,性能参数与故障排查(如CPU,内存,硬盘,RAID卡故障定位),具备服务器硬件安装,调试与维护经验。-精通FusionCompute虚拟化平台的规划,部署,配置与运维(如虚拟机生命周期管理,资源调度,高可用配置),熟悉VMware虚拟化平台(如vSphere)的基本操作与故障排查,具备虚拟化资源池优化经验(如CPU/内存 overcommit 调整,存储多路径优化)。-熟悉华为FusionCube/FastCube超融合平台的架构,部署与运维(如节点扩容,存储卷管理,虚拟机迁移),具备超融合集群性能优化经验(如存储IOPS提升,网络延迟优化)。-熟悉华为私有云平台(如HCS,FusionSphere OpenStack)的架构,部署与运维(如租户管理,服务编排,镜像管理),具备私有云平台升级与扩容经验。-熟悉服务器硬件底层原理(如BIOS/UEFI设置,RAID配置,PCIe设备管理),虚拟化底层技术(如KVM,ESXi),超融合底层技术(如分布式存储,虚拟网络)及私有云底层架构(如OpenStack核心组件,容器技术)。-精通CentOS/Ubuntu/RedHat等主流Linux发行版的安装,配置,性能调优及故障排查(如内存泄漏分析,磁盘I/O优化)-掌握Linux内核参数调优(如sysctl.conf调整),文件系统管理(ext4/XFS),LVM逻辑卷管理及磁盘分区策略-熟练部署Nginx(负载均衡,反向代理,HTTPS配置),Redis(集群模式),PostgreSQL(主从复制,备份恢复)等核心服务-熟悉防火墙配置(iptables/firewalld),SSH安全加固,SELinux策略管理,具备安全漏洞修复经验-熟练使用Shell/Python编写运维脚本(如日志清理,服务监控),掌握Ansible实现批量配置管理-掌握K8s集群部署(kubeadm/kubespray/Rancher),高可用架构设计(多Master节点,ETCD集群),熟悉Pod/Deployment/Service/Ingress等核心资源对象-能通过kubectl进行资源排障(如Pod状态分析,事件日志追踪),优化容器资源配额(CPU/内存限制)及HPA自动扩缩容-具备华为全栈技术架构的设计能力(如虚拟化资源池规划,超融合集群架构设计,私有云平台分层架构设计),能根据业务需求优化架构(如提升资源利用率,降低延迟,增强高可用性),能设计混合云架构(华为云+K8S),实现物理机,虚拟机,容器化应用的统一纳管。-具备制定技术运维操作规范的经验(如变更管理流程,故障处理流程,数据备份流程),能确保操作的一致性与可追溯性。-具备技术配置优化经验(如FusionCompute虚拟机资源分配优化,FusionCube/FastCube超融合集群存储配置优化,私有云平台服务配置优化),能通过配置调整提升系统性能与稳定性。-具备华为全栈技术故障排查的能力(如服务器硬件故障,虚拟化平台故障,超融合集群故障,私有云平台故障),能快速定位问题并解决(如通过日志分析,监控工具,华为支持平台),快速定位跨平台问题(如华为虚拟化层与K8S网络冲突),制定应急预案(如节点宕机自动迁移)。-具备识别与控制华为全栈技术运维风险的能力(如变更风险,故障风险,数据安全风险),能制定风险预案(如变更回滚计划,故障恢复计划,数据备份计划),降低业务中断概率。-具备快速学习新技术,新知识的能力(如华为新版本技术,行业最佳实践),能快速适应技术变化(如华为全栈技术的升级,云原生技术的融合)。具备主动提升自身能力的意识(如学习华为认证,参与技术培训,研究行业文档),能不断提升自身技术水平与业务能力。-具备良好的沟通能力,能与开发,测试,业务等部门有效沟通,理解业务需求并提供技术支持。-具备良好的团队协作精神,能配合团队完成系统部署,变更与故障处理,分享技术经验与知识。-具备强烈的责任心,能认真负责地完成运维工作,确保系统稳定运行,对业务连续性负责。-具备良好的抗压能力,能在高压力环境下(如系统故障,紧急变更)保持冷静,快速解决问题。-具备虚拟化,超融合,私有云项目的实施或运维经验(如项目部署,优化,故障处理)-持有华为认证(如HCIP-Cloud Computing,HCIE-Cloud Computing,HCIP-Storage,HCIE-Storage)者优先。本岗位需具备较强的责任心与良好抗压能力,能适应偶尔的加班(如系统故障处理,紧急变更)。 投递...
端侧 AI 部署与应用工程师 (2026届校招) 北京 校招 正式 智能制造 / 工业互联网 / 工业自动化 - 研发 职位描述 你将加入我们的核心研发团队,基于Qualcomm计算平台,打通从 AI 模型到端侧应用落地的“最后一公里”。我们需要你不仅懂算法原理,更能通过扎实的工程能力,构建高性能的 AI Agent 与推理系统。1. 模型转换与性能调优 (Model Engineering):使用 Linux 环境下的工具链,将 PyTorch/TensorFlow 训练模型转换为专用格式(DLC/QNN context)。编写 Shell/Python 脚本 实现模型转换、量化(Int8/FP16)及精度验证的自动化流程。分析模型在 Hexagon DSP/NPU 上的性能瓶颈,进行算子优化和推理加速。2. 端侧
【集团】资深运维工程师(Linux / 监控方向) 上海 全职 职位描述 岗位定位负责公司 Linux 基础设施、服务器运维及监控体系建设,保障业务系统稳定、安全、高效运行;主导监控平台、告警机制、自动化运维及故障治理能力的持续优化。该岗位需要能够从“日常运维”提升到“稳定性治理”和“平台化建设”层面,既能处理复杂故障,也能推动规范、工具、流程与自动化能力落地。岗位职责负责 Linux 服务器、虚拟机及云主机的日常运维、配置管理、容量管理与性能优化。负责业务系统运行环境的部署、变更、巡检、升级及故障处理,保障系统高可用。负责监控平台建设与持续优化,包括主机、应用、中间件、数据库、网络及业务指标监控。负责告警体系设计,包括告警分级、告警收敛、告警降噪、通知策略及升级机制。主导 Prometheus、Zabbix、Grafana、ELK、OpenSearch、日志平台等监控与日志体系建设。负责服务器性能分析与问题定位,包括 CPU、内存、磁盘、网络、IO、负载等指标排查。负责线上复杂故障应急响应、问题复盘及根因分析,推动问题闭环和长期治理。负责建立并持续完善巡检、备份、变更、发布、应急、故障处理等运维标准。推动自动化运维能力建设,包括 Shell、Python、Ansible 等工具开发与批量运维。参与系统架构评审,从运维和稳定性角度提出优化建议,包括高可用、容灾、容量与监控设计。建立 SLA、SLO、告警 MTTA、故障 MTTR 等稳定性指标,并持续跟踪优化。与开发、网络、安全、供应商等团队协作,推动跨团队问题解决。 职位要求 基础能力本科及以上学历,计算机、网络、软件等相关专业。5 年及以上 Linux 运维经验,具备中大型生产环境运维经验。熟悉 CentOS、Red Hat、Ubuntu 等 Linux 系统,能够独立完成安装、配置、排障及优化。熟悉 TCP/IP、DNS、HTTP、HTTPS、Nginx、Keepalived、LVS 等基础网络与高可用技术。熟悉 VMware、KVM 或云平台运维经验,了解阿里云、腾讯云、AWS、Azure 中至少一种。Linux 能力要求精通 Linux 常用命令、系统服务、systemd、用户权限、文件系统、计划任务、日志管理。能够熟练分析
Linux系统高级开发工程师 上海、西安、北京 社招 全职 职位 ID:J2288 职位描述 1. 负责Linux操作系统的定制和开发;2. 负责监控告警等基础服务组件的设计、开发、优化;3. 负责Linux发行版的稳定性、兼容性、性能看护,推动系统级问题的定位和解决;4. 参与Linux发行版构建流程和工具链建设;5. 跟踪Linux发行版社区演进及AI时代系统级新需求(如AI调度、NPU驱动框架),推动技术方向与社区对齐; 职位要求 1. 本科及以上学历,计算机/软件工程等相关专业;2. 5年以上Linux操作系统定制和发行开发经验;3. 熟悉ARM或X86体系结构,精通C/C++/Python等一种或多种编程语言;4. 掌握systemd工作原理,熟练使用crash/gdb/ftrace/bpftrace等调试工具;5. 有Debian/CentOS/openEuler/ubuntu等Linux发行版构建及基础服务开发经验;6. 有yocto等Linux定制经验、Linux发行版社区治理经验者优先。 投递...
技术中心 - 代码仓库管理员 广州 技术类 职位描述 1、负责Perforce(Helix Core)服务器的安装,配置,补丁管理与日常运维,保障服务器高可用;2、管理用户/组权限与访问控制,落实安全策略,确保代码仓库完整性与合规性;3、搭建监控体系(日志、性能、可用性),快速定位并解决服务器/客户端故障,推进应急响应与灾备落地;4、编写Shell/Python脚本实现自动化运维(备份、巡检、权限同步等),与IM高度集成形成完善的服务体系;5、完善运维文档、操作手册与应急预案,支撑团队协作与知识沉淀。 职位要求 1、本科以上学历,3年以上Perforce运维实战经验(游戏/互联网行业优先);2、精通Perforce核心组件、命令行(p4/p4d/p4p)与P4V客户端,熟悉分支/合并/发布全流程;3、深度掌握Linux系统(CentOS/RHEL/Ubuntu),熟练使用命令行与系统调优;4、熟练编写Shell/Python脚本,具备自动化运维能力,熟悉Jenkins、飞书API优先;5、具备备份恢复、 replication/failover 高可用架构设计与实施经验,能落地灾备方案;6、良好的沟通协调能力,能支撑研发团队需求,具备故障根因分析与应急处理能力。 投递...
At Roche you can show up as yourself, embraced for the unique qualities you bring. Our culture encourages personal expression, open dialogue, and genuine connections, where you are valued, accepted and respected for who you are,
大模型交付工程师/架构师-北京 北京 全职 互联网 / 电子 / 网游 职位描述 1、负责公司研发产品的现场部署实施工作,完成部署、调试和上线交付;2、负责在项目交付现场提供技术咨询和技术支持,及时响应并处理客户问题与咨询;3、现场与客户负责人对接,深入了解并抽象业务需求,形成需求调研和应用可行性的报告;4、负责在项目现场对客户进行交付产品培训事宜;5、负责交付产品的运维工作,包括日常巡检、故障处理等,保证交付产品运行顺畅; 职位要求 1、3年以上Linux运维工作经验,具备主流操作系统如Ubuntu、CentOS、Redhat等的运维经验;2、具备Bash/python/java至少一种程序编写能力;3、具备良好的解决问题能力;具备良好的沟通能力,能充分理解客户需求并提供咨询服务;4、熟悉Docker为代表的容器技术;有一定的数据库运维经验;5、熟悉大模型技术或算法工程,有大模型或相关项目研发或运维经验者优先; 投递...
桌面运维工程师-2027校招 深圳 校招 正式 职位描述 1、负责桌面端硬件设备资产管理,设备维护与故障处理:如PC电脑、打印机、会议设备、考勤门禁等;2、维护NAS网盘、桌管、杀毒等系统的日常运维与权限分配;3、参与桌面端操作系统与常用办公软件软件/专业软件安装、维护、故障处理等;4、协助完善桌面运维管理流程以及操作SOP,桌面运维知识库维护;5、协助完成简单网络问题处理,终端安全实施维护等工作。 职位要求 1、本科学历,计算机相关专业;2、了解桌面端常见硬件的工作原理,如PC机,打印机等; 3、对各类操作系统有一定了解,包括Windows/macos/ubuntu/centos等; 4、了解网络基础知识,可以对终端网络问题进行初步排查与解决; 5、有较强的学习能力与沟通能力,可以快速融入团队。 投递...