MaaS-SRE/DBA 北京 全职 互联网 / 电子 / 网游 职位描述 【岗位职责】1. 稳定性保障(核心):负责MySQL、Redis等核心存储组件的稳定性,建设全方位的监控告警体系(Prometheus/Grafana),实现故障的早发现、快止损,保障MaaS平台在高并发场景下的99.99%可用性。2. 架构治理与演进: 主导数据库架构升级,包括读写分离、冷热分离、分库分表及异地多活(双活)容灾体系的建设。3. 深度调优与质量管控: 建立标准化的SQL审核与发布流程,负责慢 SQL 治理、大表治理及数据库参数深度调优,解决数据库性能瓶颈。4. 自动化平台建设: 基于SRE理念,开发数据库自动化运维平台(Python/Go),实现备份恢复、高可用切换、自动扩缩容及账号权限管理的自动化。5. 应急响应与预案: 负责突发故障(如宕机、带宽拥塞)的应急响应,制定并定期演练标准化恢复预案(SOP),降低故障平均恢复时间(MTTR)。6. 容量规划与成本管理: 结合业务增长模型进行容量预测与压测,优化资源利用率,制定降本增效策略。【岗位要求】1. 学历与经验: 本科及以上学历,计算机相关专业;3 年以上大规模互联网数据库管理(DBA)或 SRE 经验,有高并发、大流量系统保障经验者极佳。2. 数据库精通: 精通 MySQL 原理(InnoDB 引擎、事务锁机制、索引优化、主从复制),精通 Redis(集群模式、缓存一致性、热 Key/大 Key 处理);熟悉其高可用架构(MHA/Orchestrator/Sentinel/Cluster)。3. SRE 与编程能力: 具备良好的编码能力,熟练掌握
SRE实习生-2027届 南京 校招 实习 软件研发类 职位描述 1、负责小米各业务的SRE工作,比如AIoT、小米商城、互联网业务、小米手机核心应用、视频技术等2、工作涵盖容量管理、灾备管理、活动重保、日常Oncall、troubleshooting、业务巡检、故障预案、架构优化、技术运营等;3、与DEVS共同设计产品后端架构,实现分布式、全球集群化运维管理,制定并实施相关运维技术方案,确保服务高效、稳定的运行; 4、研发设计自动化运维工具,减少日常重复性工作,用DevOps工具化思维解决业务问题,提升运维效率; 5、通过技术手段进行成本控制及优化,通过工具化及流程提升服务管理效率。 职位要求 1、熟练至少一种编程语言:Go/Python/Bash/C/C++/Java;2、熟悉Linux/Unix系统;3、乐于分享、开源,具备服务精神,良好的沟通能力和团队合作精神;4、优秀的分析和解决问题能力,勇于解决难题,有”问题到我为止“的精神。 投递...
SRE工程师 武汉、北京、南京、上海 校招 正式 软件研发类 2027届校园招聘计划 职位描述 1、我们为小米的站点稳定性提供系统和工具,是稳定性工程专家;2、实践DevOps , Google SRE 和 AI Ops 的工程思想;3、站在软件生命周期全局考虑如何保障系统健壮性,稳定性,并通过软件工程技术为站点保驾护航;4、站在用户/工程师的角度提供易用的工具和平台产品,不断完善使用体验;5、负责集团基础软件/工具/平台的设计和研发,维护小米各项业务的稳定运行;6、按照优秀的工程实践完成需求,设计,编码,测试,发布的软件开发流程;7、按照标准编写设计/开发/运维/用户文。 职位要求 1、熟练Go/C/C++/Java/Shell/Python至少一种编程语言,有Ruby/Bash经验更好;2、熟悉Linux/Unix系统;3、熟悉软件开发方法/流程,理解软件设计,开发,测试,发布过程;4、持续学习,不断追求更好,不断挑战自己,包括:产品/架构/方案/流程/编码;5、乐于分享,具备服务精神,良好的沟通能力和团队合作精神;6、优秀的分析和解决问题能力,勇于解决难题,有”问题到我为止“的精神。 投递...
业务运维岗(SRE) 深圳 全职 互联网 / 电子 / 网游 职位描述 职位描述1. 负责实时音视频业务日常运维工作,对突发事件的快速响应、定位及处理,排除故障,保障系统稳定性;2. 负责实时音视频业务稳定性保障工作并持续优化,包括服务质量提升、架构优化、容灾预案、精细化监控、问题/故障处理及规避等;3. 负责运维工作的标准化,自动化和智能化实践;4. 负责业务系统客户问题持续跟进、分析和解决。 职位要求 职位要求1、计算机及相关专业本科及以上学历2、熟悉linux,掌握常用数据结构、算法、设计模式,熟练掌握编程语言者优先(Java、PHP、Golang、Python等)3、熟练使用shell,3-5年运维经验4、熟悉SRE的主要职责,对可用性保障工作有深刻理解和认同5、熟悉Jenkins、SaltStack、Ansible、prometheus、Grafana、ELK等主流开源软件6、对AI有一定的理解和实际场景的应用 投递...
Some careers have more impact than others. If you’re looking for a career where you can make a real impression, join HSBC and discover how valued you’ll be. We are currently seeking an experienced professional to
提前批-AI 中间件研发工程师 上海 校招 正式 数字技术 - 技术运维 硕士及以上 2027届校园招聘-技术提前批 职位 ID:A13914 职位描述 参与搭建、优化新AI时代基础设施,深度参与AI网关、向量/图数据库、Sandbox安全隔离环境等核心中间件的开发、测试与迭代工作;完成AI基础设施的部署、调试、监控与日常运维,保障核心组件(部分自研)高可用运行,支撑公司AI原生项目(如Agent)规模化落地,践行SRE稳定性保障、成本优化等核心职责;基于现有AI基础设施,持续优化TOD内部基础设施平台,推进PaaS平台“云+AI”一体化升级,提升基础设施交付效率与可运维性;进行技术文档编写、测试用例设计、问题排查复盘等工作,助力团队形成标准化研运流程。 职位要求 2027届硕士毕业生,计算机、人工智能、软件工程等相关专业;具备扎实且深入的计算机学科基础,对操作系统、网络、数据库、分布式系统、计算机体系结构等底层原理有深刻理解;精通至少一种编程语言(Go、Java、Python优先),具备优秀的代码开发、调试及复杂问题排查能力,有高质量项目开发经验或相关开源贡献者优先;对AI基础设施、AI网关、安全沙箱、中间件等领域有浓厚兴趣,学习能力强,具备良好的沟通协作能力和团队配合意识;严谨负责,有较强的问题解决意识和自驱力,能主动跟进任务、配合团队完成各项研运相关工作;优先条件:熟悉云原生相关技术(K8s、Docker)、各类中间件(网关、数据库);有SRE相关实践或学习经历;了解Agent构建相关知识(如RAG、MCP、Skill)。 投递...
Some careers have more impact than others. If you’re looking for a career where you can make a real impression, join HSBC and discover how valued you’ll be. We are currently seeking an experienced professional to
AI 中间件&Agent 研发工程师 上海 社招 全职 数字技术 - 软件研发 本科及以上 3-5 年 职位描述 1. 负责 Agent上下文平台、 技术风险平台的平台开发工作,并负责平台的运营工作,完成推广和内容治理2. 负责 nacos、apollo、mesh、sentinel等服务治理中间件的开发3. 负责 部门内部平台能力到cli能力的转化4. 负责 完成技术风险系列产品 风险巡检-“先知”和故障排查-“火眼”的开发5. 负责 以上平台和产品的稳定性建设和日常运维工作 职位要求 1. 计算机及相关专业,本科及以上学历,3年以上大型软件系统运维经验2. 参与或主导过Agent产品的构建,了解至少一种agent框架如deepagents,了解 react 原理,对 Agent 的生产高可用有深入了解,具备 Agent 评测与可观测实践3.
Some careers have more impact than others. If you’re looking for a career where you can make a real impression, join HSBC and discover how valued you’ll be. We are currently seeking an experienced professional to
Some careers have more impact than others. If you’re looking for a career where you can make a real impression, join HSBC and discover how valued you’ll be. We are currently seeking an experienced professional to
Some careers have more impact than others. If you’re looking for a career where you can make a real impression, join HSBC and discover how valued you’ll be. We are currently seeking an experienced professional to
SummaryThe Insight team runs one of Apples most critical Big Data ecosystems — an exabyte-scale, highly-available infrastructure that underpins manufacturing operations for every Apple product, globally. Every iPhone, iPad, and Mac has touched our systems. We
SummaryThis position is required for working on the data migration and ongoing support for data platform for Applied Machine Learning enterprise systems at Apple China. The main deliverables will be: •Work with SRE on setting up and
SummaryPeople at Apple don’t just build products — they craft experiences our customers love and depend on. Apple Services Engineering (ASE) builds and supports the systems that make many of these daily experiences possible. If you’ve
State Street is seeking a talented and motivated Software Engineer to join the IMSWest Remediation Engineering team in Hangzhou. This role will be responsible for designing, developing, testing, and supporting remediation solutions that improve platform stability,
Position Summary State Street is seeking a highly motivated Assistant Vice President (AVP) to lead application development initiatives within the IMSWest Remediation Program. This role will be responsible for driving the design, development, and delivery of
Some careers have more impact than others. If you’re looking for a career where you can make a real impression, join HSBC and discover how valued you’ll be. We are currently seeking an experienced professional to
后端架构师 Beijing Full-time R&D - Back-end development Responsibilities 1. 负责公司核心后端系统的整体架构设计与技术演进,把控技术方向和落地路径2. 主导微服务体系建设:服务拆分、边界划分、服务治理(注册发现、配置中心、链路追踪、熔断限流)3. 负责系统稳定性治理:SLO/SLA 制定、容量规划、性能压测、故障演练、降级预案,持续降低线上事故率4. 主导高并发、高可用架构设计,解决大流量场景下的性能瓶颈与扩展性问题5. 建立并完善技术规范:编码规范、API 设计规范、代码 review 流程、技术文档体系6. 推动研发效能提升:CI/CD、可观测性(Logging / Metrics / Tracing)、自动化测试体系建设7. 技术选型与预研:跟踪业界前沿技术,评估引入成本与收益,为业务发展储备技术能力8. 培养和指导团队后端工程师,参与关键代码 review,把控代码质量9. 与产品、前端、算法、运维团队深度协作,从架构层面推动业务目标达成 Qualifications 1. 5 年以上后端开发经验,其中至少 2 年架构设计经验,有过从 0 到 1
运维研发工程师 北京 全职 互联网 / 电子 / 网游 职位描述 1.负责故障管理、稳定性治理和高可用保障相关工作,参与故障发现、响应、协同处置、复盘改进和机制沉淀,推动故障管理流程标准化、数字化和可度量化。2.参与充电业务高可用建设协作,围绕核心业务链路、关键系统依赖、容量风险、变更风险和应急预案等方向,配合业务、研发、测试、运维等团队识别并推进稳定性改进事项。3.负责重大活动保障中的协调与推动工作,包括保障方案准备、风险排查、监控确认、预案演练、保障值守、问题跟进和活动后复盘,提升活动期间企业数字平台的连续性和可靠性。4.参与系统风险相关工作的数字化建设,协同团队完成风险对象、风险指标、风险事件、治理动作、责任关系、处置状态等数据模型设计,推动风险管理从经验驱动向数据驱动演进。5.结合当前智能化技术趋势,参与系统风险治理的智能化探索,包括风险数据沉淀、规则建模、异常识别、趋势分析、智能推荐、辅助决策等方向,提升稳定性治理的自动化和智能化水平。6.持续沉淀稳定性治理方法论、流程规范、数据标准和工具能力,推动企业 IT 系统稳定性提升,降低故障发生概率和业务影响范围。 职位要求 1.全日制统招本科及以上学历,熟悉运维、SRE、DevOps 或平台工程相关工作方法,理解故障管理、监控告警、应急响应、变更管理、容量管理、稳定性治理等基本体系。2.具备较好的系统化思维,能够围绕业务链路、系统依赖、风险点、治理动作和度量指标进行结构化分析,推动复杂问题拆解和闭环解决。3.具备一定研发能力,熟悉至少一种编程语言,如 Python、Go、Java 或 JavaScript,能够参与运维工具、数据平台、风险治理平台或自动化能力建设。4.了解数据库、接口服务、消息队列、缓存、容器、云平台、监控系统等常见 IT 基础设施和应用架构,能够理解系统运行风险和高可用保障重点。5.具备数据建模和数据分析意识,能够将稳定性、故障、风险、治理动作等工作对象抽象为可管理、可统计、可追踪的数据模型。6.具备良好的跨团队沟通和项目协同能力,能够在故障处置、活动保障、风险治理推进等场景中协调多方资源,推动问题落地解决。7.具备较强的责任心和风险意识,对线上稳定性、业务连续性和用户影响有敏感度,能够在关键保障场景中保持严谨、及时和可追踪的工作方式。8.具备持续改进意识,能够通过复盘、数据分析、流程优化和工具建设,推动稳定性治理能力长期提升。 投递...
Job Summary Experienced Technology Delivery professional who manages the successful technical delivery of products. A skilled technology expert who works across multiple squads or hives for delivery of complex Features, Epics & Releases. Key Responsibilities •