【人形机器人】系统服务工程师 北京 全职 智能制造 / 工业互联网 / 工业自动化 职位描述 工作职责:1.整机服务启动拓扑、依赖声明、健康检查;进程守护、异常拉起、优雅降级;2.结构化日志、分布式 tracing(OpenTelemetry)、指标(Prometheus)与端云一体可观测;3.基于 eBPF / perf 的低开销运行时诊断,整机健康管理;4.身份认证与访问控制(PKI / X.509 / SROS2)、代码签名、密钥管理;5.OTA 升级通道(RAUC / Mender / SWUpdate)与 A/B 分区;急停 / 安全状态机上层软件对接。 职位要求 任职要求:1.本科及以上,计算机 / 信息安全相关专业;2.4 年以上系统软件 / 平台工程 / SRE
AI 平台高级 SRE 工程师 / DevOps 工程师 北京 全职 互联网 / 电子 / 网游 职位描述 1. 负责理想汽车 AI 平台大规模 GPU 集群、RDMA 网络及并行高速存储的稳定运行与日常运维,保障训练、推理等核心 AI 业务高效交付。 2. 负责大规模 GPU 集群在训练任务、资源调度、网络通信、存储访问等场景下的故障定位与问题解决,持续提升平台稳定性和可用性。 3. 深入理解 AI 训练与推理业务场景,参与 AI 平台在 Kubernetes 多集群、监控告警、日志检索、故障诊断等方向的云原生架构演进与落地。
SummaryWe are hiring an SRE to own reliability, performance, data freshness, and operational readiness for our production ETL platform. The platform supports data ingestion, transformation, and loading workflows across Kubernetes-based environments — including Airflow-based loader jobs
DevOps Engineer - China On any given day at thatgamecompany, you might: Design, implement and maintain scalable, secure, and reliable cloud infrastructure globally Design and implement infrastructure as code and configuration as code Optimize server deployment
Some careers have more impact than others. If you’re looking for a career where you can make a real impression, join HSBC and discover how valued you’ll be. We are currently seeking an experienced professional to
【27届校招】可观测性后端研发工程师(全栈) 上海 正式 技术类 2027届秋季校园招聘项目 职位描述 1. 设计并实施系统和应用程序的监控、日志记录和追踪方案;2. 开发和维护可观测性平台工具和仪表盘,提供实时的系统健康和性能可视化;3. 分析和优化系统的性能和可靠性,通过监控数据和追踪信息识别瓶颈和故障点;4. 与开发团队协作,确保应用程序在开发过程中充分考虑可观测性需求;5. AI 工程化基础:熟悉大模型相关技术架构,包括但不限于 Prompt Engineering、RAG (检索增强生成)、LangChain 或 LlamaIndex 等开发框架6. 模型评估逻辑:了解如何评估 LLM 在特定运维任务中的表现(如准确率、幻觉控制、响应时延优化等) 职位要求 1. 2027届毕业生,本科及以上学历,计算机、软件工程相关专业;2. 具备良好的编程基础,熟悉一种或多种编程语言(如 Java、Go、Python、Rust 等);3. 了解分布式系统原理,并对微服务架构有一定的理解;4. 熟悉常见的监控和可观测性工具(如 Prometheus、Grafana、ELK Stack、Jaeger、OpenTelemetry 等);5. 具备良好的问题解决能力和沟通能力,能够与跨职能团队有效协作;6. 对新技术和新工具保持强烈的好奇心和学习热情;加分项:1. 有实习或项目经验,特别是在大规模分布式系统领域;2. 在
业务运维岗(SRE) 深圳 全职 互联网 / 电子 / 网游 职位描述 职位描述1. 负责实时音视频业务日常运维工作,对突发事件的快速响应、定位及处理,排除故障,保障系统稳定性;2. 负责实时音视频业务稳定性保障工作并持续优化,包括服务质量提升、架构优化、容灾预案、精细化监控、问题/故障处理及规避等;3. 负责运维工作的标准化,自动化和智能化实践;4. 负责业务系统客户问题持续跟进、分析和解决。 职位要求 职位要求1、计算机及相关专业本科及以上学历2、熟悉linux,掌握常用数据结构、算法、设计模式,熟练掌握编程语言者优先(Java、PHP、Golang、Python等)3、熟练使用shell,3-5年运维经验4、熟悉SRE的主要职责,对可用性保障工作有深刻理解和认同5、熟悉Jenkins、SaltStack、Ansible、prometheus、Grafana、ELK等主流开源软件6、对AI有一定的理解和实际场景的应用 投递...
Some careers have more impact than others. If you’re looking for a career where you can make a real impression, join HSBC and discover how valued you’ll be. We are currently seeking an experienced professional to
AI工程师 - 平台 Beijing Full-time Intelligent manufacturing / Industrial Internet / Industrial automation - R&D Responsibilities 1. 负责公司核心AI平台的架构设计、研发与持续演进,支撑多业务线稳定高效运行。2. 参与平台化、服务化、组件化建设,沉淀通用平台能力3. 负责高并发、高可用系统的设计与实现,持续优化性能、稳定性与成本。4. 参与 大模型平台 / 模型网关(LLM Gateway) 建设,包括但不限于: - 多模型接入与统一抽象 - 请求路由、模型调度、版本与能力管理 - 配额、限流、计费、审计等平台能力5. 参与GPU / 推理资源调度与管理相关后端逻辑: -
后台开发工程师 上海 社招 全职 互联网 / 电子 / 网游 职位描述 1、负责研发效能平台后端系统的架构设计、开发和优化,支撑高并发、高可用的业务场景。2、使用Golang开发高性能微服务,优化API响应速度,保障系统稳定性和扩展性。3、负责数据库设计及优化,熟练使用 MySQL/PostgreSQL,并合理应用 Redis/Kafka 等中间件提升系统性能。4、与前端、测试、产品团队协作,完成需求分析、接口设计及联调,确保项目按时高质量交付。5、持续优化系统架构,提升代码质量,参与技术方案评审,推动DevOps及自动化测试落地。6、结合业务发展,能够独立进行项目规划与设计。 职位要求 技术能力1、5年以上后端开发经验,至少3年Go语言开发经验,熟悉 Gin/Echo/Fiber 等框架,熟悉领域驱动设计和应用2、熟悉 RESTful API 设计,了解 gRPC 或 GraphQL 加分。3、精通 MySQL/PostgreSQL,熟悉MongoDB,掌握索引优化、事务处理及分库分表策略。4、熟悉 Redis 缓存、消息队列(Kafka/RabbitMQ)及分布式锁应用。5、有微服务架构经验,熟悉使用 Docker/Kubernetes 及云服务(AWS/阿里云/腾讯云)。加分项1、拥有效能平台开发经验者优先(如流水线、监控、日志、测试管理等),如有智能驾驶或互联网相关行业更佳。2、熟悉 Prometheus/Grafana 监控,或 ELK 日志分析。3、了解 CI/CD 流程,有 Jenkins/argoCD等实践经验。4、熟悉使用大模型工具提升工作效率。软技能1、良好的编码习惯,追求高性能、可维护的代码。2、逻辑清晰,能独立解决问题,具备良好的团队协作精神
SummaryDo you want to help build some of the largest and most consequential enterprise and customer technology systems in the world? Join Apple’s Information Systems and Technology (IS&T) organization. IS&T is the engine behind everything Apple
Some careers have more impact than others. If you’re looking for a career where you can make a real impression, join HSBC and discover how valued you’ll be. We are currently seeking an experienced professional to
交付运营实习生 北京 实习 运营 - 产品运营 职位描述 1、项目交付协助:跟进具身智能项目交付进度,协助整理项目文档、更新进度看板;参与项目例会并输出会议纪要;协助识别交付中的风险与问题,跟进闭环。2、技术支持与问题跟进:协助响应客户技术问题,在指导下处理基础工单与 Bug 跟踪;参与整理故障案例与 FAQ 知识库,协助维护技术文档。3、数据运营与效能分析:协助搭建和维护交付效能指标看板;使用 SQL/Python 进行基础数据统计与分析,协助复盘流程瓶颈;参与交付工具链的测试与优化。4、客户成功与方案沉淀:协助整理客户反馈与需求,参与标杆案例资料收集与交付方法论文档的整理归档。 职位要求 1、本科及以上在读(大三、大四、研一、研二优先),计算机、自动化、机器人、电子工程等相关专业;每周可实习 4 天及以上,能持续 3 个月以上。2、具备良好的学习能力、责任心和沟通能力,对 AI / 机器人 / 具身智能领域有热情。3、熟悉 Linux 基本操作,了解 Python/Shell 基础;了解 Docker、CI/CD 等基本概念,有容器化使用经验优先。4、具备基础的 SQL 查询能力,对数据分析有兴趣。5、具备良好的文档撰写能力和逻辑思维。加分项1、了解 ROS/ROS2、SLAM、运动控制等机器人相关技术。2、使用过 Prometheus、Grafana 等监控工具。3、云平台使用或运维相关经验; 有人形
【2027届秋招】后端开发工程师 上海 正式 研发 - 后端开发 技术岗位 2027届秋季校园招聘 职位描述 1. 负责沐瞳中台 WEB 后端服务的功能设计、开发、测试及持续优化,参与系统架构和基础能力建设;2. 参与业务需求讨论和产品方案评审,与产品、前端、测试等团队协作,高效、高质量地完成产品交付;3. 参与高并发、高可用、容灾、系统解耦及性能优化等技术实践,持续提升系统的可靠性、可扩展性和可维护性;4. 参与 AI 能力与业务系统的结合,探索大模型在研发提效、内容处理、智能运营、数据分析等场景中的应用;5. 参与 Agent、RAG、知识库、Workflow、Tool Calling 等 AI 应用能力的开发和落地,推动后台服务智能化。 职位要求 1. 2027届毕业生,本科及以上学历,计算机科学与技术、软件工程、人工智能、信息安全等相关专业优先;2. 热爱计算机科学和互联网技术,具备良好的编程能力,熟悉 Golang,了解常用 Web 开发框架及后端开发模式;3. 熟悉 MySQL、Redis 等常用数据库和缓存组件,了解索引、事务、缓存及基本性能优化方法;4. 熟悉 Linux
【2027届秋招】平台运维工程师 上海 正式 研发 - 运维 技术岗位 2027届秋季校园招聘 职位描述 1. 负责平台业务的部署、新版本的发布、服务端的变更;2. 负责与平台运营的日常沟通交流,接受并处理项目组提出的运维需求;3. 负责日常运维工作的自动化、工具化建设;4. 负责平台业务运行状况监控,及时处理游戏运行中出现的故障,保证游戏服务的正常提供。 职位要求 1. 专业不限,计算机、软件工程、信息管理类优先,本科或以上学历;2. 熟悉linux操作系统,熟练使用各种linux日常命令,熟悉shell、python、golang等至少一种语言;3. 熟悉使用mysql数据库,熟悉日常的sql语句,能够对数据库进行管理、配置、部署;4. 了解zabbix、prometheus等至少一种开源监控方案;5. 了解docker容器,k8s/kubernetes容器编排工具;6. 了解各类公有云服务器、网络、安全、存储等设备和服务;7. 具有良好文档编写和文字表达能力,以及独立思考并解决问题的能力;8. 具有良好的沟通能力和团队合作精神。 投递...
Job Description Have clear and solid relationships with software development departments. Plan and document work and projects. Build and continuously optimize CI/CD process and streamline automation effort for server provisioning and applications deployment. Build a resilient
SummaryDo you want to help build some of the largest and most consequential enterprise and customer technology systems in the world? Join Apple’s Information Systems and Technology (IS&T) organization. IS&T is the engine behind everything Apple
Job Description Have clear and solid relationships with software development departments. Plan and document work and projects. Build and continuously optimize CI/CD process and streamline automation effort for server provisioning and applications deployment. Build a resilient
AI运维工程师 北京 全职 互联网 / 电子 / 网游 职位描述 职位描述1.负责公司IDC、公有云(火山云/腾讯云等)的规划、部署、监控与优化,保障业务高可用性(SLA ≥ 99.9%);2.负责管理公司GPU集群,调配训练平台资源;3.设计并实施自动化运维体系(Ansible/Terraform/Jenkins等),提升系统部署、监控告警、故障处理效率;4.维护大规模Linux服务器集群(CentOS/Ubuntu)、Kubernetes/Docker容器平台及中间件(Nginx/MySQL/Redis等)、大规模数据存储;5.建立全链路监控体系(Zabbix/Prometheus/Grafana),实时分析系统性能瓶颈,预防潜在风险;6.制定并执行容灾备份、安全加固及合规策略,响应安全事件;7.编写运维文档及技术方案,推动DevOps文化落地; 职位要求 职位要求硬性条件:1.本科及以上学历,计算机/通信相关专业,3年以上人工智能科技公司运维经验;2.具备GPU集群管理经验,了解ROS/ROS2生态;3.精通Linux系统管理、Shell/Python脚本开发,熟悉TCP/IP、HTTP等网络协议;4.熟练使用至少一种公有云(火山云/腾讯云/阿里云),有PB级存储搭建经验,具备云资源编排及成本优化经验;5.掌握容器化技术(Docker/K8s)及CI/CD工具链(GitLab/Jenkins);6.熟悉监控日志系统(ELK/Prometheus)及自动化运维工具(Ansible/SaltStack)。加分项:1.有高并发、分布式系统运维经验者优先;2.熟悉网络安全防护(WAF/防火墙/漏洞扫描);3.持有AWS/AliCloud/K8s认证证书;4.有大模型相关基础设施搭建经验;5.了解Infrastructure as Code(IaC)实践。。 投递...
SRE工程师 Shanghai Experienced Outsourced Responsibilities Vast 是一家专注于 3D AI 的独角兽公司,致力于构建能够理解和生成 3D 世界的基础模型。公司获得 NVIDIA、Lux Capital 等顶级机构投资,产品覆盖 3D 内容生成、机器人仿真训练、空间计算等前沿领域。SRE 团队是支撑这一切稳定运转的基础——你将直接参与构建服务于大规模 3D AI 模型训练与推理的基础设施体系。职位要求1、设计并维护 AWS / 阿里云的多账号体系(Organization / Landing Zone),规划账号结构与边界,制定并落地 IAM 权限策略,推行最小权限原则,管理角色、策略与 SCP2、建立云资源全生命周期管理规范,包括 Tagging 标准、资源审计与清理流程,推动 FinOps 实践:成本归因、预算告警、RI / SP