Location:CN-Shenzhen-HyQ Shift:Standard - 40 Hours (China) Scheduled Weekly Hours:40 Worker Type:Permanent Job Summary:The purpose of this role is to help build and run the LME’s new application hosting platform driving the adoption of Kubernetes based technologies
科研数据评测与项目交付方向 北京 全职 硕士及以上 职位描述 1. 科研数据与模型评测体系建设设计、搭建并持续迭代覆盖多模态科研数据的评测基准、评测集与评测方法,包括反应、物质、谱图、知识图谱、文献、语料库等数据类型,形成可用于项目验收、产品迭代和对外展示的 benchmark 资产。2. 化学数据库与科研语料库评测落地围绕化学数据库、科学语料库及相关模型能力,设计数据质量、结构化准确性、知识抽取效果、模型问答能力、可追溯性、覆盖率、一致性等关键指标,组织内部测评、抽样核验与问题归因,支撑项目阶段验收与综合验收。3. LLM-as-a-Judge / LLM-as-a-Verifier 评测流水线建设设计并落地基于大模型的自动化评测流水线,包括 prompt 设计、CoT 设计、多 agent 协同、批处理、可控解码、结果聚合与一致性校准,重点解决专业科研场景下大模型评测的幻觉、偏差和稳定性问题。4. 专用评测模型训练与优化基于领域评测数据集,参与 fine-tune 或训练专用打分器、分类器、embedding 模型,与 LLM-as-a-Judge / LLM-as-a-Verifier 路径互补,提升评测结果的稳定性、专业性与可量化程度。5. 评测驱动的算法、数据与产品迭代主导或参与评测结果分析与问题归因,输出可执行的算法优化、数据采集、数据清洗、标注策略与产品改进建议,与算法、数据、产品、工程团队形成“评测—迭代—再评测”的闭环机制。6. 科研项目统筹与交付管理将既有项目书、年度任务和验收要求转化为可执行的里程碑计划,明确交付物清单、验收口径、质量目标与风险节点,持续跟踪项目进度,推动阶段性任务和综合验收按期完成。 职位要求 1. 教育背景与专业基础硕士及以上学历,化学、化工、化学信息学、材料、生物医药、计算机、人工智能等相关专业优先,博士优先;具备跨学科科研经历或 AI for Science 项目经验者优先。2.
【27届校招】算力平台运维开发工程师 广州 正式 研发 - 算法 职位描述 作为数据基础设施组的运维开发工程师,您将会了解前沿的自动驾驶数据和算法训练平台的基础架构以及有机会获得运维大规模人工智能训练平台的经验。1、持续对提供的基础架构及上层应用进行监控,并针对可能出现的问题,持续更新及优化所需的监控工具及监控内容,保证基础架构的服务可靠性满足SLA的要求;2、配合算法、开发同学对机器学习中出现的问题进行定位,持续优化基础架构层提供的服务;3、负责研发训练平台CI/CD环境运维,软件自动化构建,以及开发流程支持。1、持续对提供的基础架构及上层应用进行监控,并针对可能出现的问题,持续更新及优化所需的监控工具及监控内容,保证基础架构的服务可靠性满足SLA的要求;2、配合算法、开发同学对机器学习中出现的问题进行定位,持续优化基础架构层提供的服务;3、负责研发训练平台CI/CD环境运维,软件自动化构建,以及开发流程支持。1、持续对提供的基础架构及上层应用进行监控,并针对可能出现的问题,持续更新及优化所需的监控工具及监控内容,保证基础架构的服务可靠性满足SLA的要求;2、配合算法、开发同学对机器学习中出现的问题进行定位,持续优化基础架构层提供的服务;3、负责研发训练平台CI/CD环境运维,软件自动化构建,以及开发流程支持。 职位要求 1、掌握一种以上的编程语言,如Python,Go或Java;3、掌握一种以上的Linux脚本,如bash;4、深入理解kubernetes,docker,containerd的相关内容,有使用helm管理kubernetes应用的经验的优先;5、有使用promethus及grafana进行服务监控的经验;6、使用过Jenkins,Spinnaker, gitlab等开发CICD;7、有一定的使用pytorch开发机器学习平台或算法的经验,了解pytorch深度学习框架; 投递...
AI全栈开发工程师(B端平台 & B端产品) 北京 全职 互联网 / 电子 / 网游 - 研发 职位描述 1. 构建与迭代B端Agent平台与产品能力:工作流编排(DAG / State Machine)、多智能体协作、会话与任务系统(异步/长任务)、记忆与上下文管理。2. 负责 Agent 工具体系工程化:工具注册/版本与兼容策略、参数 Schema(JSON Schema/Pydantic)、鉴权与租户隔离、幂等/重试/限流、失败降级、回放与审计。3. 落地企业级 RAG:多源数据接入(文档 / DB / ES / 内网系统)、切分与索引、混合检索(Milvus / PGVector + ES)、重排、引用溯源、增量更新、权限过滤(ACL /
AI全栈开发工程师 北京 全职 互联网 / 电子 / 网游 - 研发 职位描述 1. 构建与迭代B端Agent平台与产品能力:工作流编排(DAG / State Machine)、多智能体协作、会话与任务系统(异步/长任务)、记忆与上下文管理。2. 负责 Agent 工具体系工程化:工具注册/版本与兼容策略、参数 Schema(JSON Schema/Pydantic)、鉴权与租户隔离、幂等/重试/限流、失败降级、回放与审计。3. 落地企业级 RAG:多源数据接入(文档 / DB / ES / 内网系统)、切分与索引、混合检索(Milvus / PGVector + ES)、重排、引用溯源、增量更新、权限过滤(ACL / RBAC /
共创-云原生开发工程师-觅蜂子公司 上海 校招 正式 技术族 - 软件类 职位 ID:A250462 职位描述 觅蜂科技(Maniformer)是全球领先的一站式物理AI数据服务平台,致力于打造具身智能数据的 “平台型供给” 基础设施,实现数据的体系化、标准化、规模化供给。1.负责公司 Kubernetes 集群的规划、部署、升级、监控与高可用保障,支撑数百节点规模的生产环境;2.设计并实施安全、稳定、高效的 CI/CD 流水线,集成 GitOps(如 Argo CD)、Helm、Kustomize 等工具;3.优化集群资源利用率,通过 HPA/VPA、Cluster Autoscaler、Cost Allocation 等手段实现成本可控;4.构建可观测性体系:基于 Prometheus + Grafana + Loki + Tempo 实现日志、指标、链路追踪一体化监控;5.制定并落地 K8s 安全策略:包括 Pod Security
Location:CN-Shenzhen-HyQ Shift:Standard - 40 Hours (China) Scheduled Weekly Hours:40 Worker Type:Permanent Job Summary:The Senior Java Developer will play a key role in the strategic replacement of a legacy clearing platform by designing, developing, and delivering robust,
云原生 DevOps 研发工程师-2027届 北京、上海 校招 正式 研发 - 后端开发 职位描述 1. 参与 MiniMax 云原生 DevOps 平台建设,支撑研发、训练、推理、业务服务的高效交付。2. 建设 CI/CD、GitOps、环境管理、发布系统、配置管理和自动化运维工具链。3. 基于 Kubernetes、ArgoCD、Tekton / GitLab CI、Helm 等技术提升交付效率和发布稳定性。4. 探索 AI Coding、Agent 与工程平台结合,提升研发、排障、发布和运维自动化水平。 职位要求 1. 2027届本科及以上学历,计算机、软件工程、自动化等相关专业优先。2. 熟悉 Linux、网络、容器、CI/CD 基础,对研发效能和平台工程有兴趣。3. 熟悉 Kubernetes、Docker、Helm、GitLab CI、ArgoCD、Terraform 等任一技术优先。4.
Some careers have more impact than others. If you’re looking for a career where you can make a real impression, join HSBC and discover how valued you’ll be. We are currently seeking an experienced professional to
云原生研发工程师-觅蜂子公司 上海、北京 校招 正式 技术族 - 系统架构类 职位 ID:A209974 职位描述 觅蜂科技(Maniformer)是全球领先的一站式物理AI数据服务平台,致力于打造具身智能数据的 “平台型供给” 基础设施,实现数据的体系化、标准化、规模化供给。1. 负责混合云场景下基于 Kubernetes 的 Genie Studio 平台核心系统的设计、开发和维护,包括多云管理、边缘集群管理、私有化部署、资源管理、GPU 设备管理及优化、容器编排调度、运行时优化等方向中的一项或多项,持续提升平台产品的资源利用率、稳定性和易用性。2. 负责混合云场景下基于 Kubernetes 的 Genie Studio 平台基础服务的搭建、开发和维护,如:a. 网络:容器网络、RDMA、API 网关等b. 存储:分布式文件存储、对象存储等c. 边缘节点:大规模机器人节点管理、网络通信优化等d. 调度编排:训练、推理、云边联合任务、工作流等3. 与实施交付的 SRE 沟通协调,参与系统优化及问题定位,保证项目顺利部署实施。4. 跟踪云原生生态发展趋势,推动云原生 Genie
共创-运维开发工程师-觅蜂子公司 上海、北京 校招 正式 技术族 - 解决方案类 职位 ID:A96385B 职位描述 觅蜂科技(Maniformer)是全球领先的一站式物理AI数据服务平台,致力于打造具身智能数据的 “平台型供给” 基础设施,实现数据的体系化、标准化、规模化供给。1. 部署与交付- 在私有化 / 混合云 / 边缘集群等场景完成 Genie Studio 平台的安装、部署与基础配置(云主机/物理机/K8s 集群)。- 根据项目方案协助环境勘察与规划:服务器配置、网络拓扑、域名与证书、存储与备份策略等。独立处理交付中的常见问题(安装失败、服务启动异常、网络不通、权限配置等),对复杂/陌生问题能清晰描述现象并完成初步排障,必要时与二线/研发协同远程解决。- 能独立部署高可用 Kubernetes 集群,理解业务流量走向并完成常见资源(Pod/Service/Deployment/StatefulSet/PVC/Ingress 等)的排障。2. 客户对接与日常支持- 作为一线窗口承接客户咨询与问题反馈,理解客户诉求并给出初步解决方案或使用建议。- 将功能缺陷、体验问题与客户需求沉淀为问题单/需求单,完成问题分拣并跟进至闭环。- 配合产品与平台团队,参与并持续优化智能客服/自助知识库(FAQ、操作指南、排障流程),提升客户自助解决率、降低一线重复工作量。- 规范使用与维护飞书/企业微信/工单系统等沟通与支持渠道。3. 文档与规范- 编写/完善安装部署文档、标准作业手册(SOP)、常见问题与解决方案等交付文档。- 参与项目全流程并推动标准化:需求澄清
Some careers have more impact than others. If you’re looking for a career where you can make a real impression, join HSBC and discover how valued you’ll be. We are currently seeking an experienced professional to
Some careers have more impact than others. If you’re looking for a career where you can make a real impression, join HSBC and discover how valued you’ll be. We are currently seeking an experienced professional to
共创-测试开发工程师-觅蜂子公司 上海 校招 正式 技术族 - 测试类 职位 ID:A215803 职位描述 觅蜂科技(Maniformer)是全球领先的一站式物理AI数据服务平台,致力于打造具身智能数据的 “平台型供给” 基础设施,实现数据的体系化、标准化、规模化供给。- 参与数据平台产品相关的服务部署、平台维护、数据迁移、故障处理等工作- 负责开发自动化运维平台,制定并不断完善平台的运维规范、故障应急处理流程。- 负责产品的私有化交付,负责Kubernetes集群的部署,集群的故障定位、运维服务支持等工作。 职位要求 - 计算机科学、电子信息、数学等相关专业,本科及以上学历;- 具有扎实的Linux、网路、操作系统基础知识和优化技能;- 熟悉常见公有云操作, 在 Iass / 中间件 / 平台运维 某一个或多个具有丰富的运维经验- 掌握 Terraform / Ansible 等自动化运维工具,对Kubernetes/Jenkins/Docker/Helm/Gitlab等系统有一定的了解;- 具有一定的编程能力, 至少熟悉Python/Go/C++/Shell等其中一种语言- (加分项)有过自动驾驶、人形机器人行业从业者优先。 投递...
SRE工程师 热招 深圳 全职 研发 热招职位 职位描述 1、负责业务基础环境建设与维护,保障系统稳定运行;2、推进DevSecOps,协同安全部门落实安全要求与政策,提升企业安全水平;3、维护容器平台稳定性,完善监控与应急机制,确保故障快速定位与恢复;4、建设与优化流量治理、可观测和应急响应体系;5、通过自动化工具链与平台的构建,持续优化并提升交付效率与质量。 职位要求 1. 本科及以上学历,计算机科学、软件工程或相关专业优先;2. 3年以上系统运维/SRE/DevOps经验;有大规模容器集群管理或云环境项目经验者优先,制造业/全球分布式系统背景加分;3. 容器与编排:精通K8s,具备大规模集群管理、升级/迁移经验(如100+节点环境),熟悉Helm/Kustomize包管理;4、掌握安全集成方法,如容器安全基线(CIS Benchmarks)、CI/CD安全插件(SonarQube、Trivy)、配置管理安全(Secrets管理、RBAC);5、熟悉AWS(EKS/ECS)、阿里云(ACK)或GCP(GKE)等主流服务,包括云网络、存储与安全配置;有混合云部署经验优先;6、掌握至少一门脚本语言(如Python/Go/Shell),用于工具开发、API集成与自动化运维(如Ansible playbook、Python监控脚本);7、软性素质: - 高度责任心:对系统可靠性有强主人翁感,能主动识别风险并推动改进; - 沟通协作能力:跨团队(开发、安全、业务)高效协调,善于根因分析与问题复盘; - 应对挑战:高压环境下保持冷静,快速学习新技术,支持24/7 on-call(轮值响应)。 投递...
AI 智算基础设施 SRE(集群可观测 / 存储治理 / 资源整合) 上海 全职 职位描述 1.可观测与告警:使用Prometheus、Grafana等组件、搭建集群资源监控大盘和告警机制;2.存储治理:治理分布文件系统存储、对象存储,挂载规范、目录分层、配额与容量巡检;3.集群维护: 参与集群维护、任务调度组件、监控组件日常维护与排障修复。 职位要求 1.本科及以上,计算机、网络相关专业,熟练 Shell/Python;会使用 Helm、Ansible 等做组件部署与配置管理;2.熟悉 K8s 运维:节点、Pod 资源模型、存储(PV/PVC、HostPath)、调度现象与排障;3.熟练使用 Prometheus/Grafana:PromQL、大盘设计、告警规则与运营;4.熟悉 NFS 与对象存储(S3/MinIO):AI 训练场景下的挂载、权限、容量与 IO 问题排查;5.有生产 K8s 集群运维、监控平台建设或 AI 训练集群 SRE 经验。加分项1.Ceph、Lustre、GPFS 或大规模并行文件系统经验;2.Elasticsearch、Loki、Jaeger 等组件部署调优;3.智驾 / 大规模 AI
运维工程师 热招 武汉 互联网 / 电子 / 网游 职位描述 1. 在指导下完成业务的部署、发布与发布后验证2. 负责监控看板与告警响应,日常备份/巡检/容量盘点3. 参与CI/CD流水线与自动化脚本维护(如 Jenkins / GitLab CI + Ansible)4. 参与重要节点(开服/活动/版本上线)运维与值守5. 整理操作手册/变更记录/故障复盘,推动小范围优化或异常排查(如 服务器资源使用优化、CDN流量异常监测及处理) 职位要求 职位要求1. 本科及以上,1-3年左右相关经历(或优秀实习/项目经历)2. 熟悉主力云(如阿里云/腾讯云)基础资源云主机、VPC/安全组、负载均衡、对象存储、日志服务、CDN3. 会一种常用数据库的备份恢复与基础调优(如MySQL/Redis)4. 至少掌握一种脚本/语言(如Python/Shell/Go),能完成运维小工具5. 掌握CI/CD与配置/批量管理(Ansible/saltstack)6. 具备问题定位与文档化能力,能适应版本节奏与值班加分项1. 熟悉Docker/Kubernetes基本对象;会用Helm/ArgoCD做发布与回滚2. 有实操WAF/Cloudflare/DDoS等安全产品,具有一定策略规则设计能力3. 有小型运维平台/脚本工具作品(Python/Go/Node) 投递...
系统架构工程师 深圳 全职 互联网 / 电子 / 网游 职位 ID:A108755 职位描述 1、负责公司混合云的整体架构设计、实施与成本优化,保障核心业务系统的高可用性与安全性;2、主导K8s生产级集群的从0到1建设、版本升级、扩容及多集群治理;负责容器网络(CNI)、存储(CSI)方案选型及性能调优;3、负责私有云虚拟化平台(VMwarevSphere/vSAN与HCI)的运维优化,统筹计算、存储资源池的容量规划,提升资源利用率;4、建设全链路监控与可观测体系,主导复杂生产环境故障的根因分析、排查与恢复,确保持续交付质量;5、负责数据库的高可用基础架构搭建与备份策略制定,协助开发团队进行性能协同分析;6、推动基础设施即代码(laC)落地,利用Terraform/Ansible等工具实现运维自动化,优化CI/CD流程。 职位要求 1、本科及以上学历,计算机相关专业,8年以上基础架构运维经验,具备大规模混合云环境实战背景;2、熟悉AWS/Azure/腾讯云等至少两种主流公有云,并在其中一种具备生产环境架构设计或深度运维经验;3、精通Kubernetes架构,有生产级集群从0到1部署、升级及故障恢复经验;深入理解容器网络与存储原理,熟悉Helm、Docker等生态工具;4、熟悉VMwarevSphere、vSAN或HCI超融合架构,具备实际部署、调优及故障处理经验;5、熟悉主流关系型数据库高可用原理(主从/集群/备份),具备基础架构层面的问题定位能力;6、熟练掌握Terraform、Ansible等自动化工具,有推动laC落地及CI/CD集成实践经验。 投递...
数据平台开发工程师 广州 全职 通用智能板块 职位描述 1、平台架构与核心开发:负责数据平台的整体架构设计与核心模块开发,构建稳定、高效、可扩展的后端系统,支撑PB级数据处理需求;2、数据工程与流水线:设计与构建面向海量、多模态AI数据的高性能存储、处理与计算流水线,支持标签、向量检索;3、云原生技术落地:基于Kubernetes生态构建容器化、微服务化的数据平台,实现资源的高效利用与系统的弹性伸缩;4、全栈开发与产品化:负责云平台中后台管理系统及数据可视化界面的前后端研发,将平台能力产品化,为内外部用户提供清晰、易用的操作界面;5、数据治理与优化:设计并落地数据挖掘、数据生产、数据集管理等方案,优化数据生命周期管理。 职位要求 1、基础要求:计算机科学、软件工程或相关专业本科及以上学历,具备扎实的计算机基础;2、 经验要求:3-5年后端/大数据开发经验,对高并发、分布式、高可用系统有深入理解和实战经验;3、技术栈要求: - 精通Golang或Java,熟悉Python; - 熟悉数据湖/仓技术(如Delta Lake, Iceberg、Lance)或OLAP引擎(如StarRocks, Doris); - 熟悉数据仓库建模、ETL流程及调度系统;4、工程素养:具备良好的编码规范、单元测试习惯和代码重构能力,能够胜任从0到1的系统搭建与持续优化;加分项1、有MLOps/DataOps平台建设经验,有Web全栈经验,属性 vue、react 常用组件库;2、熟练掌握Kubernetes及其生态(如Helm、Kustomize );3、有自动驾驶、机器人或智能座舱相关领域经验;4、具备出色的沟通理解力,能精准协同内外;同时拥有强烈的自驱力,能主动发现问题、驱动闭环并持续优化。 投递...
Job Description: 工作职责 1. Doris 集群全生命周期管理 - 负责 Apache Doris 集群的部署架构设计、高可用配置(3FE/3BE+)、日常运维与监控体系建设 - 主导大版本升级(如 2.1→3.0 存算分离)、灰度发布、回滚预案设计与演练 - 7×24 小时稳定性保障,快速响应并解决 FE/BE 故障、Tablet 异常、Compaction 积压、OOM 等问题 - 建立完善的巡检、告警(Prometheus/Grafana)、故障复盘与 SOP 沉淀机制 2. 性能调优与治理 - 基于业务场景进行 Doris 表模型选型(Duplicate/Unique Key/Aggregate)、分区策略、分桶设计与 Sort Key