Some careers have more impact than others. If you’re looking for a career where you can make a real impression, join HSBC and discover how valued you’ll be. We are currently seeking an experienced professional to
高级存储研发专家(AI 训练数据缓存加速方向) 北京 全职 互联网 / 电子 / 网游 - 研发 职位描述 1.主导设计和研发下一代分布式多级分层缓存加速系统,基于 GPU 主机本地内存、NVMe SSD、远端并行文件系统构建大容量弹性扩缩容的多级缓存架构,实现数据按需与透明加速;2.参与设计和研发百 PB 规模的分布式文件缓存系统,支撑自动驾驶、大语言模型等业务的大规模分布式 AI 训练集群;3.设计并实现智能数据放置与生命周期管理策略(如基于访问热度的分层调度、TTL/LRU 淘汰、预取优化),降低 GPU 因存储 I/O 导致的停顿;4.参与研究和落地高性能存储软硬件技术栈,如 GPU Direct Storage、NVMe-oF、RDMA、Burst Buffer 等,持续优化端到端数据通路性能;5.参与元数据管理系统设计,实现高效的路径查找和缓存机制,保证元数据访问延迟在毫秒级。 职位要求 1.本科及以上学历,5 年以上分布式存储系统、缓存系统、文件系统或相关大规模系统软件研发经验;2.熟练掌握 Rust、C/C++、Golang 中至少一种系统编程语言,具备在大型软件项目中应用AI Coding 的经验;3.深入理解分布式系统设计原理(一致性、复制、分片、容错),有
AI运维工程师 北京 全职 互联网 / 电子 / 网游 职位描述 职位描述1.负责公司IDC、公有云(火山云/腾讯云等)的规划、部署、监控与优化,保障业务高可用性(SLA ≥ 99.9%);2.负责管理公司GPU集群,调配训练平台资源;3.设计并实施自动化运维体系(Ansible/Terraform/Jenkins等),提升系统部署、监控告警、故障处理效率;4.维护大规模Linux服务器集群(CentOS/Ubuntu)、Kubernetes/Docker容器平台及中间件(Nginx/MySQL/Redis等)、大规模数据存储;5.建立全链路监控体系(Zabbix/Prometheus/Grafana),实时分析系统性能瓶颈,预防潜在风险;6.制定并执行容灾备份、安全加固及合规策略,响应安全事件;7.编写运维文档及技术方案,推动DevOps文化落地; 职位要求 职位要求硬性条件:1.本科及以上学历,计算机/通信相关专业,3年以上人工智能科技公司运维经验;2.具备GPU集群管理经验,了解ROS/ROS2生态;3.精通Linux系统管理、Shell/Python脚本开发,熟悉TCP/IP、HTTP等网络协议;4.熟练使用至少一种公有云(火山云/腾讯云/阿里云),有PB级存储搭建经验,具备云资源编排及成本优化经验;5.掌握容器化技术(Docker/K8s)及CI/CD工具链(GitLab/Jenkins);6.熟悉监控日志系统(ELK/Prometheus)及自动化运维工具(Ansible/SaltStack)。加分项:1.有高并发、分布式系统运维经验者优先;2.熟悉网络安全防护(WAF/防火墙/漏洞扫描);3.持有AWS/AliCloud/K8s认证证书;4.有大模型相关基础设施搭建经验;5.了解Infrastructure as Code(IaC)实践。。 投递...
存储平台研发工程师-2027 届 北京、上海 校招 正式 研发 - 后端开发 2027届校园招聘 职位描述 关于我们我们是一家AI大模型公司。训练一个模型需要读多少数据、Checkpoint 存到哪里、几千张卡同时读同一份数据集会发生什么——这些问题最后都会落到存储上。存储平台团队负责公司 PB 级数据的存与取,建设从底层数据结构到上层服务化的自研系统。你可能会做什么:1、在以下一到两个方向上深入,并在实习或入职初期与导师一起探索与解决存储命题:分布式存储内核 数据面与元数据服务的设计与实现。副本与纠删码、一致性协议、索引结构、IO 路径优化、海量小文件与元数据扩展性。这个方向偏底层, 需要你对操作系统、文件系统、网络与存储介质有真实的好奇心;2、存储管控与服务化 集群的编排、调度、扩缩容、多租户与配额、数据生命周期管理、迁移与数据流转链路。让一套复杂系统变得可被安全操作,本身是很难的工程问题;3、存储运营与效率 容量与性能的建模和推演、成本效率优化、资源画像与水位管理、数据分层策略。这个方向需要你既写得了代码,也算得清账;4、稳定性保障可观测体系、异常检测、故障定位与自愈、一致性校验、混沌演练。目标是在系统规模持续增长的同时,把故障影响面持续压小。 职位要求 我们希望你具备:1、计算机、软件工程或相关专业;2027 年毕业;2、扎实的计算机基础:数据结构与算法、操作系统、计算机网络。学过或自学过分布式系统是加分;3、至少熟练一门系统级编程语言(C++ / Go / Rust),写过能跑起来、有一定复杂度的东西;4、有独立定位和解决问题的经历——不管是课程项目、开源贡献、竞赛还是自己折腾的玩具项目,我们更关心你遇到问题之后做了什么。 投递...
高级存储研发高级工程师(AI 训练数据缓存加速方向) 北京 全职 互联网 / 电子 / 网游 - 研发 职位描述 1.主导设计和研发下一代分布式多级分层缓存加速系统,基于 GPU 主机本地内存、NVMe SSD、远端并行文件系统构建大容量弹性扩缩容的多级缓存架构,实现数据按需与透明加速;2.参与设计和研发百 PB 规模的分布式文件缓存系统,支撑自动驾驶、大语言模型等业务的大规模分布式 AI 训练集群;3.设计并实现智能数据放置与生命周期管理策略(如基于访问热度的分层调度、TTL/LRU 淘汰、预取优化),降低 GPU 因存储 I/O 导致的停顿;4.参与研究和落地高性能存储软硬件技术栈,如 GPU Direct Storage、NVMe-oF、RDMA、Burst Buffer 等,持续优化端到端数据通路性能;5.参与元数据管理系统设计,实现高效的路径查找和缓存机制,保证元数据访问延迟在毫秒级。 职位要求 1.本科及以上学历,5 年以上分布式存储系统、缓存系统、文件系统或相关大规模系统软件研发经验;2.熟练掌握 Rust、C/C++、Golang 中至少一种系统编程语言,具备在大型软件项目中应用AI Coding 的经验;3.深入理解分布式系统设计原理(一致性、复制、分片、容错),有
location : Shanghai/Shenzhen/Guangzhou Global Private Banking & Wealth International Wealth and Premier Banking (IWPB) provides a leading premium proposition through Premier Banking and, together with our Private Bank, are present across the world’s most important markets,
location : Shanghai/Shenzhen/Guangzhou Global Private Banking & Wealth International Wealth and Premier Banking (IWPB) provides a leading premium proposition through Premier Banking and, together with our Private Bank, are present across the world’s most important markets,
岗位职责 负责大语言模型 pretrain 数据算法的设计与实现,包括数据选择、质量建模、去重、过滤、数据配比、合成数据与课程学习等方向。 将数据算法落地到大规模数据处理流程中,基于 Ray、Spark 等分布式框架处理海量训练数据。 设计并执行数据消融实验,评估不同数据源、质量过滤策略、去重策略、配比方案和采样策略对模型能力的影响。 建设数据到模型效果的实验闭环,结合训练 loss、benchmark、能力维度评测、训练动态和样本分析,定位数据问题并迭代数据策略。 岗位要求 计算机、人工智能、数学、统计学等相关专业,本科及以上学历。 熟悉大语言模型预训练范式,理解 pretrain 数据对模型能力、训练稳定性和 scaling behavior 的影响。 具备扎实的机器学习、NLP 或大模型算法基础,能够独立完成算法设计、实验设计、结果分析和策略迭代。 熟练使用 Python,熟悉 PyTorch、TensorFlow、JAX 等至少一种深度学习框架。 熟悉大规模数据处理,有 Ray、Spark 等分布式计算框架使用经验。 具备良好的工程实现能力,能够将数据算法实现为稳定、高效、可复用的大规模处理 pipeline。 具备较强的数据分析能力,能从 loss 曲线、评测结果、数据分布和样本案例中定位问题。 具备良好的论文阅读、问题拆解和跨团队协作能力。 加分项 有 LLM
优才-分布式数据平台研发工程师-灵犀业务部 上海、北京 校招 正式 技术 - 算法类 职位 ID:A84823 职位描述 1、参与 PB 级数据存储与管理平台建设,支持数据检索、版本、权限和血缘管理。2、搭建分布式数据处理流水线,支持数据清洗、转换、自动标注、质检和发布。3、建设采训推一站式平台,打通数据、训练、评测和模型发布流程。4、完善系统监控、容错和故障恢复能力,保障平台稳定运行。 职位要求 1、2027 届本科及以上学历,计算机、软件工程等相关专业。2、熟练掌握 Python,具备 C++、Rust、Go 或 Java 中至少一门语言的开发经验。3、熟悉分布式系统、计算机网络和数据库基础。4、熟悉 Kafka、S3、Spark、Ray、Flink、Docker、Kubernetes 中的一种或多种。5、有分布式系统、数据平台、工作流或开源项目实践者优先。6、在分布式系统、数据工程、云计算等相关领域顶级会议发表论文者优先。 投递...
Tech Lead - 自动驾驶工具链 北京、广州 全职 职位描述 在小马智行,你将主导构建支撑自动驾驶系统研发的核心工具基建。面对 PB 级数据处理、超大规模仿真、跨地域研发协作和复杂系统调试的挑战,你的技术方案将直接影响成百上千位工程师的研发效率,并成为自动驾驶规模化落地的重要基础能力你将负责负责自动驾驶核心工具链的技术方向与架构演进,包括但不限于:1. 架构研发: 构建高置信度的云原生仿真系统架构,为算法验证提供稳定底座,支撑大规模自动化评测与回归2. 性能优化: 优化全链路计算资源调度与关键性能瓶颈,提升高并发场景下的稳定性、吞吐能力与资源利用率3. 平台建设: 主导工具链平台架构设计与技术选型,推进仿真、数据与评测能力的体系化建设与持续演进4. 技术规划: 协同团队制定技术路线,推动核心指标持续提升,平衡短期交付与长期平台能力沉淀5. 工程质量: 推行高标准代码规范与工程实践,主导设计评审、代码审查等质量保障机制建设 职位要求 我们期待你1. 5 年以上软件开发经验,拥有技术团队协作和核心技术负责人经历,能够独立把控技术方向2. 熟练掌握至少一门主力语言(C++/Python),能够主导关键技术决策,并具备 hands-on 实战能力3. 熟悉 k8s 及其生态系统,具备云原生架构设计、微服务治理或大型云平台性能优化经验4. 具备强 owner 意识与优秀的跨部门协作能力,能够推动复杂技术决策落地5. 拥有开放的技术视野与快速学习能力,能够在高强度环境下解决复杂系统问题加分项1. 有自动驾驶仿真工具开发、自动驾驶开发经验2. 有大规模计算资源调度管理与性能调优实践经验3. 有大型互联网平台或云基础设施建设经验加入我们,你将获得1.
AI 数据基础架构工程师 武汉、北京 校招 正式 软件研发类 2027届校园招聘计划 职位描述 参与支撑数亿设备、PB 级数据规模的湖仓一体架构研发,主导 AI Agent 在大数据全链路的落地,作为 Apache 顶级开源项目贡献者,和全球开发者一起定义下一代数据基础设施。工作内容1、构建 AI 时代的数据底座:参与 Apache Doris、Kyuubi 等 OLAP 引擎,Kestra、Ray 等调度引擎,Iceberg、Paimon、Lance 等数据湖存储引擎的研发与优化,打造支撑大模型训练、Agent 实时决策的湖仓一体底座。2、保障 PB 级数据服务高可用:负责线上服务的性能、稳定性与质量优化,推进存算分离架构升级、自动化运维与跨可用区容灾能力建设。3、研发大数据场景通用 Data Agent:基于大模型打造覆盖数据需求理解、建模、开发、消费、运维全链路的智能 Agent,推动数据工作流从人找数据向Agent 主动服务升级。4、参与全球顶级开源社区共建:作为 Apache Doris、Paimon 等项目核心贡献者提交 PR,参与多维计算、湖流一体、多模态计算等前沿方向研发。 职位要求 1、扎实的 Java、C++、Golang
数据平台负责人 北京、深圳 全职 智能制造 / 工业互联网 / 工业自动化 职位描述 1. 负责具身智能数据平台团队整体管理,带领数据运营、数据工程、数据算法三个方向;2. 对数据平台核心结果负责,包括: - 原始数据采集产能 - 有效训练数据产能 - 数据质量与数据可用率 - 数据处理链路效率与稳定性3. 建立从数据需求 → 采集 → 标注 → 清洗 → 质检 → 挖掘 → 数据集交付 → 训练反馈的完整数据闭环;4. 负责数据运营体系建设,包括采集/标注
校招-大模型算法工程师(数据闭环方向) 上海、北京 校招 正式 数字技术 - 算法 硕士及以上 2027届校园招聘-正式批 职位 ID:A151513A 职位描述 负责智能辅助驾驶端到端模型的强化学习训练框架设计与优化,包括但不限于 PPO、GRPO、DPO、Offline RL、RLHF 等技术路线。负责智能辅助驾驶训练数据体系建设,包括数据版本管理、数据质量评估、场景覆盖分析、长尾场景挖掘和数据迭代策略设计。负责智能辅助驾驶奖励模型(Reward Model)和评测体系建设,设计兼顾安全性、舒适性、效率和规则遵守的奖励函数体系。负责智能辅助驾驶模型训练闭环建设,包括数据挖掘、数据生产、训练、评测、回灌和迭代优化。负责大规模分布式训练任务开发与优化,提升训练效率、资源利用率和模型收敛效果。探索 Diffusion、Autoregressive、World Model、RL 等前沿技术在智能辅助驾驶中的应用,并推动落地。跟踪学术界和工业界最新进展,推动先进算法在业务中的快速验证和落地。 职位要求 计算机、人工智能、自动化、机器人等相关专业硕士及以上学历。扎实的机器学习和深度学习基础,熟悉 Transformer、Diffusion、LLM 等主流模型架构。熟悉强化学习基础理论,包括:MDP、Policy Gradient、Actor-Critic、Offline RL熟悉智能辅助驾驶训练链路,包括:数据构建数据清洗数据版本管理模型训练模型评测闭环迭代具备良好的工程能力,能够独立完成算法设计、实验验证和线上部署。加分项智能辅助驾驶方向有端到端智能辅助驾驶(E2E Driving)经验。有 Planning、Behavior、Trajectory Prediction 或 Closed-loop Simulation 经验。有 CARLA、闭环仿真或真实车辆部署经验。有智能辅助驾驶数据引擎建设经验。有数据版本管理平台设计经验。数据与训练体系方向有 PB 级数据管理经验。有训练数据自动发版体系建设经验。有数据质量度量、场景覆盖分析、难例挖掘经验。有训练效率优化经验(吞吐、收敛、成本优化)。学术背景在以下顶级会议或期刊发表论文者优先有智能辅助驾驶、强化学习或大模型方向高质量开源项目经验者优先。 投递...
公司描述 Do you want beneficial technologies being shaped by your ideas? Whether in the areas of mobility solutions, consumer goods, industrial technology or energy and building technology - with us, you will have the chance to