Some careers have more impact than others. If you’re looking for a career where you can make a real impression, join HSBC and discover how valued you’ll be. We are currently seeking an experienced professional to
Global Private Banking & Wealth International Wealth and Premier Banking (IWPB) provides a leading premium proposition through Premier Banking and, together with our Private Bank, are present across the world’s most important markets, booking centres, and
技术中心 - 数仓开发工程师 广州 技术类 职位描述 1、负责公司海量数据的接入,包括不限于服务端日志、客户端日志、外部聚合数据等,搭建公司数据中台,建设国内海外数据仓库;2、负责实时和离线数据开发,提供高质量、稳定的数据服务,为业务部门赋能;3、参与数据治理,面对PB级存量数据和万亿条级别的新增数据量,提升数据易用性及数据质量,降低数据处理成本;4、负责数仓平台内各种大数据、高并发、数据治理等方面的技术设计和落地;5、负责公司自建大数据的组件维护与调优。 职位要求 1、本科及以上学历,计算机相关专业,三年以上数仓工作经验;2、具备较好的Java/Python编码和SQL能力,能保质保量完成数据建设和数据分析工作;3、熟悉数仓建模理论,有完整数仓的建设经验,熟悉海量数据处理、ETL及任务调度、元数据管理、数据治理;4、熟悉大数据相关工具和框架,如StarRocks、Doris、Flink、Kafka、Hadoop、Hive、Spark、ClickHouse、Trino、Presto、FlinkCDC、Canal、DataX等数仓和ETL工具,具备集群与组件的调优能力;5、具备良好的团队协作和沟通能力,较强的工作规划和执行能力,积极推动项目进度;6、乐于探索新技术和业界新问题的解决方案,学习主动性强。 投递...
数据仓库工程师 深圳 社招 全职 职位描述 1、负责企业级数据仓库及业务数据集市的架构规划、分层设计(ODS/DWD/DWS/ADS)与落地实施,确保架构的先进性、可扩展性与高性能。2、主导核心业务域的数据建模工作,精通维度建模等方法论,设计通用灵活的数据模型与宽表,保障数据的一致性、完整性与复用性。3、设计并实现高效的ETL/ELT数据集成方案,负责数据提取、转换、加载全流程的开发、调度与优化,解决大规模数据处理中的性能瓶颈。4、推进数据治理体系建设,包括数据质量监控、元数据管理、数据血缘追踪、指标体系标准化等,提升整体数据质量与数据资产价值。5、负责数据仓库的日常运维与故障排查,保障数据服务SLA达标,及时响应并解决数据延迟、数据错误等线上问题,确保数据链路稳定可靠。6、深入理解业务需求,与数据分析、业务部门紧密协作,提供高质量的数据支持与解决方案,支撑业务决策、数据产品迭代及精细化运营。 职位要求 一、基础要求1、本科及以上学历,计算机科学、数据科学、信息技术等相关专业。2、3-7年及以上数据仓库设计与开发经验,有完整的企业级数据仓库建设项目经验优先。3、具备强烈的责任心、严谨的逻辑思维、良好的沟通协调能力及团队协作精神,对数据敏感,重视数据质量。二、 技术能力1、精通数据仓库理论体系,深入理解分层架构、主题域建模、维度建模等方法论,能结合业务场景设计合理的数据模型。2、精通SQL/HQL/Spark SQL开发及优化,能高效处理TB/PB级大规模数据集,具备复杂查询性能调优实战经验。3、熟悉大数据生态技术栈,具备Hadoop、Hive、Spark、Flink、Kafka等组件的实战应用经验;了解MPP数据库(ClickHouse、Doris)、OLAP引擎(Kylin、Presto)者优先。4、掌握Java/Python/Scala中的至少一种编程语言,具备良好的代码规范与工程化能力;熟悉ETL工具(DataX、Airflow、Kettle)及任务调度系统者优先。5、具备数据治理相关经验,熟悉数据质量监控、元数据管理、数据血缘分析等工具(如Apache Atlas、Griffin)的使用者优先。三、加分项1、有互联网、金融、电商等行业数据仓库建设经验者优先。2、有数据字典、指标管理体系从0到1搭建经验者优先。 投递...
提前批-大模型算法工程师(数据闭环方向) 上海、北京 校招 正式 数字技术 - 算法 硕士及以上 2027届校园招聘-技术提前批 职位 ID:A156209 职位描述 负责智能辅助驾驶端到端模型的强化学习训练框架设计与优化,包括但不限于 PPO、GRPO、DPO、Offline RL、RLHF 等技术路线。负责智能辅助驾驶训练数据体系建设,包括数据版本管理、数据质量评估、场景覆盖分析、长尾场景挖掘和数据迭代策略设计。负责智能辅助驾驶奖励模型(Reward Model)和评测体系建设,设计兼顾安全性、舒适性、效率和规则遵守的奖励函数体系。负责智能辅助驾驶模型训练闭环建设,包括数据挖掘、数据生产、训练、评测、回灌和迭代优化。负责大规模分布式训练任务开发与优化,提升训练效率、资源利用率和模型收敛效果。探索 Diffusion、Autoregressive、World Model、RL 等前沿技术在智能辅助驾驶中的应用,并推动落地。跟踪学术界和工业界最新进展,推动先进算法在业务中的快速验证和落地。 职位要求 计算机、人工智能、自动化、机器人等相关专业硕士及以上学历。扎实的机器学习和深度学习基础,熟悉 Transformer、Diffusion、LLM 等主流模型架构。熟悉强化学习基础理论,包括:MDP、Policy Gradient、Actor-Critic、Offline RL熟悉智能辅助驾驶训练链路,包括:数据构建数据清洗数据版本管理模型训练模型评测闭环迭代具备良好的工程能力,能够独立完成算法设计、实验验证和线上部署。加分项智能辅助驾驶方向有端到端智能辅助驾驶(E2E Driving)经验。有 Planning、Behavior、Trajectory Prediction 或 Closed-loop Simulation 经验。有 CARLA、闭环仿真或真实车辆部署经验。有智能辅助驾驶数据引擎建设经验。有数据版本管理平台设计经验。数据与训练体系方向有 PB 级数据管理经验。有训练数据自动发版体系建设经验。有数据质量度量、场景覆盖分析、难例挖掘经验。有训练效率优化经验(吞吐、收敛、成本优化)。学术背景在以下顶级会议或期刊发表论文者优先有智能辅助驾驶、强化学习或大模型方向高质量开源项目经验者优先。 投递...
AI院-大模型算法- GLM预训练数据研究 北京 全职 互联网 / 电子 / 网游 职位描述 一、大规模预训练数据处理与优化1. 设计和优化PB级训练数据的筛选、去重、清洗体系2. 基于LLM模型的语义级去重算法、质量筛选算法优化3. 领域特定数据筛选策略,支持代码、数学、科学等专业领域二、数据质量评估与优化体系1. 构建基于大模型的数据质量自动评估系统2. 设计数据多样性、复杂度、有用性等多维度评估指标3. 优化数据配比策略,包括领域权重、语言分布、质量分层4. 构建数据污染检测算法,识别测试数据泄露 职位要求 一、基础要求1. 统招硕士或以上学历,计算机、AI相关专业2. 大模型预训练项目经验,深度参与过大模型预训练数据处理3. 有处理TB级以上训练数据的实际项目经验二、技术能力1. 精通分布式计算框架(Spark、Ray、Maxcompute等)2. 掌握高性能文本处理算法(LSH、SimHash等)3. 熟悉云原生数据处理架构4. 熟悉数据质量评估指标和方法【加分项】1. 有开源大模型项目数据相关的贡献经验2. 发表过大模型数据相关的顶会论文3. 熟悉 AI 伦理与安全合规的数据处理流程 投递...
算法工程师 北京 全职 互联网 / 电子 / 网游 职位描述 一、大规模预训练数据处理与优化1. 设计和优化PB级多模态训练数据的筛选、去重、清洗体系2. 基于LLM模型的语义级去重算法、质量筛选算法优化3. 领域特定数据筛选策略,支持代码、数学、科学等专业领域二、数据质量评估与优化体系1. 构建基于大模型的数据质量自动评估系统2. 设计数据多样性、复杂度、有用性等多维度评估指标3. 优化数据配比策略,包括领域权重、语言分布、质量分层4. 构建数据污染检测算法,识别测试数据泄露 职位要求 一、基础要求1. 统招本科及以上学历,计算机、AI相关专业2. 大模型预训练项目经验,深度参与过大模型预训练数据处理3. 有处理TB级以上训练数据的实际项目经验二、技术能力1. 精通分布式计算框架(Spark、Ray、Maxcompute等)2. 掌握高性能文本处理算法(LSH、SimHash等)3. 熟悉云原生数据处理架构4. 熟悉数据质量评估指标和方法【加分项】1. 有开源大模型项目数据相关的贡献经验2. 发表过大模型数据相关的顶会论文3. 熟悉 AI 伦理与安全合规的数据处理流程 投递...
车端数据挖掘算法实习生(数据检索) 北京 实习 数字技术 职位 ID:A40566 职位描述 协助管理蔚来海量PB级别量产车回流数据;协助用模型对数据进行质检, 场景识别,打标;协助构建基于海量数据的数据检索系统; 职位要求 1、熟悉Python语言,有Lua编程经验/熟悉SQL优先2、有ROS系统下的开发经验优先3、熟悉常用的linux系统指令,习惯linux系统使用和操作,有长期远程服务器开发经验优先4、了解智能辅助驾驶感知、pnc等相关算法,对于算法的效果和corner case有一定认识,熟悉常用数据挖掘相关算法; 投递...
Data Infra Tech Lead 北京、上海、苏州 全职 研发 - 高级技术职位 职位描述 1、负责自动驾驶 & 通用大模型双赛道的数据底层基建全链路架构设计与研发,搭建支撑 VLM 大模型、视频生成、自动驾驶世界模型、端到端智驾模型训练的高性能、高可扩展数据生产平台;2、打通图像、视频、激光雷达点云、多传感器时序数据全生命周期链路,构建行业领先的数据治理体系,用 AI 工程化能力反哺数据生产全流程,持续驱动模型迭代效率与数据质量上限。 职位要求 1、经验门槛:具备扎实的大规模分布式系统架构设计、底层数据平台基建开发经验,具备完整复杂系统从 0 到 1 架构搭建与迭代优化经验;2、编程能力:精通 Python,熟练掌握 Go/C++ 至少一门主力开发语言,具备优秀的工程化设计、代码架构与性能调优能力;3、大数据基建功底:深度精通分布式数据处理技术,拥有TB/PB 级海量多模态数据存储、计算、调度、流水线开发经验,熟悉湖仓一体、对象存储、分布式计算生态技术栈;4、大模型全流程认知:深度熟悉大模型训练全流程,完整了解预训练、SFT 微调、RLHF 对齐全链路,理解大模型训练对数据体系、数据质量、数据供给链路的核心诉求。加分项:1、具备自动驾驶领域数据基建经验优先,熟悉激光雷达点云、车载多传感器融合数据处理、智驾场景数据挖掘、自动驾驶世界模型 / 端到端大模型数据体系建设经验优先;2、有长视频数据处理、3D 数据基建、大规模预训练数据集构建经验优先。 投递...
公司描述 Do you want beneficial technologies being shaped by your ideas? Whether in the areas of mobility solutions, consumer goods, industrial technology or energy and building technology - with us, you will have the chance to
26届校招-大模型算法工程师(预训练数据质量) 北京 正式 互联网 / 电子 / 网游 职位描述 【岗位职责】一、大规模预训练数据处理与优化1. 设计和优化PB级多模态训练数据的筛选、去重、清洗体系2. 基于LLM模型的语义级去重算法、质量筛选算法优化3. 领域特定数据筛选策略,支持代码、数学、科学等专业领域二、数据质量评估与优化体系1. 构建基于大模型的数据质量自动评估系统2. 设计数据多样性、复杂度、有用性等多维度评估指标3. 优化数据配比策略,包括领域权重、语言分布、质量分层4. 构建数据污染检测算法,识别测试数据泄露 职位要求 【任职要求】一、基础要求1. 统招本科及以上学历,计算机、AI相关专业2. 大模型预训练项目经验,深度参与过大模型预训练数据处理3. 有处理TB级以上训练数据的实际项目经验二、技术能力1. 精通分布式计算框架(Spark、Ray、Maxcompute等)2. 掌握高性能文本处理算法(LSH、SimHash等)3. 熟悉云原生数据处理架构4. 熟悉数据质量评估指标和方法【加分项】1. 有开源大模型项目数据相关的贡献经验2. 发表过大模型数据相关的顶会论文3. 熟悉 AI 伦理与安全合规的数据处理流程4. 多模态数据处理经验 投递...
数据仓库工程师 广州 全职 研发 - 大数据 职位描述 1、深度拆解业务需求,负责多产品线数仓通用模型设计、报表开发与迭代维护,具备数据模型架构设计、性能调优实战经验;2、熟悉主流大数据技术体系,独立负责离线、实时全链路数据开发,覆盖数据采集、清洗、建模、指标计算等全场景,完成编码、调试与性能优化,保障数据任务稳定高效运行;3、具备数据治理落地能力,持续保障数据的准确性、稳定性与时效性;4、推动 AI Agent 业务场景落地,结合大数据需求参与智能体搭建、调试与流程编排,落地智能故障排查、数据异常识别、任务自动化调度等能力,驱动数据体系智能化升级。 职位要求 1、本科及以上学历,计算机、大数据、人工智能等相关专业优先;工作严谨细致,具备良好抗压能力;2、三年及以上大数据和数据仓库开发工作经验,深度参与过 PB 级海量数据处理项目,具备独立建模能力,拥有数据分层、维度建模、指标口径统一、数据治理完整落地经验;3、熟悉大数据完整技术链路,熟练使用 Hadoop、Hive、Flink、Kafka、HBase、Doris 等主流组件,精通数据采集、存储、计算、调度、监控全流程原理与实操;4、熟悉 AI Agent 搭建与业务落地流程,能够协同团队完成大数据体系智能化改造、自动化运维、智能数据分析等场景落地,拥有 AI + 大数据融合项目经验者优先;5、有实时开发、任务性能调优、存储成本治理相关落地经验者优先。 投递...
大模型数据工程师/专家 北京 全职 互联网 / 电子 / 网游 职位描述 1、负责自动驾驶 & 通用大模型双赛道的数据底层基建全链路架构设计与研发,搭建支撑 VLM 大模型、视频生成、自动驾驶世界模型、端到端智驾模型训练的高性能、高可扩展数据生产平台;2、打通图像、视频、激光雷达点云、多传感器时序数据全生命周期链路,构建行业领先的数据治理体系,用 AI 工程化能力反哺数据生产全流程,持续驱动模型迭代效率与数据质量上限。 职位要求 1、具备扎实的大规模分布式系统架构设计、底层数据平台基建开发经验,具备完整复杂系统的架构搭建与迭代优化经验;2、熟练掌握Python/Go/C++ 等一到多门开发语言,具备优秀的工程化设计、代码架构与性能调优能力;3、深度精通分布式数据处理技术,拥有TB/PB 级海量多模态数据存储、计算、调度、流水线开发经验,熟悉湖仓一体、对象存储、分布式计算生态技术栈;4、深度熟悉大模型训练全流程,完整了解预训练、SFT 微调、RLHF 对齐全链路,理解大模型训练对数据体系、数据质量、数据供给链路的核心诉求。加分项:1、具备自动驾驶领域数据基建经验优先,熟悉激光雷达点云、车载多传感器融合数据处理、智驾场景数据挖掘、自动驾驶世界模型/端到端大模型数据体系建设经验优先;2、有长视频数据处理、3D 数据基建、大规模预训练数据集构建经验优先。 投递...
数据平台开发工程师 广州 全职 通用智能板块 职位描述 1、平台架构与核心开发:负责数据平台的整体架构设计与核心模块开发,构建稳定、高效、可扩展的后端系统,支撑PB级数据处理需求;2、数据工程与流水线:设计与构建面向海量、多模态AI数据的高性能存储、处理与计算流水线,支持标签、向量检索;3、云原生技术落地:基于Kubernetes生态构建容器化、微服务化的数据平台,实现资源的高效利用与系统的弹性伸缩;4、全栈开发与产品化:负责云平台中后台管理系统及数据可视化界面的前后端研发,将平台能力产品化,为内外部用户提供清晰、易用的操作界面;5、数据治理与优化:设计并落地数据挖掘、数据生产、数据集管理等方案,优化数据生命周期管理。 职位要求 1、基础要求:计算机科学、软件工程或相关专业本科及以上学历,具备扎实的计算机基础;2、 经验要求:3-5年后端/大数据开发经验,对高并发、分布式、高可用系统有深入理解和实战经验;3、技术栈要求: - 精通Golang或Java,熟悉Python; - 熟悉数据湖/仓技术(如Delta Lake, Iceberg、Lance)或OLAP引擎(如StarRocks, Doris); - 熟悉数据仓库建模、ETL流程及调度系统;4、工程素养:具备良好的编码规范、单元测试习惯和代码重构能力,能够胜任从0到1的系统搭建与持续优化;加分项1、有MLOps/DataOps平台建设经验,有Web全栈经验,属性 vue、react 常用组件库;2、熟练掌握Kubernetes及其生态(如Helm、Kustomize );3、有自动驾驶、机器人或智能座舱相关领域经验;4、具备出色的沟通理解力,能精准协同内外;同时拥有强烈的自驱力,能主动发现问题、驱动闭环并持续优化。 投递...
高级存储工程师 惠州 全职 职位描述 1. 全栈存储运维管理对象存储、块存储、分布式存储、云存储(AWS S3/阿里云OSS)及高性能存储(Lustre/GPFS),涵盖部署、监控、调优与故障处理针对传统业务与HPC场景(CAE仿真/AI训练)优化存储架构,提升IO效率与资源利用率2. 性能与可靠性保障建立跨平台监控体系,分析IOPS/延迟/吞吐量等指标,实施QoS策略与负载均衡设计PB级数据容灾方案,包括备份恢复、多活架构及超算存储容灾标准3. 技术演进规划推动混合云/多云存储落地,探索超算与云存储融合架构(如热数据分级迁移)研究存储新技术(软件定义存储/STaaS/NVMe-oF)并推动试点 职位要求 1. 5年以上存储运维经验,含2年超算/HPC存储管理(Lustre/GPFS/BeeGFS)2. 精通以下至少两个领域:云存储集成(Terraform/AWS EBS)、HPC优化(MPI-IO调优/RDMA网络/元数据扩展)、容灾方案(Veeam/异地多活)3. 熟练使用Python/Shell实现运维自动化优先条件:1. 有PB级存储集群管理经验,熟悉超算硬件(DDN/HPE Apollo)2. 持云平台存储认证(AWS/Azure)或HPC认证(Intel HPC Academy)3. 熟悉容器存储(Kubernetes CSI)及AI训练数据管道 投递...
数据闭环工程师(工程交付方向) 上海 全职 算法类 职位描述 1.负责训练评测数据交付,保证数据质量,确保交付的数据能直接服务于模型训练迭代;2.根据质量监控和治理体系,确保数据准确性和一致性,实现数据血缘追踪、元数据管理和数据版本控制;3.负责端到端智驾数据产线基础算法建设,包括但不限于数据检索挖掘算子开发、数据清洗&质检算法开发、数据服务开发和维护;3.负责组织数据管理相关会议,拉通对齐数据链路各环节进度,主动识别数据交付风险,推动并跟进堵点问题解决;4.与算法团队紧密协作,理解数据使用场景和需求,优化数据Pipeline以匹配模型迭代节奏。 职位要求 1.硕士及以上学历,扎实的计算机/软件工程基础,熟练Python/C++/Go其中一门语言,具备多线程、异步、大数据、高并发等系统的设计经验;熟悉shell命令及开发;2.必须具有智驾(智能辅助驾驶)行业相关工作经验,熟悉智驾数据特点,包括感知、预测、规划、控制等模块数据;3.有单表TB级别以上数据大规模分布式计算和特征工程实战经验,具备PB级别数据管理和治理经验;4.熟悉自动驾驶数据格式(Rosbag、Mcap、HDF5等),了解并处理过各类2D/3D标注数据、场景标注数据者优先;5.具备良好的沟通协调、问题推动及团队合作能力,责任心强、执行力强,有端到端智驾大模型数据工程经历者加分。 投递...
数据闭环研发工程师(Mstar) Mstar 北京 Mstar计划 职位描述 1、建设自动驾驶数据飞轮,负责数据回收、数据挖掘、自动标注、数据生产等流水线研发;2、搭建PB级分布式数据系统,优化数据存储、检索与流转性能;3、研发高价值样本筛选策略,结合大模型完成数据清洗、质检、难例分析,降低标注成本;4、协同算法团队搭建数据质量评估体系,推动需求落地;5、预研主动学习、仿真数据等前沿技术并落地产线。 职位要求 1、计算机、自动化、机器人等相关专业,硕士及以上学历;2、扎实计算机基础,精通Python、熟练C/C++/Go/Java;3、掌握深度学习基础,具备大模型落地实践经验;4、拥有大规模数据、分布式系统项目经验优先;5、良好系统思维,具备独立方案设计与问题排查能力。加分项:1、项目竞赛:具备大规模数据集构建、数据流水线落地实战经验;智能车竞赛、超算竞赛获奖者优先,擅长从数据层面优化模型效果,而非仅调网络结构。2、学术成果:有主动学习、样本筛选、数据治理、大模型数据应用方向相关论文者优先,重视数据策略创新。3、技术栈:熟悉 Ray/Flyte/Spark/Flink、ROS、云原生、大数据存储者优先。4、思维特质:具备强数据闭环思维,信奉数据决定模型上限;拥有第一性原理思考方式,擅长量化验证方案收益;既能深耕底层算法,又能完成工程落地,具备长期成长为数据闭环架构负责人的潜力者优先。 投递...
Some careers have more impact than others. If you’re looking for a career where you can make a real impression, join HSBC and discover how valued you’ll be. We are currently seeking an experienced professional to
Tech Lead - 自动驾驶工具链(广州) 广州 全职 职位描述 职位描述- 设计与实现高吞吐、低延时的分布式数据采集处理管道,保障PB级路测数据的高效处理与分析能力,支撑多算法团队并行研发需求- 基于自动驾驶系统研发与运营需求,联合算法团队制定数据采集策略- 构建智能化问题溯源系统,实现路测异常的自动化分析与全生命周期追踪管理- 主导制定数据存储与计算资源的成本优化策略,持续提升资源利用效率- 推行卓越工程实践,主导代码审查、设计评审等质量保障活动- 制定团队技术路线图,平衡短期交付与长期技术积累,参与公司级自动驾驶技术战略规划 职位要求 - 5年以上软件开发经验,1年以上技术团队管理经验(Tech Lead及以上职级)- 深刻理解C++/Python或至少一门高级程序语言,具备复杂软件架构设计能力- 强烈的结果导向与系统性思维,能根据实施效果动态优化技术方案- 优秀的跨部门协作能力,能推动跨部门技术决策与工程落地- 开放的技术视野与快速学习能力,能在高强度下解决前沿技术难题加分项:- 有大数据系统研发经验或其他大型分布式系统研发经验 投递...
MiMo-大模型数据架构工程师 北京 校招 正式 软件研发类 2027届校园招聘计划 职位描述 【团队与使命】负责构建支撑万亿级网页接入的高并发、高吞吐分布式网络与数据传输基础设施。日均百亿级请求,攻克全球复杂网络网关与浏览器底层内核解析难题,打造 AI 时代超级数据管道。【岗位职责】1. 高并发分布式网关:研发百亿级请求/PB级吞吐的全球接入网关(C10M)。2. 高性能调度引擎:研发千万级任务分布式调度集群,实现负载均衡与自愈。3. Web 底层解析管道:深入 Web 渲染与 DOM 结构,优化 Headless 浏览器集群与解析。4. 智能网络与路由:研发全球节点调度,攻克智能路由、协议防护对抗(TLS指纹/WAF)。5. 基础架构可观测:构建全球 Trace/Metrics 体系,保障系统高可用。 职位要求 1. 本科及以上,计算机/软件/网安/电子等相关专业。2. 精通 Go 或 C++,代码功底扎实,注重性能与规范。3. 深入理解 Web 体系架构、TCP/IP、HTTP/1/2/3 及 Socket/epoll 网络编程。4.