全栈云端计算平台工程师 广州 全职 通用智能板块 职位描述 职位描述1. 负责小鹏集团计算平台的架构设计与研发落地,构建云端模型开发,训练基础设施以及大规模数据生产基础设施;2. 设计并实现高性能数据编排与加载系统,支撑 PB 级多模态数据(文本、图像、视频、点云、传感器等)的高效处理、缓存加速,支持批式与流式数据生产;深度集成AI Coding Agent与 Data Pipeline,实现数据准备、清洗、标注、版本管理的自动化与智能化闭环;3. 负责云原生基础设施层的开发与优化,包括 GPU集群调度、弹性资源管理、容器化训练/推理工作负载编排,持续提升资源利用率与系统吞吐;4. 可以承担全栈职责,包括前端管理控制台到后端分布式服务的开发。职位要求1. 计算机 / 软件工程 / 数学 / 自动化等相关专业硕士及以上学历,或具备同等技术能力;3 年及以上后端/基础设施开发经验,其中 2 年及以上大规模 AI 平台或分布式系统研发经验;2. 精通Python,具备出色的工程化能力;熟练使用 Golang/Java/C++ 中至少一门语言进行系统性开发;3. 熟悉 AI Coding / AI
深度学习平台研发工程师 广州 全职 通用智能板块 职位描述 建设高效的深度学习基础服务,保障大规模训练稳定,为各类模型研发提供技术支撑,优化计算效率,支持算法团队业务需求落地【主要职责】:1. 负责深度学习平台的系统架构设计和研发工作,提供端到端的模型交付能力2. 集成云原生能力,负责模型研发、训练、推理等相关功能,提升平台资源利用率和计算效率3. 负责大模型训练/推理的监控、排障和容错4. 持续运营,改进平台性能、易用性和稳定性,优化用户体验【基本资格】:5. 计算机科学,工程或相关领域的学士学位6. 熟悉Linux开发环境,掌握Golang/Python等语言,具备良好的代码规范意识和文档编写能力7. 熟悉云原生相关技术,如kubernetes、kubeflow、volcano等,具备二次开发经验8. 熟悉微服务、数据库、分布式系统、缓存技术、消息队列等相关技术9. 强大的解决问题能力,热爱技术,有较强的自我驱动学习能力,持续关注前沿技术发展【期望资格】:10. 相关领域的硕士学位11. 深入理解深度学习理论,熟悉主流训练推理框架Pytorch/Deepspeed/Megatron/Triton/Vllm,故障定位和性能调优方向有相关项目经验12. 参与过AI Infra相关项目,熟悉FlashAttantion、DLRover、Pytorch Elastic等社区项目13. 具备大规模GPU集群的研发和实践经验,了解通用GPU架构、GPU虚拟化、RDMA高速网络和分布式存储技术 职位要求 - 投递...
数据平台工具链开发工程师 广州 全职 通用智能板块 职位描述 1、团队管理与梯队建设:负责自动驾驶数据采集与标注工具系统研发团队的日常管理;建立并完善敏捷研发机制,培养核心技术骨干,构建高效运转的团队网络;2、技术架构与技术规划:主导数据生产系统(含前端高精度点云/3D重建标注工具及后端高并发数据流转平台)的整体架构设计与技术演进,确保系统的高可靠性、可扩展性及优异的用户体验;3、业务闭环与效能提升:深入理解自动驾驶VLA大模型时代的数据挖掘与训练需求,主导“流水线标注系统”等创新工具链的落地,通过系统化、自动化手段大幅降低培训与标注成本,提升数据交付质量与吞吐量;4、资源统筹与项目攻坚:面对海量数据和并行激增的业务需求,统筹协调资源分配,通过PDCA和OKR体系进行战略对齐与矩阵式管理,打破资源壁垒,保障核心高优项目的按时高质量交付;5、数据驱动与基建:推动数据闭环(Data Infra)平台建设,建立科学的业务监控与研发效能指标大盘,以数据洞察驱动平台系统的持续优化。 职位要求 1、学历与背景:本科及以上学历,计算机科学、软件工程或相关专业;2、经验要求:具有 5 年以上软件研发经验,及至少 2-3 年以上带班(10-30人规模)管理经验,具备技术系统从0到1及从1到N的演进推盘能力;3、技术功底深厚:深入理解前后端全栈技术架构,熟悉 Python(FastAPI/Flask)或 Node.js(Koa) / Go / Java 等至少一种后端技术栈,了解高并发微服务设计;4、熟悉前端工程化体系及可视化渲染技术(如 React、Three.js、Canvas 2D 等);5、熟悉云原生架构(Kubernetes、Docker)及 CI/CD 流程;熟悉 MongoDB、Redis、PostgreSQL 等数据库技术及海量数据存储治理;6、管理与心力:具备出色的全局观、系统化思维和抗压能力(心力强);能够完成从“个人技术攻坚”到“系统设计者与团队放大器”的角色转换,熟练应用敏捷开发管理工具;7、沟通与协作:具备极强的跨部门沟通能力与横向拉通能力,能够与算法、数据运营及产品团队高效协作。加分项:1、深入了解自动驾驶数据闭环生态,具备 L2-L4 自动驾驶数据采集、标注工具链或数据挖掘系统研发及管理经验者优先;2、主导过超大规模数据流处理引擎或复杂 3D 点云标注系统(如包含多传感器融合、SLAM等场景)开发落地者优先;3、熟悉大模型辅助标注(Auto-labeling)、大模型端到端链路及 Data Infra 底层建设经验者优先。 投递...
【27届校招】深度学习平台研发工程师 广州 正式 互联网 / 电子 / 网游 职位描述 建设高效的深度学习基础服务,保障大规模训练稳定,为各类模型研发提供技术支撑,优化计算效率,支持算法团队业务需求落地 职位要求 【主要职责】:1、负责深度学习平台的系统架构设计和研发工作,提供端到端的模型交付能力2、集成云原生能力,负责模型研发、训练、推理、Agent等相关功能,提升平台资源利用率和计算效率3、负责大模型训练/推理的监控、排障和容错,参与模型训练和推理性能调优4、持续运营,改进平台性能、易用性和稳定性,优化用户体验【基本资格】1、计算机科学,工程或相关领域的学士学位;2、熟悉Linux开发环境,掌握Golang/Python等语言,具备良好的代码规范意识和文档编写能力;3、熟悉云原生相关技术,如kubernetes、kubeflow、volcano等,具备二次开发经验;4、熟悉微服务、数据库、分布式系统、缓存技术、消息队列等相关技术;5、强大的解决问题能力,热爱技术,有较强的自我驱动学习能力,持续关注前沿技术发展【期望资格】1、相关领域的硕士学位;2、深入理解深度学习理论,熟悉主流训练推理框架Pytorch/Deepspeed/Megatron/Triton/Vllm,故障定位和性能调优方向有相关项目经验;3、参与过AI Infra相关项目,熟悉FlashAttantion、DLRover、AIBrix等社区项目;4、具备大规模GPU集群的研发和实践经验,了解通用GPU架构、GPU虚拟化、RDMA高速网络和分布式存储技术 投递...
【27届校招】深度学习平台研发工程师 广州 正式 互联网 / 电子 / 网游 通用智能板块 职位描述 建设高效的深度学习基础服务,保障大规模训练稳定,为各类模型研发提供技术支撑,优化计算效率,支持算法团队业务需求落地 职位要求 【主要职责】:1、负责深度学习平台的系统架构设计和研发工作,提供端到端的模型交付能力2、集成云原生能力,负责模型研发、训练、推理、Agent等相关功能,提升平台资源利用率和计算效率3、负责大模型训练/推理的监控、排障和容错,参与模型训练和推理性能调优4、持续运营,改进平台性能、易用性和稳定性,优化用户体验【基本资格】1、计算机科学,工程或相关领域的学士学位;2、熟悉Linux开发环境,掌握Golang/Python等语言,具备良好的代码规范意识和文档编写能力;3、熟悉云原生相关技术,如kubernetes、kubeflow、volcano等,具备二次开发经验;4、熟悉微服务、数据库、分布式系统、缓存技术、消息队列等相关技术;5、强大的解决问题能力,热爱技术,有较强的自我驱动学习能力,持续关注前沿技术发展【期望资格】1、相关领域的硕士学位;2、深入理解深度学习理论,熟悉主流训练推理框架Pytorch/Deepspeed/Megatron/Triton/Vllm,故障定位和性能调优方向有相关项目经验;3、参与过AI Infra相关项目,熟悉FlashAttantion、DLRover、AIBrix等社区项目;4、具备大规模GPU集群的研发和实践经验,了解通用GPU架构、GPU虚拟化、RDMA高速网络和分布式存储技术 投递...
Some careers have more impact than others. If you’re looking for a career where you can make a real impression, join HSBC and discover how valued you’ll be. We are currently seeking an experienced professional to
Some careers have more impact than others. If you’re looking for a career where you can make a real impression, join HSBC and discover how valued you’ll be. We are currently seeking an experienced professional to