Java数据平台开发 上海 全职 平台类 职位描述 1. 参与叠纸大数据平台和数据中台建设;2. 参与构建流批一体的数据自助分析平台,支持业务方自助进行数据的快速定位和分析;3. 在传统大数据开发和数仓建模的基础上,探索创新的方案,构建自动化、智能化的建模引擎;4. 保证大数据平台相关服务的稳定性、高可用性,不断优化服务性能。 职位要求 1. 计算机相关专业本科以上学历,5年以上Java相关工作经验;2. 熟练使用常用的JAVA技术框架,并对JAVA Web的各种主流框架如Spring、SpringBoot、MyBatis、Kafka等有深入的应用和优化经验,掌握它的原理和机制;3. 熟练掌握微服务开发和架构设计,有大型复杂业务系统架构设计经验者优先;4. 熟悉一种或多种大数据相关组件者优先,比如:Flink,Spark,Hive,元数据管理等,对组件的原理有深入的了解;5. 具有良好的学习能力、团队协助以及沟通能力,执行力强,对工作有责任心,具备良好的规划、沟通以及协调能力;6. 有数据类产品落地交付经验者优先。加分项:1. 了解python语言,有爬虫、pandas等开发经验更佳;2. 有阿里云平台DataWorks、Hologres、MaxCompute、ADB使用经验;3. 有DataX/HDFS/HIVE等开源工具实际生产使用经验者优先,熟悉源码实现者更佳;4. 有用skills提高开发效率落地场景的经验更佳。 投递...
知识平台算法专家(RAG & 知识图谱方向) 上海 社招 全职 数字技术 本科及以上 5-7 年 职位描述 岗位核心使命深度融合 LLM 与知识图谱技术,构建企业级 GraphRAG 架构。通过本体建模与高精度检索技术,解决大模型在复杂专业领域下的幻觉问题,打造工业级的知识服务引擎。主要职责RAG 架构优化:负责企业级 RAG(检索增强生成)系统的全链路研发。针对长文本及复杂知识,优化文档切片 (Chunking) 策略、多路召回 (Retrieval) 及 重排序 (Reranking) 算法,提升问答的准确性与归因能力。知识中枢建设:负责领域本体论 (Ontology) 建模,设计高扩展性的 Schema;利用 LLM 实现自动化知识抽取(实体、属性、三元组),构建高质量结构化知识库。底层存储与检索:负责基于 Milvus/Zilliz 的向量数据库与 Elasticsearch 的全文检索集成,设计向量-标量混合检索方案,优化海量数据的检索延迟与相关性。推理与应用落地:探索图增强检索(GraphRAG)、多步推理链(CoT)在知识平台中的应用,负责从非结构化数据到结构化知识转化的全流程算法迭代。 职位要求 1.
数据仓库工程师 上海 社招 全职 职能与支持 - 数据分析 本科及以上 3-5 年 职位描述 1. 调研现有系统数据情况,并根据业务模块和需求,参与数据仓库设计与研发,建设电驱/电池工业化核心数据资产;2. 负责从多个系统及数据源进行数据获取,并根据数据标准同步至数据湖,保证数据的完整性和准确性;3. 负责不同技术场景下的数据获取和使用开发方案落地(实时、离线);4. 负责数据治理体系的完善和实施,打造稳定可靠的数据服务和保障体系;5. 与业务团队、算法团队、产品团队紧密合作,参与数据产品和应用的数据研发,与产品一起打造极致体验的数据产品。6. 负责数据化运营,沉淀算法和数据分析思路,协作并推动数据化运营项目落地; 职位要求 1. 计算机、软件工程、自动化等相关专业本科及以上;2. 3-7年大数据工程实施经验,数据仓库建模和开发,了解目前主流大数据技术,如流批一体、数据湖等;3. 熟练掌握hive、spark等大数据工具,具备海量数据加工处理(ETL)相关经验,具备丰富的优化经验。熟练使用Java、Python等语言,熟悉hive UDF开发;4. 能独立负责业务域数据仓库开发及维护、数据仓库模型、数据报表等工作内容;熟悉数据仓库模型设计,掌握常用数据建模方法;5. 熟悉数据治理方法论、具备一定的数据治理经验;6. 较好的业务理解和数据洞察能力,能直接和业务对话,快速进行需求的理解和落地;7. 具有良好的团队合作和沟通能力,有很强的自驱力,能主动为结果负责; 投递...
We are seeking an experienced Senior Data Engineer to design, implement, and maintain our data infrastructure and pipelines. The ideal candidate will have a strong background in data engineering, big data technologies, and cloud platforms. You
AI算法工程师 上海 全职 互联网 / 电子 / 网游 职位描述 职位描述1. 专注游戏场景下的算法研发工作,深耕用户增长、因果推断、归因分析、个性化体验流设计及商业化活动/道具智能推荐等方向,驱动产品核心指标提升;2. 基于业务数据洞察,结合游戏生态特性定义可量化的算法优化目标,设计高落地性方案并推动实施,为项目创造显著商业价值;3. 持续关注AI领域前沿技术动态,探索其在游戏场景的创新应用,推动技术成果转化与工程化落地;4. 深度联动产品、运营团队,通过玩家行为建模与多维度分析,制定精细化算法策略,构建快速迭代机制以持续优化效果。 任职要求1. 计算机、数学、统计学等相关专业本科及以上学历,3年以上算法研发经验,具备独立负责项目的能力;2. 精通Python编程,具备扎实的代码功底与工程实现能力,掌握C/C++或Java者优先;3. 对游戏行业有浓厚兴趣,具备敏锐的业务洞察力,拥有游戏算法成功落地经验者优先;4. 在机器学习、深度学习、数据挖掘、自然语言处理或多模态技术等领域有深入研究,需提供相关项目案例及成果说明;5. 熟悉分布式数据处理框架,对流式计算有实践经验,熟练运用Hadoop/Spark/Flink等大数据工具进行数据建模与分析优先考虑。我们秉承“BE WILD. BE FREE.”的品牌主张,坚持始终创业、简单务实、开放包容、勇于担当的文化理念。在这里——【态度】我们讲求自驱,不设边界,没有人能定义你的舞台和天花板;【氛围】内部真·扁平,新人的意见、不同的观点都有可能成为波克前行的关键;【成长】入职即有指导人和成长伙伴双cover,内部分享+外聘大神助你突破自我;【生活】一日三餐下午茶,房补公寓任你选,节日社团境外游.让游戏不只是工作,更是你的生活! 投递...
【集团】大数据开发-平台开发 上海 全职 职位描述 1.参与建设大数据基础设施:数据平台层面构建包括数据集成、ETL、质量与治理等中台能力,提升数据研发的工作效率;数据架构层面规划设计业务领域核心模型,探索落地另类数据的架构,包括不限于数仓一体、云数据库等;2. 参与建设升级公司数据体系,支撑公司整体数据体系需求,构建高效,稳定的数据通道,推动数据智能化和自动化体系的建设; 职位要求 1.熟悉大数据生态数据技术,了解Flink、Spark、HDFS、 Hive、Odps等主流大数据计算/存储引擎,了解 hbase、 lindorm等OLAP、OLTP引擎及相关数据应用场景,解决方案;2. 有大数据研发、治理等相关平台建设经验者优先,对数据仓库,数据湖熟悉者优先,有数据思维、数学思维者优先;3.知识与能力: 1)扎实的Java编程基础,熟悉JVM、类加载机制、多线程以及性能优化等; 2)精通SpringCloud微服务技术体系springboot、eureka、nacos、apollo、rabbitmq、kafka、rocketmq等等,熟悉相关技术原理,对框架源码有一定研究。 投递...
【集团】大数据开发高级工程师(数据驾舱-研发) 上海 全职 职位描述 1、本科及以上学历,3年及以上大数据相关开发经验;2、熟悉Oracle,对hdfs、flink、spark等有深入理解;3、有flink,数据库,sql查询优化,性能优化相关经验者优先;4、优秀的业务理解能力、逻辑性和沟通能力,能跨部门合作沟通; 职位要求 1、深入理解流式sql原理及应用场景,并实现完备的流式sql功能;2、负责流式sql查询优化、运行时优化、问题诊断及分析等;3、负责流计算引擎flink的调度优化、执行优化,支撑高吞吐、大状态作业的稳定运行;4、负责实时计算在业务上的应用,如实时多维分析、实时异常监控排查等;5、负责业务线实时数仓的规划、设计以及建设;6、熟练掌握至少一种编程语言(如Java、Scala)。 投递...
【集团】大数据开发工程师(数据驾舱) 上海 全职 职位描述 1、本科及以上学历,3年及以上大数据相关开发经验;2、熟悉Oracle,对hdfs、flink、spark等有深入理解;3、有flink,数据库,sql查询优化,性能优化相关经验者优先;4、优秀的业务理解能力、逻辑性和沟通能力,能跨部门合作沟通; 职位要求 1、深入理解流式sql原理及应用场景,并实现完备的流式sql功能;2、负责流式sql查询优化、运行时优化、问题诊断及分析等;3、负责流计算引擎flink的调度优化、执行优化,支撑高吞吐、大状态作业的稳定运行;4、负责实时计算在业务上的应用,如实时多维分析、实时异常监控排查等;5、负责业务线实时数仓的规划、设计以及建设;6、熟练掌握至少一种编程语言(如Java、Scala)。 投递...
【集团】大数据测试工程师-兔集 上海 全职 职位描述 主要职责:1.大数据产品质量保障(核心职责):设计和执行复杂的数据测试用例,包括:功能正确性、数据准确性、完整性、一致性测试,以及数据转换逻辑的验证。2.自动化测试:设计、开发并维护高效的自动化脚本,以提升测试覆盖率和执行效率。3.测试策略与流程:参与制定和优化大数据项目的测试策略、测试计划和测试流程。深入理解业务和数据逻辑,设计高效的数据构造和数据模拟方案。 职位要求 任职要求1.测试专业能力:具备2年以上软件测试经验,其中至少1年以上大数据领域测试经验。掌握功能测试、集成测试、性能测试等方法论,能独立设计测试用例和测试数据。对质量保障体系有深入理解,具备敏锐的缺陷洞察力和分析能力。2.大数据技术栈:具备大数据平台(如 Hadoop、Spark、Flink、Hive、Kafka 等)的测试经验。精通 SQL,能够编写复杂的查询语句进行数据验证和探查。理解数据仓库分层模型(如 ODS, DWD, DWS, ADS)。3. 工具开发能力:熟练掌握至少一门编程语言,如 Python、Java ,并具备良好的编码习惯。4.个人素质:具备出色的逻辑思维能力、分析问题和解决问题的能力。拥有强烈的技术热情、自驱力和团队合作精神。乐于分享,能够将技术方案清晰地传达给团队成员。 投递...
资深大数据开发 上海 全职 平台类 职位描述 1、负责离线和实时数据仓库的搭建与优化,保障数据的准确、完整和高效可用;2、根据业务需求设计合理的数据模型,开发高效ETL流程,进行数据分层与数据治理;3、跟进数据产品在业务场景中的落地,开发数据应用和分析工具,提升数据服务的易用性和价值;4、负责大数据平台和任务的性能调优、解决各类技术难题,保障系统的稳定与高效运行;5、深入理解游戏业务,对接业务部门,制定并实现复杂业务的数据解决方案;6、持续跟踪大语言模型等前沿技术发展,将数据开发能力转化为可落地的智能化实践经验。 职位要求 1、本科及以上学历,计算机、软件工程、数据分析或相关专业,5年以上大数据开发经验;2、精通Java、Python等至少一门编程语言,扎实的代码功底和算法能力;3、熟练掌握Hadoop、Hive、Spark、Flink、Kafka等大数据生态组件,有阿里云Maxcompute、ADB开发经验者优先;4、熟悉数据仓库理论体系,分层设计与维度建模,有PB级数据处理经验者优先;5、业务理解能力强,能够独立对接复杂业务需求,善于沟通和团队协作;6、逻辑思维强,有良好的技术敏感度和学习驱动力,抗压能力强,有责任心和团队合作精神;7、熟悉大语言模型等前沿技术,具备大语言模型等前沿技术应用能力。 投递...
具身大模型数据架构师 深圳、上海、北京 全职 智能机器人板块 职位描述 岗位职责1、负责具身智能多模态数据体系建设,围绕视频、图像、音频、传感器、状态流、日志等海量异构数据,设计可扩展的数据接入、存储、组织、检索与消费架构;2、参与构建面向原始数据管理、训练评测集管理等的数据湖仓与数据管线,推动数据在采集、解析、切分、对齐、清洗、标注、入湖、索引、回放和回溯等环节的工程化落地;3、联合算法团队建设高质量训练数据集、评测集和数据闭环机制,支撑具身大模型的数据生产、问题定位、效果分析和持续迭代;4、参与多模态数据标准和中间结构设计,提升不同来源、不同格式数据之间的兼容性、复用性和可治理性;5、 构建 Data Agent,实现智能检索、数据分析、数据洞察等能力,持续提升数据生产效率与研发效率。 职位要求 任职要求1、计算机、数学、统计、自动化、电子、机器人等专业;2.、具备 AI 算法开发、数据工程、分布式系统、模型调优或系统工程优化相关经验之一;3、具备海量多模态异构数据的架构设计能力,能够从业务目标出发设计数据分层、数据模型、存储布局、索引组织与读写链路;4、熟悉 Python/Java/ go中至少一门语言,具备扎实的数据处理和工程实现能力;5、熟悉 Iceberg、Lance 等面向大规模分析或多模态数据场景的数据格式与存储方案,理解 Parquet、Arrow、对象存储、元数据管理等核心机制;6、熟悉 LanceDB、Milvus、Elasticsearch、ClickHouse 等检索/分析系统,或有多模态样本库建设经验;7、熟悉 Spark、Flink、Ray、Kafka 等大数据或分布式计算框架中的一项或多项,理解批处理、流处理、批流一体及任务编排;8、熟悉向量检索、特征索引、样本检索、数据切片、时间戳对齐、多模态关联等一种或多种能力,能够支撑训练数据构建和问题追溯;9、对数据闭环、具身智能和大模型方向有强烈兴趣,具备自驱力、学习能力和跨团队协作意识。加分项1、有机器人、自动驾驶、大模型行业等行业的多模态海量数据架构实践经验;2、有数据湖、湖仓一体、元数据平台、数据质量平台或数据检索平台建设经验;3、有顶会/期刊论文、开源项目、数据竞赛成果,或在数据基础设施方向有系统性产出。 投递...
数据挖掘工程师/专家 北京、上海 社招 全职 研发 - 算法 职位描述 1. 基于自动驾驶海量数据,利用机器学习、深度学习和数据挖掘方法,负责相关数据挖掘、场景发现、数据筛选与价值挖掘工作,研发适用于实际业务场景的 AI 模型、算法和工具。2. 负责机器学习/深度学习领域的算法研究与工程落地,包括但不限于图学习、生成学习、迁移学习、强化学习、多模态学习以及各类优化方法的实践与创新。3. 面向自动驾驶感知、预测、规划、仿真、数据闭环等业务场景,探索前沿算法问题,设计并实现可落地的技术解决方案,推动数据驱动的模型迭代和业务发展。4. 建设数据挖掘与智能分析能力,包括规则挖掘、Embedding 检索、向量数据库、图搜索、文搜图/图搜图、多模态理解等能力,提升数据生产、质检、评测和交付效率。5. 结合业务需求,沉淀可复用的数据挖掘工具链和算法平台,支持大规模数据分析、样本召回、长尾场景挖掘、难例发现和数据质量提升。 职位要求 1. 数学、计算机、统计学、通信、电子、自动化等相关专业本科以上学历;具备 3 年及以上机器学习、深度学习或数据挖掘相关研究或工程经验。2. 熟悉 Python、Java、C/C++、Scala 等至少一门编程语言,具备良好的工程实现能力,有大规模数据处理、算法系统开发或模型训练经验者优先。3. 熟悉至少一种深度学习框架,如 PyTorch、TensorFlow、MindSpore 等;熟悉常见机器学习/深度学习模型和算法,包括但不限于 GBDT、RF、CNN、RNN、Transformer、CLIP、多模态模型、Embedding 模型等。4. 具备较强的数据分析和数据建模能力,熟悉常见数据挖掘方法,如聚类、分类、召回、排序、异常检测、相似度检索、特征工程、样本筛选等。5. 有自动驾驶、机器人、智能交通、地图、推荐系统、搜索广告、多模态理解、大规模数据挖掘等相关经验者优先。熟悉大数据处理工具或平台者优先,如 Spark、Flink、Hadoop、Hive、ClickHouse、Doris、Elasticsearch、Milvus、Faiss 等。6. 具备良好的问题抽象能力、技术判断力和沟通协作能力,能够结合业务场景快速定位问题,并推动算法方案落地。加分项1. 有自动驾驶数据闭环、长尾场景挖掘、感知数据挖掘、仿真数据挖掘、数据质检或模型评测经验。2. 有多模态大模型、VLM、CLIP、Qwen-VL、Embedding 检索、向量数据库、RAG、Agent
【27届校招】 算法工程师(自动驾驶仿真) 广州、上海 正式 研发 - 算法 通用智能板块 职位描述 工作职责仿真场景与评价算法研发参与自动驾驶仿真平台中场景生成/泛化算法(如基于数据驱动的场景编辑、对抗性场景挖掘)、评价指标体系(如闭环通过率、复现率、漏报率)的设计与实现,推动仿真结果向真实路测能力的有效迁移。大规模分布式仿真调度策略优化协助设计面向海量仿真任务(SIL/HIL)的智能调度与算力管理策略,优化任务排队、资源利用率与数据流吞吐,支撑日产千级 Case、长里程持续累积的仿真规模。闭环仿真链路与数据接口开发参与仿真与算法团队(感知、规控、云端)的数据交互协议与 API 定义,保障仿真软件在不同硬件平台(HIL 节点、GPU 集群)上的高一致性与高可靠性,协同定位复现率、diff 等指标异常。算法预研与模型验证支持配合预研方向(如生成式仿真、神经渲染、端到端评测)进行实验设计、训练任务管理与结果分析,输出可落地的性能结论,辅助架构选型与训练方案决策。 职位要求 基本条件2027 年应届毕业生,计算机科学、软件工程、人工智能、自动化、数学等相关专业,硕士及以上学历优先。扎实的编程与算法功底:精通 Python、C++、Go、Java 中至少一种语言,熟练掌握常用数据结构、算法及设计模式,具备良好的工程编码习惯。深入理解 Linux 操作系统原理(进程/线程调度、内存管理、I/O 模型)及网络协议(TCP/IP、HTTP、gRPC 等),能够进行问题定位与性能调优。2. 加分项(仿真/算法相关)机器学习与深度学习基础:了解常见模型训练流程、损失函数、优化器,具备使用 PyTorch/TensorFlow 进行实验的经验;对生成模型(Diffusion、GAN)、计算机视觉或强化学习有初步了解者优先。分布式计算与仿真调度:理解分布式系统基本概念(一致性、容错、任务调度),有 Ray、Spark 或类似框架使用经验者优先;熟悉 Kubernetes/Docker 容器化部署者更佳。仿真/自动驾驶背景:了解 SIL/HIL 仿真基本流程、场景编辑或评价指标(如复现率、通过率、轨迹误差)者优先;有 CarSim/SUMO/ROS/Apollo 等工具经验者可加分。后端与数据基建:了解 MySQL/PostgreSQL、Redis、Kafka/RabbitMQ 等数据存储与消息中间件基本原理,能配合搭建仿真数据
【27届校招】通用智能AI平台研发工程师 北京、上海、广州 正式 研发 - 算法 通用智能板块 职位描述 小鹏通用智能AI数据闭环平台团队,负责构建支撑百万级路采数据、千卡GPU集群的自动驾驶,具身智能数据与AI基础设施。从路测车辆上每秒产生的GB级传感器数据和多模态具身智能传感器数据,到最终训练出能够应对复杂城市道路的感知/预测/决策模型——我们打造的平台是这一切的底座。你将与国内顶尖的分布式系统、AI基础设施、自动驾驶算法工程师并肩工作,直面PB级数据处理、大规模分布式训练、大模型辅助标注等前沿技术挑战。真实场景,海量数据:你将处理来自摄像头、LiDAR、毫米波雷达、GPS/IMU等多传感器的真实路采和数采数据,规模达到PB级——这不是课堂作业,而是工业级挑战。前沿技术,深度应用:VLM自动化标注、Milvus向量检索、流批一体架构、GPU集群调度……你接触的不是纸上谈兵的技术,而是正在重塑行业的关键能力。完整链路,全局视野:从数据接入→清洗治理→特征提取→模型训练→推理部署→数据回流,你将有机会参与到AI平台的全链路建设中,理解自动驾驶数据闭环的每一环。高速成长,快速扛事:27届校招专属培养计划,mentor一对一引导,但绝不只让你做边角料——我们希望你尽快独立负责核心模块的研发与优化。方向一:大规模数据处理开发高可靠的ETL数据处理流水线,处理车载传感器数据(摄像头图像、LiDAR点云、GPS轨迹、CAN总线信号等)基于Spark/Flink优化数据清洗、转换、聚合任务,持续提升云端数据处理的吞吐与稳定性构建多模态Embedding生产流水线,支持CV/NLP模型对海量数据的分布式特征提取探索基于VLM(视觉语言模型)的自动标签生成方案,减少对人工标注的依赖,加速算法迭代构建驾驶场景的语义索引系统,支持复杂语义检索(如“夜间雨天前车急刹”“高架桥上旁车近距离切入”)方向二:数据建模与治理设计多源异构数据仓库的分层模型(ODS/DWD/DWS/ADS),支撑感知、预测、规划等算法的训练数据需求构建数据血缘与元数据管理体系,确保每一帧训练数据的来源、处理过程与版本都可追溯制定多模态数据的向量化规范(图像/点云/文本的Embedding标准),为后续检索与训练提供高质量特征输入方向三:AI平台架构与优化搭建数据湖仓一体架构(基于Iceberg/Delta Lake + StarRocks/Doris),兼顾数据湖的灵活性与数据仓库的查询性能开发高性能特征向量数据库(基于Milvus/Pinecone或自研引擎),支撑亿级向量的低延迟检索持续优化存储与计算性能(分区策略、压缩算法、缓存机制),探索流批一体、存算分离等新架构的落地设计高效的数据存储、分区与读取策略(Parquet/ORC),优化存储与网络I/O,保障训练与推理的数据吞吐方向四:分析工具与可视化开发BI数据看板,实时监控数据质量及自动驾驶核心指标(感知准确率、接管率、场景覆盖率等)提供多模态检索接口,支持通过文本描述(如“从左后方快速切入的摩托车”)检索对应的驾驶场景视频片段 职位要求 1、2027届硕士/博士毕业生,计算机、软件工程、人工智能、自动化、电子信息等相关专业2、扎实的编程基础,熟练掌握 Python/C++/Java/Scala 中至少一门语言,有良好的工程习惯与代码质量意识熟悉至少一项大数据处理框架(Spark/Flink)或深度学习框架(PyTorch/TensorFlow)3、对自动驾驶场景有基本认知和浓厚兴趣——你不一定懂感知算法细节,但要理解数据对算法训练的价值加分项(满足1-2项即可,非硬性要求)1、有数据仓库建模或数据湖(Iceberg/Delta Lake/Hudi)实际使用经验2、熟悉分布式计算原理,有Spark/Flink任务性能调优经验3、了解Kubernetes及GPU虚拟化技术,有集群资源调度相关实践4、使用过Milvus、Weaviate、Pinecone等向量数据库,或对向量检索算法(HNSW/IVF)有研究5、熟悉VLM/多模态模型(如CLIP、LLaVA、Qwen-VL等),有特征提取或模型微调经验6、有自动驾驶相关数据集(nuScenes/Waymo/Argoverse)的处理经验在ACM、Kaggle、天池等编程/数据竞赛中取得过优异成绩7、有高质量技术博客或开源项目贡献收获1、有竞争力的薪酬与校招专属福利包(薪资面议,对标一线互联网/自动驾驶公司)2、真实的工业级技术挑战,你的代码将直接运行在千卡GPU集群和PB级数据湖上3、技术广度与深度的双重成长,在数据工程、AI基础设施、分布式系统、多模态模型等方向持续积累4、广阔的成长空间:团队技术氛围浓厚,鼓励技术分享、论文阅读与创新探索,支持将前沿成果转化为实际生产力5、清晰的校招培养路径:入职前3个月mentor带教,半年内逐步独立负责核心模块,1年内具备技术owner能力 投递...
数据平台架构师 热招 上海、杭州 全职 研发 职位描述 1、负责企业级大数据平台体系的建设,设计高可用、高性能、稳定可靠的数据平台架构方案,支撑企业级数据仓库和数据治理的落地,保障平台稳定高效运行、支撑业务发展; 2、负责数据平台整体技术架构体系的建设和优化,包括括数据湖、数据仓库、数据中台、实时计算平台等核心组件的规划与建设改进数据研发流程,提升数据研发质量;3、完善数仓的数据合规建设,优化数仓存储计算性能;4、作为技术领域专家,制定团队技术规范、开发标准和最佳实践,承担技术难题攻关,跟踪行业前沿技术趋势,持续驱动技术创新。 职位要求 1、计算机相关专业本科及以上学历,5年以上数据平台研发经验。 2、精通数据平台和仓库建设理论,有企业级数据仓库搭建和数据治理经验。 3、对批流一体、数据湖等业内前沿方向有深刻理解,有实际落地经验者优先。 4、熟悉大数据生态相关技术,如Hive、Doris、ClickHouse、iceberg、HBase、Spark、Flink、Kafka等,另外熟悉SQL、Python、Java、Go等编程语言 5、有Linux系统的基础运维能力,熟悉K8S容器编排基本概念、原理、组件、工具 。6、良好的业务理解力,较强的自驱力,热爱技术,结果导向。 投递...
资深搜索算法工程师 热招 上海、杭州 全职 研发 职位描述 1. 参与搜索、推荐等个性化场景的算法能力输出,负责搜索召回、粗排、精排、重排全链路算法的优化与迭代。2. 负责多模态语义搜索算法迭代,包括意图识别、Query改写、向量化检索、相关性建模等。3.深入分析用户搜索行为数据,挖掘用户意图,将算法落地业务场景,不断提升用户体验和实际业务效果,构建个性化搜索能力。4. 紧跟SOTA论文持续迭代算法模型,持续关注NLP / 信息检索 / 推荐系统领域前沿论文,推动学术成果工程化落地,关注学术成果使用创新和能力扩展。 职位要求 1. 熟悉个性化场景中常用的机器学习&深度学习模型,具备扎实的理论知识,对前沿技术有热情有探索。2. 熟悉个性化场景算法领域方向,包括但不限于表征召回(SeqModel,GNN)、深度精排(MultiTask)、上下文重排(ListWise)等。3. 熟悉TensorFlow、Pytorch等深度学习开源框架,具有较好的模型构建能力;4. 熟练使用hive、Spark等大数据平台处理数据;熟悉java/python等编程语言,具有较好的算法落地能力;5. 热爱互联网和电商业务,具备较强的抗压能力、主动性和自驱力,学习能力强。 投递...
数据开发工程师 上海、杭州 全职 研发 - 数据 热招职位 职位描述 1、负责离线数据仓库,搭建数据架构和模型,保障数据准确、一致和稳定,包括数据清洗、模型设计、数据治理和稳定性保障;2、负责实时数据架构建设,开发实时计算任务,保障数据传输的实时性与准确性,满足实时数据在各业务场景的需求;3、深入理解业务,根据业务发展阶段和需求,提供系统性的解决方案并落地;4、关注大数据领域前沿技术,将新技术、新方法应用到实际工作中,持续优化数据开发体系与技术架构。 职位要求 1、较为丰富的数仓设计&开发经验,具备离线/实时数据处理能力,有海量数据实时处理经验优先;2、熟悉Hadoop/Spark/Flink生态相关技术,具备一定的JAVA、Scala、Python语言的开发能力,能够结合多技术栈的优势提出业务解决方案;3、对数据敏感,具备良好的业务理解能力,通过数据体系与业务的结合,进行良好的数仓模型设计,保障稳定性和扩展性;4、有良好的逻辑思维性,有良好的抗压能力和自驱能力;5、具备数据治理经验为加分项。 投递...
【27届校招】计算平台软件工程师 上海、广州 正式 研发 - 算法 通用智能板块 职位描述 1、参与自动驾驶海量数据的采集、管理、处理与高效调度,设计与开发自动驾驶全链路数据平台,包括但不限于数据湖、数据仓库、分布式存储、流批一体计算与智能数据标注、数据治理等;2、研发大规模分布式计算与训练平台,基于Spark、Flink、Ray、PyTorch等技术实现自动驾驶大模型的数据清洗、预处理、并行训练与推理,支持多GPU/多集群高性能任务编排与资源调度;3、优化存储与检索架构,探索和实现包括OSS、CPFS、Iceberg、Delta Lake、Hudi、StarRocks、ClickHouse、ElasticSearch、Milvus等新一代高性能存储与检索方案,提升数据读写、索引、管理效率,赋能AI训练和推理;4、参与团队架构设计与技术攻关,跟进学术前沿与业界动态,解决自动驾驶场景下数据一致性、扩展性、高可用、智能调度等核心难题;5、推进工程实践落地与持续优化,深度参与端到端系统开发、自动化测试、上线发布与持续运维,推动数据与AI平台的稳定迭代和性能进化。 职位要求 1、教育背景:计算机、软件工程、人工智能、数据科学等相关专业,本科及以上学历,硕博优先;2、理论基础扎实: 精通分布式系统原理、并行计算、存储系统、数据库原理、数据湖/数据仓库理论、大规模机器学习等学科知识,有相关顶会/顶刊论文经历者优先;3、技术能力突出:(1)熟练掌握至少一种主流分布式计算框架(如Spark、Flink、Ray等)和一种深度学习框架(如PyTorch、TensorFlow等);(2)具备大数据存储与处理系统(如OSS、CPFS、Iceberg、Delta Lake、Hudi、StarRocks、ClickHouse、ElasticSearch、Milvus等)实操经验;(3)具备高性能数据检索、索引优化、海量数据管理等工程经验;4、编程与工程能力强(1)熟练掌握Python/Java/Scala/C++/Rust等主流开发语言中的至少一种,具备良好的工程实践和代码规范;(2)有高并发、大规模分布式系统、流式/批式混合计算平台相关项目经验者优先;5、创新与解决问题能力:具备独立分析复杂系统、定位瓶颈、提出创新性解决方案的能力,对技术钻研有热情,善于跨界学习;6、沟通协作与主动学习:良好的团队协作能力、沟通表达能力及自驱力,乐于分享、敢于挑战难题;7、加分项:(1) 在数据库、分布式系统、云原生计算、向量数据库、机器学习系统等领域有顶会(SIGMOD、VLDB、ICDE、NeurIPS、ICML等)论文、竞赛获奖或开源项目贡献;(2)有阿里云、腾讯云、AWS、GCP等云平台大数据相关实习、项目或竞赛经历;(3) 具备自动驾驶、机器人、智能感知领域大规模数据处理或AI应用落地经验;(4)英语或技术写作能力优秀,有技术博客、专利、文档经验。 投递...
SummaryApple is where individual imaginations gather together, committing to the values that lead to great work! Every new product we build, service we create, or Apple Store experience we deliver is the result of us making
2026届秋招-大数据开发工程师 补录 上海 正式 互联网 / 电子 / 网游 技术 职位描述 1. 基于大数据平台完成数据相关的开发工作,包含指标和报表开发;2. 密切配合游戏项目组,提供相应的数据分析支撑。 职位要求 1. 2026届应届本科及硕士毕业生,计算机相关专业,top 985院校优先;2. 熟悉SQL,Python,Spark,JAVA等其中至少一项开发技能;3. 熟悉Linux系统的操作,熟练使用脚本开发;4. 能够明确自己当前的定位和未来的成长规划;5. 热爱游戏行业,工作认真负责。 职位信息 团队介绍: 我们是一支年轻有活力的数据支撑团队,有多名经验丰富的数据从业者,涵盖了大数据,数据仓库,数据分析师等专业领域,支撑了公司PB级别的数据服务。我们期待您的加入,我们会有定期的技术分享,会有经验丰富的人来帮助你迅速成长,我们也希望你能够给我们带来新的东西,让我们一起成长~ 投递...