Python开发实习生 上海 实习 职位描述 参与云端数据处理管线的开发、维护与优化工作,协助完成数据从采集、处理到训练全链路的工程化落地;负责数据Pipeline相关模块的代码编写、单元测试与文档撰写,保障代码质量与可维护性;协助排查数据流转过程中的异常与性能瓶颈,参与日志分析、问题定位与修复工作;参与数据管线自动化工具与监控脚本的开发,提升数据运维效率。 职位要求 硕士在读,计算机、软件工程、人工智能等相关专业,每周至少实习4天,实习期3个月以上;扎实的Python编程基础,熟悉常用数据结构与设计模式,代码风格规范;了解数据处理基础流程,有ETL/数据Pipeline开发经验者优先;了解Docker、Kubernetes等容器化技术,有云端开发经验者优先;具备良好的学习能力与团队协作精神,对数据工程领域有热情。加分项了解Airflow、DolphinScheduler等工作流调度框架;了解Spark、Flink等大数据处理框架;了解Git协作开发与CI/CD流程;有开源项目贡献或技术博客者优先。 投递...
Super Sparks-校招-具身智能/机器人研究员(Embodied AI / Robotics Researcher) 上海 校招 正式 数字技术 - 算法 博士及以上 Super Sparks 招聘计划 职位 ID:A258152A 职位描述 -探索具身智能前沿技术,制定技术路线,统筹内部研发方向;-开发、微调视觉-语言-动作(VLA)大模型(如 RT-2、OpenVLA、Groot、pi0 等),实现环境理解、任务分解与动作生成;-设计基于 Transformer、Diffusion Policy 的抓取与运动规划算法,提升操作泛化性;-领导或参与核心算法研究,覆盖具身交互、感知、操作、仿真、训练等方向,提升具身能力与可靠性;-对特定场景使用仿真数据集或模型数据集强化训练,确保操作成功率;-在机器人平台部署 VLA 模型,通过模型量化、推理加速等方式提升整体执行效果;-推动相关工具建设,高效训练与验证部署,加快具身智能的产品化落地。 职位要求 -计算机/机器人/人工智能等相关领域硕士或博士;-精通 Python/C++,掌握 PyTorch/TensorFlow 框架;-深入理解强化学习基本原理与核心算法(PPO、SAC 等)及常用框架;-深入理解大模型(VLM、VLA)开发流程(训练、微调、部署),并有实际项目经历;-深入理解机器人学习算法,具备强化学习用于机器人领域的项目经验;-在顶会(CoRL、ICRA、IROS、CVPR、ICLR 等)发表具身智能或大模型相关论文优先;-具备 OpenVLA、Groot、pi0 等 VLA 模型应用经验优先;-具备模型量化(Quantization)、边缘部署经验优先;-有持续学习和创新精神,能自主、高效工作。 投递...
Super Sparks-校招-机器人仿真系统研究员/工程师 上海 校招 正式 数字技术 - 算法 博士及以上 Super Sparks 招聘计划 职位 ID:A221758 职位描述 构建高保真仿真环境,实现算法高效训练与低成本迁移。- 搭建机器人仿真环境,包括传感器、执行器、交互对象及周围环境,模拟真实物理特性;- 构建泛化动态交互场景,支持算法训练;- 机器人算法的训练和验证:评估提供合适强化学习训练框架(如PPO/SAC),并验证训练算法在模拟环境中的效果;- 支持SimtoReal调试,根据实际差异,优化仿真参数;- 持续追踪仿真最新算法和技术,开展机器人仿真技术规划、仿真工具链建设; 职位要求 - 计算机/机器人/人工智能等相关领域的硕士或博士;- 熟悉Issac Lab、Mujoco等主流仿真平台,具备基于上述平台的环境搭建与测试能力;- 熟悉C++、Python,熟悉ROS/ROS2;- 熟悉机器人运动学、动力学,熟悉传感器内外参标定;- 具备移动机器人、机械臂仿真开发训练经验优先;- 具备SimtoReal经验优先;- 有持续学习和创新精神,能自主、高效工作。 投递...
Super Sparks-校招-智能体Harness Engineering研究员/工程师 上海 校招 正式 数字技术 - 算法 硕士及以上 Super Sparks 招聘计划 职位 ID:A82261 职位描述 1.跟踪 AI4SE(AI for Software Engineering)与 Agent 领域的前沿方法(代码生成、智能测试、程序分析、故障诊断等),将其中已验证的方法在车载软件工程场景中工程化落地。2.主导 1~2 个落地课题,从原型验证推进到团队可日常使用的工具或流程。候选方向包括但不限于:车载 C++/AUTOSAR 代码生成与补全、测试自动化、OTA 版本集成与车端故障诊断智能体、全链路 Agent 化开发。3.与交付团队深度协作,确保落地产出真正服务于版本交付与质量目标,而非停留在 demo。4.持续沉淀落地经验,形成可复用的方法与工具,提升团队整体研发效能。 职位要求 计算机、软件工程或相关专业博士学位(应届毕业生)。研究方向为 AI4SE、代码智能、程序分析、软件测试自动化、大模型 Agent 之一,有论文或项目产出。扎实的工程能力(核心门槛):能独立完成系统设计与工程开发。熟悉大模型应用开发(Prompt、RAG、Agent 框架等),熟练掌握 Python /
Super Sparks-校招-端到端大模型闭环数据迭代 上海、北京 校招 正式 数字技术 博士及以上 Super Sparks 招聘计划 职位 ID:A80761 职位描述 - 探索world action大模型预训练、后训练高效数据闭环迭代范式- 负责端到端大模型Policy、Env Generation、价值评估紧耦合的模型架构设计、训练及优化- 主导模型与数据结合的高效闭环训练、数据Scaling范式(预训练/SFT/RL)研究- 参与多任务、多Scenario 训练、Benchmark数据集制作及筛选,评测指标设计 职位要求 - 精通VLA/WA/WM算法的原理,熟练掌握大模型训练、微调方法;- 扎实的数学基础(概率统计、优化、图论);- 熟练掌握Python/C++编程及PyTorch/TensorFlow等深度学习训练框架;- (加分)发表过智能辅助驾驶 / 具身智能相关方向的高权重 / 高技术影响力论文,具备对世界模型的体系化认知能力;- (加分)在国内外顶尖高校实验室或企业核心模型团队参与数据Scaling工作;- 学历:博士 投递...
知识平台算法专家(RAG & 知识图谱方向) 上海 社招 全职 数字技术 本科及以上 5-7 年 职位描述 岗位核心使命深度融合 LLM 与知识图谱技术,构建企业级 GraphRAG 架构。通过本体建模与高精度检索技术,解决大模型在复杂专业领域下的幻觉问题,打造工业级的知识服务引擎。主要职责RAG 架构优化:负责企业级 RAG(检索增强生成)系统的全链路研发。针对长文本及复杂知识,优化文档切片 (Chunking) 策略、多路召回 (Retrieval) 及 重排序 (Reranking) 算法,提升问答的准确性与归因能力。知识中枢建设:负责领域本体论 (Ontology) 建模,设计高扩展性的 Schema;利用 LLM 实现自动化知识抽取(实体、属性、三元组),构建高质量结构化知识库。底层存储与检索:负责基于 Milvus/Zilliz 的向量数据库与 Elasticsearch 的全文检索集成,设计向量-标量混合检索方案,优化海量数据的检索延迟与相关性。推理与应用落地:探索图增强检索(GraphRAG)、多步推理链(CoT)在知识平台中的应用,负责从非结构化数据到结构化知识转化的全流程算法迭代。 职位要求 1.
数据仓库工程师 上海 社招 全职 职能与支持 - 数据分析 本科及以上 3-5 年 职位描述 1. 调研现有系统数据情况,并根据业务模块和需求,参与数据仓库设计与研发,建设电驱/电池工业化核心数据资产;2. 负责从多个系统及数据源进行数据获取,并根据数据标准同步至数据湖,保证数据的完整性和准确性;3. 负责不同技术场景下的数据获取和使用开发方案落地(实时、离线);4. 负责数据治理体系的完善和实施,打造稳定可靠的数据服务和保障体系;5. 与业务团队、算法团队、产品团队紧密合作,参与数据产品和应用的数据研发,与产品一起打造极致体验的数据产品。6. 负责数据化运营,沉淀算法和数据分析思路,协作并推动数据化运营项目落地; 职位要求 1. 计算机、软件工程、自动化等相关专业本科及以上;2. 3-7年大数据工程实施经验,数据仓库建模和开发,了解目前主流大数据技术,如流批一体、数据湖等;3. 熟练掌握hive、spark等大数据工具,具备海量数据加工处理(ETL)相关经验,具备丰富的优化经验。熟练使用Java、Python等语言,熟悉hive UDF开发;4. 能独立负责业务域数据仓库开发及维护、数据仓库模型、数据报表等工作内容;熟悉数据仓库模型设计,掌握常用数据建模方法;5. 熟悉数据治理方法论、具备一定的数据治理经验;6. 较好的业务理解和数据洞察能力,能直接和业务对话,快速进行需求的理解和落地;7. 具有良好的团队合作和沟通能力,有很强的自驱力,能主动为结果负责; 投递...
We are seeking an experienced Senior Data Engineer to design, implement, and maintain our data infrastructure and pipelines. The ideal candidate will have a strong background in data engineering, big data technologies, and cloud platforms. You
大数据开发工程师-汽车专项-实习 简历急缺 上海 校招 实习 软件研发类 职位描述 方向一:1.负责智能网联平台大数据需求分析、输出技术方案、数据开发工作;2.参与智能网联平台整车数仓建设及数据集市建设(数据ETL、数据建模、指标开发);3.参与智能网联平台大数据平台建设(离线/实时计算、数据质量、数据可视化、数据服务开发);4.负责智能网联大数据应用功能模块部署上线、线上问题分析、跟踪解决。方向二:负责电驱,电池,热管理等动力零部件的用户画像负责动力零部件的大数据健康监控和分析负责动力零部件的大数据转化,生成加速试验工况负责测试数据的云端自动化分析等处理分析任务 职位要求 1.计算机、软件工程、数据科学、统计学相关专业;2.熟练掌握SQL语言,熟练掌握Spark SQL&Spark离线计算、Flink实时计算技术优先;3.掌握数据仓库基本概念(如星型模型、雪花模型、数据分层),有数据仓库建模或ETL开发经验者优先;4.掌握Python编程语言,熟悉Pandas、NumPy等数据处理库,掌握一定的机器学习、深度学习算法,了解LLM相关知识&Java编程语言是加分项;5.有良好的沟通能力,能高效完成安排的工作; 投递...
数据分析师 上海 全职 互联网 / 电子 / 网游 职位描述 我们目前在研一款中东Domino游戏,(可以理解为过去的QQ游戏大厅,作为平台里面有不同游戏合集,包括Domino,Ludo,国际象棋等),目前是埃及游戏榜Top3!身为项目组的数据分析师,你会在项目中拥有较高的自主权和决定权。我们鼓励自己提出和把控方向而非单纯执行,也鼓励分析项目数据主动提出优化想法。我们希望在这里,你能快速接触和全面学习产品研发的过程和结果把控,并不断通过反馈正向积累数据经验,与大家共同成长!岗位职责:1、主导构建行为型 PLTV / 用户价值评估模型- 在低付费率场景下,基于用户行为数据定义用户价值指标- 设计特征体系、样本标签与评估方法,输出可运营的用户分层结果2、设计并迭代外挂 / 刷子识别与监控方案- 结合规则与数据建模手段,提升异常用户识别效果- 建设刷子监控看板,支持风控与运营策略3、建立优质用户识别与行为路径模型- 分析优质用户的共性特征与关键行为路径- 为增长策略、产品设计提供数据支持与建议4、推动分析与模型结果产品化- 设计并维护 PLTV 看板、用户分层视图、监控类报表- 确保数据结果可被业务理解、使用和持续跟进5、与用户增长、策划等角色深度协作- 从业务目标出发定义分析问题- 推动数据结论在策略中的实际落地与验证 任职要求:1、必须具备- 本科及以上学历,数学 / 统计 / 计算机 / 数据相关专业优先- 精通
数据分析(捕鱼) 上海 全职 产品 / 策划 / 项目 - 数据分析 职位描述 岗位职责:1. 独立搭建可视化报表,包括:功能报表、用户行为类报表等,可视化强且复用性高;2. 完成产品数据分析需求,通过分析及挖掘玩家数据协助研发改善优化产品;3. 针对项目进行专项数据分析,包括不限于:留存及流失分析、活跃分析、付费分析、功能玩法分析、用户游戏行为等;4. 负责对海量用户行为数据进行建模分析以及游戏埋点方案设计;5. 制定数据监控和预警方案,完善用户画像系统及用户分析体系,比如:用户流失预测等;6. 协助运营及策划进行用户和买量等数据分析,优化游戏项目的各项指标。任职要求:1. 本科及以上学历,计算机、统计学,数学,数据挖掘等专业;2. 3-5年以上数据挖掘或分析经验,有游戏行业背景优先,有深度参与中重度产品数据分析的经历;3. 熟练掌握Sql、Python、R语言等至少一种数据分析工具;4. 熟练掌握可视化分析工具,例如:quickbi;5. 熟悉数据仓库或者关系型数据库者优先考虑;6. 熟悉使用大数据技术,例如Hadoop、Hive、Spark者优先考虑;7. 热爱游戏行业,尤其是手机游戏优先考虑;8. 具有良好的逻辑思维能力、表达能力,对数据敏感,定量分析能力强,对数据如何驱动业务有一定思考。 投递...
AI算法工程师 上海 全职 互联网 / 电子 / 网游 职位描述 职位描述1. 专注游戏场景下的算法研发工作,深耕用户增长、因果推断、归因分析、个性化体验流设计及商业化活动/道具智能推荐等方向,驱动产品核心指标提升;2. 基于业务数据洞察,结合游戏生态特性定义可量化的算法优化目标,设计高落地性方案并推动实施,为项目创造显著商业价值;3. 持续关注AI领域前沿技术动态,探索其在游戏场景的创新应用,推动技术成果转化与工程化落地;4. 深度联动产品、运营团队,通过玩家行为建模与多维度分析,制定精细化算法策略,构建快速迭代机制以持续优化效果。 任职要求1. 计算机、数学、统计学等相关专业本科及以上学历,3年以上算法研发经验,具备独立负责项目的能力;2. 精通Python编程,具备扎实的代码功底与工程实现能力,掌握C/C++或Java者优先;3. 对游戏行业有浓厚兴趣,具备敏锐的业务洞察力,拥有游戏算法成功落地经验者优先;4. 在机器学习、深度学习、数据挖掘、自然语言处理或多模态技术等领域有深入研究,需提供相关项目案例及成果说明;5. 熟悉分布式数据处理框架,对流式计算有实践经验,熟练运用Hadoop/Spark/Flink等大数据工具进行数据建模与分析优先考虑。我们秉承“BE WILD. BE FREE.”的品牌主张,坚持始终创业、简单务实、开放包容、勇于担当的文化理念。在这里——【态度】我们讲求自驱,不设边界,没有人能定义你的舞台和天花板;【氛围】内部真·扁平,新人的意见、不同的观点都有可能成为波克前行的关键;【成长】入职即有指导人和成长伙伴双cover,内部分享+外聘大神助你突破自我;【生活】一日三餐下午茶,房补公寓任你选,节日社团境外游.让游戏不只是工作,更是你的生活! 投递...
用增算法工程师 上海 全职 互联网 / 电子 / 网游 职位描述 岗位职责:1. 负责广告/推荐投放算法体系的整体设计与迭代,包括但不限于CTR/CVR预估、智能出价、人群扩展等核心模块。2. 解决大规模投放中的关键难题,如数据稀疏、冷启动、延迟反馈、多目标优化等。3. 带领或推动算法项目从实验到全量上线,通过A/B测试验证并显著提升投放ROI。任职要求:1. 3年以上投放/推荐/广告算法经验,有大规模CTR/CVR预估或智能调价实战经历。2. 机器学习基础扎实,熟悉DeepFM、MMoE、ESMM等常见模型,有TensorFlow/PyTorch大模型训练经验。3. 编程能力突出(Python/SQL/Spark),熟悉大数据处理流程。4. 数据敏感度高,能独立拆解业务问题并转化为算法方案,结果导向。 投递...
Join Our Business Intelligence Team Were looking for a talented Business Intelligence (BI) Analyst to join our growing BI team. In this role, youll work closely with Product, Operations, Payment, Finance, Risk, and Data Engineering to
风控算法工程师 (大模型+智能风控方向) 上海 技术 - 算法 本科及以上 2026届春招 职位描述 岗位职责1 智能化风控组件研发(大模型+传统风控)- 负责将最新的大语言模型(LLM)及Agent技术与传统统计建模、数据挖掘、机器学习方法深度结合,攻克实际风控业务难题。2 负责流水账单解析、KYC智能画像建设、用户偿债能力评估等核心风控组件的研发与迭代。- 持续提升风控组件的风险排序能力(ROC/AUC、KS)、稳定性(PSI)等核心指标,为风险管理提供坚实的决策支持。3 多维数据挖掘与模型优化- 运用统计学、机器学习、深度学习及图模型等前沿技术,持续挖掘关键风控维度与新型特征。- 优化内外部多源异构数据(如文本、行为、关系网络)的组合效率,提升风控模型的综合决策效能与响应速度。4 业务协同与数据驱动经营- 协同策略团队与业务团队,推动风控中台组件在信贷、交易等具体业务场景中的深度应用与落地。- 坚持数据驱动,从风控数据中捕捉潜在的经营机会,实现“风险控制”与“业务增长”的双赢,提升最终经营结果。 职位要求 任职要求1 专业背景- 计算机、数学、统计学、运筹学、金融、经济学或相关专业,研究生及以上学历。2 核心技能与经验- 具备风控领域建模或策略项目、实习经验,有风控项目落地并取得显著业务成效的经验。- 深入理解常用机器学习算法(XGBoost、LightGBM等)、统计建模方法、图模型建模方法;- 具备大模型以及NLP经验:熟悉LLM微调(Prompt Engineering/LoRA等)、RAG、文本挖掘、传统NLP算法,有利用大模型解析复杂非结构化数据经验者优先。3 工程与编程能力- 具备良好的编程功底与代码习惯,熟练掌握 SQL/Python,了解大数据生态(Hive/Spark)。4 软实力- 具备极强的学习能力、严密的逻辑思维与良好的建模思维,对前沿技术(尤其是AI大模型在工业界的落地)保持高度热情。- 具备优秀的团队协同与沟通能力,能够用数据说话,将复杂的技术方案转化为业务语言。 职位信息 部门:
【集团】大数据测试工程师-兔集 上海 全职 职位描述 主要职责:1.大数据产品质量保障(核心职责):设计和执行复杂的数据测试用例,包括:功能正确性、数据准确性、完整性、一致性测试,以及数据转换逻辑的验证。2.自动化测试:设计、开发并维护高效的自动化脚本,以提升测试覆盖率和执行效率。3.测试策略与流程:参与制定和优化大数据项目的测试策略、测试计划和测试流程。深入理解业务和数据逻辑,设计高效的数据构造和数据模拟方案。 职位要求 任职要求1.测试专业能力:具备2年以上软件测试经验,其中至少1年以上大数据领域测试经验。掌握功能测试、集成测试、性能测试等方法论,能独立设计测试用例和测试数据。对质量保障体系有深入理解,具备敏锐的缺陷洞察力和分析能力。2.大数据技术栈:具备大数据平台(如 Hadoop、Spark、Flink、Hive、Kafka 等)的测试经验。精通 SQL,能够编写复杂的查询语句进行数据验证和探查。理解数据仓库分层模型(如 ODS, DWD, DWS, ADS)。3. 工具开发能力:熟练掌握至少一门编程语言,如 Python、Java ,并具备良好的编码习惯。4.个人素质:具备出色的逻辑思维能力、分析问题和解决问题的能力。拥有强烈的技术热情、自驱力和团队合作精神。乐于分享,能够将技术方案清晰地传达给团队成员。 投递...
资深大数据开发 上海 全职 平台类 职位描述 1、负责离线和实时数据仓库的搭建与优化,保障数据的准确、完整和高效可用;2、根据业务需求设计合理的数据模型,开发高效ETL流程,进行数据分层与数据治理;3、跟进数据产品在业务场景中的落地,开发数据应用和分析工具,提升数据服务的易用性和价值;4、负责大数据平台和任务的性能调优、解决各类技术难题,保障系统的稳定与高效运行;5、深入理解游戏业务,对接业务部门,制定并实现复杂业务的数据解决方案;6、持续跟踪大语言模型等前沿技术发展,将数据开发能力转化为可落地的智能化实践经验。 职位要求 1、本科及以上学历,计算机、软件工程、数据分析或相关专业,5年以上大数据开发经验;2、精通Java、Python等至少一门编程语言,扎实的代码功底和算法能力;3、熟练掌握Hadoop、Hive、Spark、Flink、Kafka等大数据生态组件,有阿里云Maxcompute、ADB开发经验者优先;4、熟悉数据仓库理论体系,分层设计与维度建模,有PB级数据处理经验者优先;5、业务理解能力强,能够独立对接复杂业务需求,善于沟通和团队协作;6、逻辑思维强,有良好的技术敏感度和学习驱动力,抗压能力强,有责任心和团队合作精神;7、熟悉大语言模型等前沿技术,具备大语言模型等前沿技术应用能力。 投递...
具身算法实习生 上海 实习 职位描述 参与具身智能机器人算法研发,聚焦模仿学习/强化学习算法在真实机器人上的落地应用,参与数据采集、数据挖掘、数据评测全流程,以高质量数据驱动算法迭代。【岗位职责】- 参与遥操作数据采集、数据清洗、格式转换与质量评估,支撑算法训练数据需求;- 基于模仿学习(ACT、Diffusion Policy)或强化学习(PPO、SAC)进行模型训练与调优;- 参与数据挖掘与分析,识别高价值样本(失败轨迹、长尾场景),提升数据对模型的效果增益;- 协助建立数据质量评测流程,包括标注准确率校验、数据分布分析、端云一致性检查;- 在仿真环境(Isaac Sim、Mujoco)或真实机器人平台上进行算法验证与Badcase归因分析;- 跟踪具身智能与数据驱动的前沿技术,复现论文并探索新方法。 职位要求 【任职要求】- 计算机、自动化、机器人、人工智能等相关专业,硕士或博士在读(优秀本科生亦可);- 熟练掌握Python,熟悉PyTorch深度学习框架;- 了解模仿学习(ACT、Diffusion Policy)或强化学习(PPO、SAC)基础知识;- 了解ROS/ROS2,有机器人数据处理经验(MCAP、ROS bag、Parquet等)者优先;- 有真实机器人(机械臂、人形机器人、移动底盘)上手经验者优先;- 【快速入职】每周能保证4天以上实习时间,能连续实习3个月以上。【加分项】- 有遥操作数据采集或UMI/ALOHA系统使用经验;- 熟悉数据标注、数据挖掘或数据质量评测方法;- 有大规模数据处理经验(Spark、Ray等);- 在CoRL、ICRA、IROS、NeurIPS、CVPR等会议发表过相关论文;- 有GitHub开源项目贡献经历。【我们提供】- 真实的机器人实验环境与大规模数据采集设施;- 资深算法工程师一对一指导,快速成长;- 有机会参与顶级会议论文投稿;- 有竞争力的实习薪资与餐补;- 表现优异者可获得转正机会。 投递...
具身大模型数据架构师 深圳、上海、北京 全职 智能机器人板块 职位描述 岗位职责1、负责具身智能多模态数据体系建设,围绕视频、图像、音频、传感器、状态流、日志等海量异构数据,设计可扩展的数据接入、存储、组织、检索与消费架构;2、参与构建面向原始数据管理、训练评测集管理等的数据湖仓与数据管线,推动数据在采集、解析、切分、对齐、清洗、标注、入湖、索引、回放和回溯等环节的工程化落地;3、联合算法团队建设高质量训练数据集、评测集和数据闭环机制,支撑具身大模型的数据生产、问题定位、效果分析和持续迭代;4、参与多模态数据标准和中间结构设计,提升不同来源、不同格式数据之间的兼容性、复用性和可治理性;5、 构建 Data Agent,实现智能检索、数据分析、数据洞察等能力,持续提升数据生产效率与研发效率。 职位要求 任职要求1、计算机、数学、统计、自动化、电子、机器人等专业;2.、具备 AI 算法开发、数据工程、分布式系统、模型调优或系统工程优化相关经验之一;3、具备海量多模态异构数据的架构设计能力,能够从业务目标出发设计数据分层、数据模型、存储布局、索引组织与读写链路;4、熟悉 Python/Java/ go中至少一门语言,具备扎实的数据处理和工程实现能力;5、熟悉 Iceberg、Lance 等面向大规模分析或多模态数据场景的数据格式与存储方案,理解 Parquet、Arrow、对象存储、元数据管理等核心机制;6、熟悉 LanceDB、Milvus、Elasticsearch、ClickHouse 等检索/分析系统,或有多模态样本库建设经验;7、熟悉 Spark、Flink、Ray、Kafka 等大数据或分布式计算框架中的一项或多项,理解批处理、流处理、批流一体及任务编排;8、熟悉向量检索、特征索引、样本检索、数据切片、时间戳对齐、多模态关联等一种或多种能力,能够支撑训练数据构建和问题追溯;9、对数据闭环、具身智能和大模型方向有强烈兴趣,具备自驱力、学习能力和跨团队协作意识。加分项1、有机器人、自动驾驶、大模型行业等行业的多模态海量数据架构实践经验;2、有数据湖、湖仓一体、元数据平台、数据质量平台或数据检索平台建设经验;3、有顶会/期刊论文、开源项目、数据竞赛成果,或在数据基础设施方向有系统性产出。 投递...
Java数据平台开发 上海 全职 平台类 职位描述 1. 参与叠纸大数据平台和数据中台建设;2. 参与构建流批一体的数据自助分析平台,支持业务方自助进行数据的快速定位和分析;3. 在传统大数据开发和数仓建模的基础上,探索创新的方案,构建自动化、智能化的建模引擎;4. 保证大数据平台相关服务的稳定性、高可用性,不断优化服务性能。 职位要求 1. 计算机相关专业本科以上学历,5年以上Java相关工作经验;2. 熟练使用常用的JAVA技术框架,并对JAVA Web的各种主流框架如Spring、SpringBoot、MyBatis、Kafka等有深入的应用和优化经验,掌握它的原理和机制;3. 熟练掌握微服务开发和架构设计,有大型复杂业务系统架构设计经验者优先;4. 熟悉一种或多种大数据相关组件者优先,比如:Flink,Spark,Hive,元数据管理等,对组件的原理有深入的了解;5. 具有良好的学习能力、团队协助以及沟通能力,执行力强,对工作有责任心,具备良好的规划、沟通以及协调能力;6. 有数据类产品落地交付经验者优先。加分项:1. 了解python语言,有爬虫、pandas等开发经验更佳;2. 有阿里云平台DataWorks、Hologres、MaxCompute、ADB使用经验;3. 有DataX/HDFS/HIVE等开源工具实际生产使用经验者优先,熟悉源码实现者更佳;4. 有用skills提高开发效率落地场景的经验更佳。 投递...