具身智能数据工程师 北京 全职 互联网 / 电子 / 网游 职位描述 负责具身智能方向的数据平台建设,支撑机器人、多模态感知、语言理解、动作决策、任务规划等场景的数据生产、管理、流转与分析。设计并建设大规模多模态数据处理平台,覆盖视频、图像、语音、文本指令、传感器数据、机器人操作轨迹、环境状态、任务执行日志等数据类型。负责数据采集、清洗、标注、质检、版本管理、样本检索、数据回流等核心链路的平台化能力建设。建设面向模型训练的数据集管理能力,包括数据集构建、切分、去重、质量评估、元数据管理、血缘追踪与可复现训练数据交付。参与搭建具身智能数据闭环系统,支持模型训练、评测、仿真、真实机器人执行后的数据回收与持续迭代。与算法、机器人、仿真、标注、产品等团队协作,抽象共性数据需求,沉淀稳定、高效、可扩展的平台工具。负责数据平台的性能优化、稳定性建设、权限治理、成本优化和工程规范落地。 职位要求 本科及以上学历,计算机、软件工程、人工智能、自动化、机器人、电子信息等相关专业优先。具备扎实的数据工程或后端平台开发经验,熟悉 Python / Java / Go / Scala 中至少一种语言。熟悉大规模数据处理链路,了解 Spark、Flink、Kafka、Airflow、Ray、Hadoop、Hive、ClickHouse、ElasticSearch 等技术中的一种或多种。熟悉数据库、对象存储、消息队列、任务调度、数据湖或数据仓库等平台基础组件。有良好的平台化思维,能够将复杂业务流程抽象为稳定的数据模型、任务系统、服务接口和工具链。具备较强的数据质量意识,理解数据清洗、标注质检、样本治理、版本管理、数据血缘、权限控制等工程问题。有多模态数据、机器人数据、视频理解数据、仿真数据或大规模模型训练数据平台经验者优先。熟悉 Kubernetes、Docker、云原生架构、分布式任务调度或高性能计算平台者优先。具备良好的沟通协作能力,能够与算法、工程、产品和运营团队高效配合,推动复杂系统落地。有具身智能、机器人学习、VLA / VLM / 多模态大模型相关数据平台经验优先。有数据标注平台、数据闭环平台、模型训练数据平台、仿真数据平台建设经验优先。熟悉 ROS、机器人日志格式、传感器数据、轨迹数据、仿真环境或模型评测链路优先。有从 0 到 1 搭建数据平台或核心数据链路的经验优先。 投递...
反作弊算法工程师 北京 社招 全职 技术 - 算法 职位 ID:A117785 职位描述 支持爱奇艺全域流量及推广渠道的反作弊体系。通过技术手段实现对虚假流量的检测和过滤,保障爱奇艺站内数据的真实性和渠道营销的可靠性。核心职责 :-风险识别:利用机器学习、深度学习、大模型等技术,构建针对流量异常和渠道作弊的识别模型-反作弊策略制定:通过分析作弊目标(渠道、分账、广告分成)和作弊手段(如代理 IP、模拟器、云手机),制定并落地覆盖全链路的反作弊规则策略-反作弊效果评估:搭建完善的反作弊效果评估体系,评估其在流量和渠道方向的 ROI,并根据效果推进其在业务层面进行整改-反作弊能力建设:构建完善的反作弊特征库,利用离线和实时处理技术支持实时反作弊和离线反作弊,提升识别的实时性和准确率 职位要求 -教育背景:计算机、信息类等相关专业硕士及以上-开发技能:熟练掌握 Java、Python、SQL/Hive 等计算机语言,熟悉 Hive、Spark、Flink 等 Hadoop 生态,具备大规模海量数据处理能力,有实时计算经验者优先-算法能力:熟练掌握基础的机器学习算法,如:LR、RF、GBDT、XGBoost等,有使用异常检测算法、图分析、深度学习等优先;-综合素质:具备高度的数据洞察和逻辑推理能力,能够从海量数据中捕捉到细微的数据异常并分析数据异常的原因,具备高效的沟通能力,能与各业务方沟通解决业务对反作弊的核心述求并推进实施;-反作弊经验:了解广告生态和归因逻辑,了解常见的作弊手段,了解黑产供应链者优先。 投递...
数据研发工程师 北京 全职 研发 - 大数据 职位描述 1、负责掌阅集团企业级数据建设(涵盖流量、内容、用户、商业化等业务方向),提供通用、稳定、丰富、高效的公共数据能力,提升数据支持业务的效率,探索数据增量价值;2、面向流量、内容、用户、商业化等业务方向,建设专题数据,提供丰富易用的数据服务,直接支持公司业务决策分析,赋能业务;3、建设企业级数据治理和管理体系,结合业务+元数据+技术,推进资源成本的优化,提高数据服务质量,保障数据产出的稳定性和准确性;4、参与公司级别商业化相关系统数据设计、研发以及保障。 职位要求 1、精通分布式文件系统hdfs常用命令以及底层原理。2、精通yarn,datax,sqoop,hbase 等hadoop生态常用工具3、精通数仓常用计算引擎,hive/spark/kylin/impala/starrocks 至少两种以上。4、精通常用数据库3种以上。mysql/redis/hbase/es5、对数仓之上的衍生产品(例:投放,BI,DMP,数据分析平台,监控平台,调度平台等)有丰富经验,有过大厂经验最好,。6、熟悉linux常用命令,熟悉至少一种脚本语言。shell/python7、熟悉Kafka、Flink、Scala、Java技术栈, 熟练运用流计算窗口、状态、算子、并发、调优技术8、对自己使用过的组件看过源码者优先考虑。强加分项:1.有明确的广告投放系统经验,对广告投放术语、指标例如 cpm/cpc/cps/wau/uv/pv/ltv/apru/roi等等有相对深刻得了理解,并参与实践2.对计算广告服务基本流程架构(dsp/adx/dmp/ssp等等)、核心概念例如RTA/RTB等等有相对深刻的了解甚至实际参与研发3.对于用户画像-用户标签-用户分群的数据体系建设有实践经验 投递...
高级算法工程师 北京 社招 全职 职位 ID:A229937 职位描述 1. 负责排线、道口均衡、配载均衡等模型的开发与优化工作,通过先进的算法设计,解决多供应商、多工厂入厂运输过程中的复杂问题,提高运输效率,降低运输成本。2. 针对场内排产、排程、VDC路径规划等场景,开发高效的算法模型,确保工厂内部物流运作的顺畅和高效,满足生产计划和调度的要求。3. 负责库存优化算法的开发与实施,通过数据分析和建模,优化库存水平,降低库存成本,同时确保供应链的稳定性和响应能力。4. 与供应链管理、物流运营、生产计划等部门紧密合作,深入了解业务需求,确保算法模型能够有效支持业务目标的实现。5. 跟踪国内外供应链物流领域的最新算法研究成果和技术动态,结合公司业务需求,探索新的算法应用方向和技术创新点。 职位要求 1. 计算机、数学、统计学或人工智能等相关专业硕士学历以上;博士优先。有工厂域排产排程经验者优先。2. 熟练掌握运筹学、数学建模、优化算法等基础知识,具备扎实的数学功底和逻辑思维能力。3. 精通Python、Java等编程语言,熟悉常用数据结构和算法。4. 熟悉机器学习、深度学习、运筹优化、统计学等算法,了解大模型相关理论,有大模型部署、微调经验,熟悉Qwen、ChatGPT、InternVL等大模型。5. 熟悉大模型(如 LLM)的微调技术(如 LoRA)和部署流程,具备 Prompt 调优的经验,能够根据业务需求设计和优化 Prompt,提升模型的性能和输出质量。6. 熟悉数据挖掘和大数据处理工具(如Hadoop、Hive、Spark),熟练使用算法框架(如TensorFlow、PyTorch)和优化工具(如Gurobi、Ortools)。7. 具备在复杂业务场景下独立开展算法项目的能力,能够从问题定义、数据收集与分析、模型构建与优化到实际部署的全流程进行有效推进。 投递...
高级大数据研发工程师 北京 社招 全职 职位 ID:A94598 职位描述 1、负责小爱内容资源数据流及数据服务建设;2、负责小爱内容数据、搜索推荐服务架构优化;3、负责小爱用户画像、LLM通用知识库建设。 职位要求 1、熟悉大数据相关技术:Spark/Flink/Hadoop/HBase/Hive/Iceberg等;2、熟练使用Java、Scala、Python语言中的一种或者多种,熟悉java常见数据结构、多线程并发、JVM等;3、熟悉常用基础组件:Mq/Redis/Es等;具备数据库系统理论知识,熟悉Mysql/Tidb等,精通SQL;4、有过分布式、高并发业务系统搭建经验优先;5、熟悉大模型(LLM)技术,对向量数据库、RAG等有过深入调研优先;6、责任心强,具有较强的学习、沟通和问题解决能力。 投递...
大数据开发工程师 北京 全职 研发 - 大数据 职位描述 职位介绍:- 参与公司离线数仓的架构和搭建工作;- 参与DataPipeline,DataFlow、流程自动化、数据可视化的开发工作;- 参与架构优化、性能改进、功能完善、故障分析等工作;基本要求:- 全日制本科及以上学历,计算机相关专业;- 3年及以上大数据开发工作经验;- 熟悉Hadoop生态,对Spark、Hive、Presto等组件有丰富的使用和开发经验;- 有Airflow等调度工具的设计、开发经验; - 熟悉数仓模型的设计,分层设计和管理;- 可以熟练使用Java或Pyhton进行开发工作;加分项:- 使用过AWS大数据组件;- 参与过数据湖、湖仓一体的建设;- 有元数据管理、数据治理、数据目录、数据资产管理等相关经验; 职位要求 - 投递...
大数据开发工程师 北京 社招 全职 职位 ID:A79146 职位描述 1、负责企业级数据仓库设计、建模、规范以及研发工作;2、深入理解业务需求,规划数据仓库建设的整体方向和技术路线,构建快速、准确、灵活、实用的数据仓库,挖掘发挥数据的价值;3、保证数据仓库的及时、准确、稳定产出,构建好用的数据仓库;4、打造行业一流的数据仓库团队;5、与小伙伴一起调研和实践热门数据仓库组件和技术(数据湖、TiDB、FlinkSql、实时数仓等);6、探索 AI 与数仓的深度融合,推动 AI Agent、大模型在数据开发、数据治理、智能分析等场景的落地应用;7、建设数仓智能体(Data Agent),实现自然语言驱动的数据查询、指标解读、异常归因等能力,降低数据使用门槛;8、负责数据仓库的 AI 赋能体系搭建,包括但不限于:智能 ETL 开发辅助、数据质量智能巡检、元数据智能管理、智能运维等;9、跟踪业界 AI+Data 前沿技术(Text2SQL、RAG、LLM4Data 等),结合业务场景进行技术选型与落地,推动团队 AI 能力建设。 职位要求 1、精通Unix/Linux操作系统下Java或Scala开发,有良好的编码习惯,有扎实的计算机理论基础;2、熟练掌握大数据处理技术栈,有丰富的Hadoop/Spark的实际项目使用经验,使用过Flink/Doris/Holo等更佳;3、大数据开发工作至少5-10年,有Hive数据仓库开发经验,有实时数据仓库开发经验者更佳;4、具有优秀的业务理解能力、自我推动力,有较强的逻辑分析能力,对数据敏感,对大数据处理和分析技术充满激情;5、熟悉数据仓库建设生命周期和流程规范,并掌握主题建模、维度建模理论者优先;6、了解大模型原理与应用,有 LLM/RAG/Agent 等 AI 技术在数据领域落地的实践经验者优先;7、熟悉 Text2SQL、智能数据治理、AI 辅助 ETL 开发等方向,具备将 AI 能力融入数据开发流程的意识和能力;8、持续关注 AI+Data 前沿技术动态,有较强的学习能力和技术热情,愿意探索大模型与数仓的深度结合。 投递...
AIoT研发实习生-2027届 北京 校招 实习 软件研发类 职位描述 1. 协助开发面向 IoT 场景的 Agent 能力,包括任务拆解、工具调用、结果汇总与异常处理。2. 协助构建 Agent 工作流(如 ReAct / Plan-Execute),配合完成设备控制、状态查询、知识问答等场景的端到端联调。3. 参与 Prompt 设计与迭代,协助完成 Agent 的效果评测与问题复盘,持续优化响应质量与稳定性。4. 借助 AI 工具辅助编码,实现 IoT 场景相关功能开发,参与 AI 在 IoT 业务中的落地实践。5. 协助维护 Java/Python 相关后台接口,基于 Spring Boot