Refine Reset All
Sort by
Job Type
Employer/Recruiter
Date Posted
Location
Job Type
Employer/Recruiter
All Filters

Java Spark Jobs In Beijing (Peking) - 15 Job Positions Available

1 – 15 of 15 jobs
易宝支付 YeePay jobs

风控Java研发工程师 北京 全职 金融 职位描述 期待拥有开放心态、拥抱持续进化的你成为易宝的事业伙伴,共绘 “一群人的浪漫”。1、负责支付风控中台核心子系统的设计与开发,包括但不限于规则引擎、实时决策引擎、变量平台、名单管理系统、人工审核工作流等,支撑每秒万级的高并发实时风控请求。2、与风控策略团队紧密配合,将复杂的反欺诈、反洗钱、反盗刷业务逻辑转化为高效、可维护的技术实现,支持策略的快速上线与A/B测试。3、基于Flink/Spark等大数据技术建设实时特征计算平台,为风控模型与策略提供准实时的指标支持;参与数据清洗、标签体系建设。4、攻克支付场景下的业务技术难题,如防重放、幂等性设计、分布式事务,以及对突发流量(如大促场景) 的弹性伸缩与限流降级。 职位要求 1、本科及以上学历,计算机相关专业,3-5年Java开发经验,其中至少1年以上风控、金融、支付或安全领域研发经验;2、扎实的JAVA基础,熟悉JAVA核心原理,熟练掌握多线程开发,有JVM调优经验优先;3、熟悉分布式系统设计与开发,熟悉Spring等主流框架,熟悉Redis、ES、Sqoop、Kafka、Hive其中的一种或几种中间件4、理解支付/信贷业务中常见的风险类型(盗刷、套现、薅羊毛、商户二清等),了解基本的反欺诈规则(如设备指纹、IP画像、行为序列)。5、有对接三方风控产品经验(如Sift Science、Forter、同盾、邦盛)或自建规则引擎(Drools/EasyRule/Aviator)深度优化经验。 投递...

Premium Full-time
易宝支付 YeePay  7 days ago
小米科技 Xiaomi Technology jobs

AIoT研发实习生-2027届 北京 校招 实习 软件研发类 职位描述 1. 协助开发面向 IoT 场景的 Agent 能力,包括任务拆解、工具调用、结果汇总与异常处理。2. 协助构建 Agent 工作流(如 ReAct / Plan-Execute),配合完成设备控制、状态查询、知识问答等场景的端到端联调。3. 参与 Prompt 设计与迭代,协助完成 Agent 的效果评测与问题复盘,持续优化响应质量与稳定性。4. 借助 AI 工具辅助编码,实现 IoT 场景相关功能开发,参与 AI 在 IoT 业务中的落地实践。5. 协助维护 Java/Python 相关后台接口,基于 Spring Boot

小米科技 Xiaomi Technology  29 days ago
极佳科技 GigaAI jobs

具身智能数据工程师 北京 全职 互联网 / 电子 / 网游 职位描述 负责具身智能方向的数据平台建设,支撑机器人、多模态感知、语言理解、动作决策、任务规划等场景的数据生产、管理、流转与分析。设计并建设大规模多模态数据处理平台,覆盖视频、图像、语音、文本指令、传感器数据、机器人操作轨迹、环境状态、任务执行日志等数据类型。负责数据采集、清洗、标注、质检、版本管理、样本检索、数据回流等核心链路的平台化能力建设。建设面向模型训练的数据集管理能力,包括数据集构建、切分、去重、质量评估、元数据管理、血缘追踪与可复现训练数据交付。参与搭建具身智能数据闭环系统,支持模型训练、评测、仿真、真实机器人执行后的数据回收与持续迭代。与算法、机器人、仿真、标注、产品等团队协作,抽象共性数据需求,沉淀稳定、高效、可扩展的平台工具。负责数据平台的性能优化、稳定性建设、权限治理、成本优化和工程规范落地。 职位要求 本科及以上学历,计算机、软件工程、人工智能、自动化、机器人、电子信息等相关专业优先。具备扎实的数据工程或后端平台开发经验,熟悉 Python / Java / Go / Scala 中至少一种语言。熟悉大规模数据处理链路,了解 Spark、Flink、Kafka、Airflow、Ray、Hadoop、Hive、ClickHouse、ElasticSearch 等技术中的一种或多种。熟悉数据库、对象存储、消息队列、任务调度、数据湖或数据仓库等平台基础组件。有良好的平台化思维,能够将复杂业务流程抽象为稳定的数据模型、任务系统、服务接口和工具链。具备较强的数据质量意识,理解数据清洗、标注质检、样本治理、版本管理、数据血缘、权限控制等工程问题。有多模态数据、机器人数据、视频理解数据、仿真数据或大规模模型训练数据平台经验者优先。熟悉 Kubernetes、Docker、云原生架构、分布式任务调度或高性能计算平台者优先。具备良好的沟通协作能力,能够与算法、工程、产品和运营团队高效配合,推动复杂系统落地。有具身智能、机器人学习、VLA / VLM / 多模态大模型相关数据平台经验优先。有数据标注平台、数据闭环平台、模型训练数据平台、仿真数据平台建设经验优先。熟悉 ROS、机器人日志格式、传感器数据、轨迹数据、仿真环境或模型评测链路优先。有从 0 到 1 搭建数据平台或核心数据链路的经验优先。 投递...

极佳科技 GigaAI  22 days ago
爱奇艺 iQIYI jobs

反作弊算法工程师 北京 社招 全职 技术 - 算法 职位 ID:A117785 职位描述 支持爱奇艺全域流量及推广渠道的反作弊体系。通过技术手段实现对虚假流量的检测和过滤,保障爱奇艺站内数据的真实性和渠道营销的可靠性。核心职责 :-风险识别:利用机器学习、深度学习、大模型等技术,构建针对流量异常和渠道作弊的识别模型-反作弊策略制定:通过分析作弊目标(渠道、分账、广告分成)和作弊手段(如代理 IP、模拟器、云手机),制定并落地覆盖全链路的反作弊规则策略-反作弊效果评估:搭建完善的反作弊效果评估体系,评估其在流量和渠道方向的 ROI,并根据效果推进其在业务层面进行整改-反作弊能力建设:构建完善的反作弊特征库,利用离线和实时处理技术支持实时反作弊和离线反作弊,提升识别的实时性和准确率 职位要求 -教育背景:计算机、信息类等相关专业硕士及以上-开发技能:熟练掌握 Java、Python、SQL/Hive 等计算机语言,熟悉 Hive、Spark、Flink 等 Hadoop 生态,具备大规模海量数据处理能力,有实时计算经验者优先-算法能力:熟练掌握基础的机器学习算法,如:LR、RF、GBDT、XGBoost等,有使用异常检测算法、图分析、深度学习等优先;-综合素质:具备高度的数据洞察和逻辑推理能力,能够从海量数据中捕捉到细微的数据异常并分析数据异常的原因,具备高效的沟通能力,能与各业务方沟通解决业务对反作弊的核心述求并推进实施;-反作弊经验:了解广告生态和归因逻辑,了解常见的作弊手段,了解黑产供应链者优先。 投递...

Premium Full-time Hadoop
爱奇艺 IQIYI  22 days ago
掌阅科技 iReader Technology jobs

数据研发工程师 北京 全职 研发 - 大数据 职位描述 1、负责掌阅集团企业级数据建设(涵盖流量、内容、用户、商业化等业务方向),提供通用、稳定、丰富、高效的公共数据能力,提升数据支持业务的效率,探索数据增量价值;2、面向流量、内容、用户、商业化等业务方向,建设专题数据,提供丰富易用的数据服务,直接支持公司业务决策分析,赋能业务;3、建设企业级数据治理和管理体系,结合业务+元数据+技术,推进资源成本的优化,提高数据服务质量,保障数据产出的稳定性和准确性;4、参与公司级别商业化相关系统数据设计、研发以及保障。 职位要求 1、精通分布式文件系统hdfs常用命令以及底层原理。2、精通yarn,datax,sqoop,hbase 等hadoop生态常用工具3、精通数仓常用计算引擎,hive/spark/kylin/impala/starrocks 至少两种以上。4、精通常用数据库3种以上。mysql/redis/hbase/es5、对数仓之上的衍生产品(例:投放,BI,DMP,数据分析平台,监控平台,调度平台等)有丰富经验,有过大厂经验最好,。6、熟悉linux常用命令,熟悉至少一种脚本语言。shell/python7、熟悉Kafka、Flink、Scala、Java技术栈, 熟练运用流计算窗口、状态、算子、并发、调优技术8、对自己使用过的组件看过源码者优先考虑。强加分项:1.有明确的广告投放系统经验,对广告投放术语、指标例如 cpm/cpc/cps/wau/uv/pv/ltv/apru/roi等等有相对深刻得了理解,并参与实践2.对计算广告服务基本流程架构(dsp/adx/dmp/ssp等等)、核心概念例如RTA/RTB等等有相对深刻的了解甚至实际参与研发3.对于用户画像-用户标签-用户分群的数据体系建设有实践经验 投递...

Premium Full-time
掌阅科技 IReader Technology  19 days ago
Apple jobs

SummaryApple is where individual imaginations gather together, committing to the values that lead to great work. Every new product we build, service we create, or Apple Store experience we deliver is the result of us making

Apple  9 days ago
Xiaomi jobs

高级算法工程师 北京 社招 全职 职位 ID:A229937 职位描述 1. 负责排线、道口均衡、配载均衡等模型的开发与优化工作,通过先进的算法设计,解决多供应商、多工厂入厂运输过程中的复杂问题,提高运输效率,降低运输成本。2. 针对场内排产、排程、VDC路径规划等场景,开发高效的算法模型,确保工厂内部物流运作的顺畅和高效,满足生产计划和调度的要求。3. 负责库存优化算法的开发与实施,通过数据分析和建模,优化库存水平,降低库存成本,同时确保供应链的稳定性和响应能力。4. 与供应链管理、物流运营、生产计划等部门紧密合作,深入了解业务需求,确保算法模型能够有效支持业务目标的实现。5. 跟踪国内外供应链物流领域的最新算法研究成果和技术动态,结合公司业务需求,探索新的算法应用方向和技术创新点。 职位要求 1. 计算机、数学、统计学或人工智能等相关专业硕士学历以上;博士优先。有工厂域排产排程经验者优先。2. 熟练掌握运筹学、数学建模、优化算法等基础知识,具备扎实的数学功底和逻辑思维能力。3. 精通Python、Java等编程语言,熟悉常用数据结构和算法。4. 熟悉机器学习、深度学习、运筹优化、统计学等算法,了解大模型相关理论,有大模型部署、微调经验,熟悉Qwen、ChatGPT、InternVL等大模型。5. 熟悉大模型(如 LLM)的微调技术(如 LoRA)和部署流程,具备 Prompt 调优的经验,能够根据业务需求设计和优化 Prompt,提升模型的性能和输出质量。6. 熟悉数据挖掘和大数据处理工具(如Hadoop、Hive、Spark),熟练使用算法框架(如TensorFlow、PyTorch)和优化工具(如Gurobi、Ortools)。7. 具备在复杂业务场景下独立开展算法项目的能力,能够从问题定义、数据收集与分析、模型构建与优化到实际部署的全流程进行有效推进。 投递...

Premium Full-time
Xiaomi  7 days ago
Xiaomi jobs

高级大数据研发工程师 北京 社招 全职 职位 ID:A94598 职位描述 1、负责小爱内容资源数据流及数据服务建设;2、负责小爱内容数据、搜索推荐服务架构优化;3、负责小爱用户画像、LLM通用知识库建设。 职位要求 1、熟悉大数据相关技术:Spark/Flink/Hadoop/HBase/Hive/Iceberg等;2、熟练使用Java、Scala、Python语言中的一种或者多种,熟悉java常见数据结构、多线程并发、JVM等;3、熟悉常用基础组件:Mq/Redis/Es等;具备数据库系统理论知识,熟悉Mysql/Tidb等,精通SQL;4、有过分布式、高并发业务系统搭建经验优先;5、熟悉大模型(LLM)技术,对向量数据库、RAG等有过深入调研优先;6、责任心强,具有较强的学习、沟通和问题解决能力。 投递...

Premium Full-time
Xiaomi  7 days ago
百观科技 BigOne Lab jobs

大数据开发工程师 北京 全职 研发 - 大数据 职位描述 职位介绍:- 参与公司离线数仓的架构和搭建工作;- 参与DataPipeline,DataFlow、流程自动化、数据可视化的开发工作;- 参与架构优化、性能改进、功能完善、故障分析等工作;基本要求:- 全日制本科及以上学历,计算机相关专业;- 3年及以上大数据开发工作经验;- 熟悉Hadoop生态,对Spark、Hive、Presto等组件有丰富的使用和开发经验;- 有Airflow等调度工具的设计、开发经验; - 熟悉数仓模型的设计,分层设计和管理;- 可以熟练使用Java或Pyhton进行开发工作;加分项:- 使用过AWS大数据组件;- 参与过数据湖、湖仓一体的建设;- 有元数据管理、数据治理、数据目录、数据资产管理等相关经验; 职位要求 - 投递...

Premium Full-time
百观科技 BigOne Lab  6 days ago
百观科技 BigOne Lab jobs

高级大数据开发工程师 北京 全职 互联网 / 电子 / 网游 职位描述 - 参与公司数据湖架构搭建和开发;- 参与ETL设计,数据工程建设和数据可视化开发; 职位要求 基本要求:- 全日制本科学历,计算机相关专业,5年-10年大数据开发工作经验;- 熟悉公有云架构,对阿里云/AWS数据湖生态有丰富的项目经验;- 熟练使用MR/Spark/Flink等大数据计算框架,掌握Java/Scala/Python等开发语言- 掌握数据湖体系架构、数据建模方法、数据治理等知识,较强的业务理解和抽象能力;- 熟系Airflow调度工具,使用Zeppelin、Jupyter Notebook进行数据开发; - 熟系AWS LakeFormation、Glue、EMR大数据组件,使用JavaSpark,Python进行数据分析;加分项:- 数据湖方向做过前瞻性技术规划的建设经验者,优先;- 通过技术驱动产品变革,并带来好的结果经验者,优先; 投递...

Premium Full-time
百观科技 BigOne Lab  6 days ago
Soul APP jobs

推荐架构实习生-BJ 北京 社招 实习 互联网 / 电子 / 网游 职位描述 1、参与千万级用户线上推荐业务全链路架构迭代与落地,涵盖召回、粗排、精排、特征服务、在线推理等核心模块,负责系统性能瓶颈优化、架构重构;2、面向大规模机器学习训练 / 推理场景,完成推荐系统流程抽象、组件化改造,支撑海量样本、高维度特征、大模型推理的工程效率提升;3、负责高并发、高吞吐在线推荐服务稳定性建设,通过缓存、异步、资源调度等手段优化 QPS、RT、扩容能力,线上问题排查与治理;4、参与技术方案评审、性能压测、线上灰度发布,沉淀推荐架构通用工具与技术文档。 职位要求 1、本科及以上在读,计算机、软件工程、数学、电子信息、通信等相关专业,28/29 届毕业优先,可长期实习;2、熟练使用 Java / C++ / Go 至少一门后端开发语言,有完整项目编码经验,代码规范良好;3、扎实计算机基础:熟悉数据结构和算法、操作系统、计算机网络、数据库原理;掌握掌握多线程、内存模型、网络编程优先4、了解推荐系统基础链路,有分布式、高并发服务开发经验优先,熟悉 Redis、MQ、向量检索、Spark 等组件加分5、熟悉ai coding和agent使用加分 投递...

Premium Full-time Java C++
Soul APP  6 days ago
Momenta jobs

后端开发实习生-python 北京 实习 互联网 / 电子 / 网游 日常实习生 职位描述 协助自动驾驶数据产线平台的搭建与开发协助数据产线平台的故障与问题排查协助前后端联调 职位要求 硕士及以上学历,实习6个月及以上 每周5天计算机、软件相关专业能快速理解业务需求,有产品原型设计能力熟悉Java、Python、Rust,以及相关开发框架有spark\trino\flink\hbase\es等数据引擎使用经验,源码阅读经验尤佳熟悉一种或多种数据存储与查询引擎(含数据库) 投递...

Premium Full-time
Momenta  6 days ago
Conviva jobs

Conviva is the first and best place to understand and optimize digital customer experiences. Our Operational Data Platform harnesses full-census, comprehensive client-side telemetry—capturing every aspect of customer experience and engagement across all devices and linking them

Conviva  6 days ago
Z.ai jobs

MaaS-数据开发工程师(风控方向) 北京 全职 互联网 / 电子 / 网游 职位描述 职位描述:1. 负责大模型业务风控数据体系建设,支撑反作弊、反欺诈攻防策略场景,构建高质量、可复用的数据资产,保障数据时效性与准确性。2. 参与实时数仓与特征工程架构设计,覆盖日志接入、非结构化数据处理、特征计算、策略引擎等关键链路,快速响应黑产变化。3. 使用Java/Python开发高效数据处理模块,优化流式计算资源利用率,推动数据治理与工程化实践(CI/CD、单元测试、性能调优)。4. 与算法、安全团队紧密协作,深入理解攻防逻辑,从数据视角主动发现风险并推动策略迭代。 职位要求 任职要求:1. 本科及以上学历,3年以上数据开发经验,有风控/反作弊/反欺诈领域实战经验,对异常数据敏感。2. 熟练掌握Java或Python,精通大数据技术栈,具备扎实的编码能力与工程能力(代码规范、测试、调优、CI/CD),能独立维护高质量数据处理模块。3. 精通离线&实时计算技术栈(Spark/Flink/Kafka),有海量数据实时处理及调优经验;熟悉OLAP引擎(ClickHouse/Doris),能进行数据建模与查询优化。4. 具备非结构化/半结构化数据解析经验(文本、JSON、XML、日志),熟练使用正则表达式、UDF等技术处理脏数据、乱码等问题。加分项:1. 有爬虫数据处理经验,熟悉爬虫数据的清洗、解析、结构化流程。2. 有AI风控实战经验:如用户行为序列建模、图算法、NLP文本风险识别、智能体辅助策略分析等。3. 了解图数据库(Neo4j/HugeGraph)或向量数据库(Milvus/FAISS)。4. 有从0到1搭建风控数据体系经验,具备架构思维和快速响应能力。 投递...

Premium Full-time
Z.ai  17 hours ago
Xiaomi jobs

大数据开发工程师 北京 社招 全职 职位 ID:A79146 职位描述 1、负责企业级数据仓库设计、建模、规范以及研发工作;2、深入理解业务需求,规划数据仓库建设的整体方向和技术路线,构建快速、准确、灵活、实用的数据仓库,挖掘发挥数据的价值;3、保证数据仓库的及时、准确、稳定产出,构建好用的数据仓库;4、打造行业一流的数据仓库团队;5、与小伙伴一起调研和实践热门数据仓库组件和技术(数据湖、TiDB、FlinkSql、实时数仓等);6、探索 AI 与数仓的深度融合,推动 AI Agent、大模型在数据开发、数据治理、智能分析等场景的落地应用;7、建设数仓智能体(Data Agent),实现自然语言驱动的数据查询、指标解读、异常归因等能力,降低数据使用门槛;8、负责数据仓库的 AI 赋能体系搭建,包括但不限于:智能 ETL 开发辅助、数据质量智能巡检、元数据智能管理、智能运维等;9、跟踪业界 AI+Data 前沿技术(Text2SQL、RAG、LLM4Data 等),结合业务场景进行技术选型与落地,推动团队 AI 能力建设。 职位要求 1、精通Unix/Linux操作系统下Java或Scala开发,有良好的编码习惯,有扎实的计算机理论基础;2、熟练掌握大数据处理技术栈,有丰富的Hadoop/Spark的实际项目使用经验,使用过Flink/Doris/Holo等更佳;3、大数据开发工作至少5-10年,有Hive数据仓库开发经验,有实时数据仓库开发经验者更佳;4、具有优秀的业务理解能力、自我推动力,有较强的逻辑分析能力,对数据敏感,对大数据处理和分析技术充满激情;5、熟悉数据仓库建设生命周期和流程规范,并掌握主题建模、维度建模理论者优先;6、了解大模型原理与应用,有 LLM/RAG/Agent 等 AI 技术在数据领域落地的实践经验者优先;7、熟悉 Text2SQL、智能数据治理、AI 辅助 ETL 开发等方向,具备将 AI 能力融入数据开发流程的意识和能力;8、持续关注 AI+Data 前沿技术动态,有较强的学习能力和技术热情,愿意探索大模型与数仓的深度结合。 投递...

Premium Full-time AI ETL
Xiaomi  13 hours ago

Subscribe for job alerts and resources to make your job search easier!

Confirmation email sent to

Check your email and click on the link to start receiving your job alerts

Receive the latest job openings for:

java spark jobs in beijing

Confirmation email sent to

Check your email and click on the link to start receiving your job alerts

All Filters Apply
Sort by
Job Type
Employer/Recruiter