Refine Reset All
Sort by
Company
Employer/Recruiter
Experience
Date Posted
Company
Job Type
Employer/Recruiter
Experience
All Filters

Hive Jobs In China - 73 Job Positions Available

1 – 20 of 73 jobs
NIO jobs

知识平台算法专家(RAG & 知识图谱方向) 上海 社招 全职 数字技术 本科及以上 5-7 年 职位描述 岗位核心使命深度融合 LLM 与知识图谱技术,构建企业级 GraphRAG 架构。通过本体建模与高精度检索技术,解决大模型在复杂专业领域下的幻觉问题,打造工业级的知识服务引擎。主要职责RAG 架构优化:负责企业级 RAG(检索增强生成)系统的全链路研发。针对长文本及复杂知识,优化文档切片 (Chunking) 策略、多路召回 (Retrieval) 及 重排序 (Reranking) 算法,提升问答的准确性与归因能力。知识中枢建设:负责领域本体论 (Ontology) 建模,设计高扩展性的 Schema;利用 LLM 实现自动化知识抽取(实体、属性、三元组),构建高质量结构化知识库。底层存储与检索:负责基于 Milvus/Zilliz 的向量数据库与 Elasticsearch 的全文检索集成,设计向量-标量混合检索方案,优化海量数据的检索延迟与相关性。推理与应用落地:探索图增强检索(GraphRAG)、多步推理链(CoT)在知识平台中的应用,负责从非结构化数据到结构化知识转化的全流程算法迭代。 职位要求 1.

NIO  24 days ago
NIO jobs

数据仓库工程师 上海 社招 全职 职能与支持 - 数据分析 本科及以上 3-5 年 职位描述 1. 调研现有系统数据情况,并根据业务模块和需求,参与数据仓库设计与研发,建设电驱/电池工业化核心数据资产;2. 负责从多个系统及数据源进行数据获取,并根据数据标准同步至数据湖,保证数据的完整性和准确性;3. 负责不同技术场景下的数据获取和使用开发方案落地(实时、离线);4. 负责数据治理体系的完善和实施,打造稳定可靠的数据服务和保障体系;5. 与业务团队、算法团队、产品团队紧密合作,参与数据产品和应用的数据研发,与产品一起打造极致体验的数据产品。6. 负责数据化运营,沉淀算法和数据分析思路,协作并推动数据化运营项目落地; 职位要求 1. 计算机、软件工程、自动化等相关专业本科及以上;2. 3-7年大数据工程实施经验,数据仓库建模和开发,了解目前主流大数据技术,如流批一体、数据湖等;3. 熟练掌握hive、spark等大数据工具,具备海量数据加工处理(ETL)相关经验,具备丰富的优化经验。熟练使用Java、Python等语言,熟悉hive UDF开发;4. 能独立负责业务域数据仓库开发及维护、数据仓库模型、数据报表等工作内容;熟悉数据仓库模型设计,掌握常用数据建模方法;5. 熟悉数据治理方法论、具备一定的数据治理经验;6. 较好的业务理解和数据洞察能力,能直接和业务对话,快速进行需求的理解和落地;7. 具有良好的团队合作和沟通能力,有很强的自驱力,能主动为结果负责; 投递...

Premium Full-time
NIO  24 days ago
Makro PRO jobs

We are seeking an experienced Senior Data Engineer to design, implement, and maintain our data infrastructure and pipelines. The ideal candidate will have a strong background in data engineering, big data technologies, and cloud platforms. You

Makro PRO  24 days ago
BOKE Technology Co., Ltd jobs

大数据开发负责人 上海 全职 互联网 / 电子 / 网游 职位描述 1、负责公司游戏数据体系的整体规划与建设,搭建稳定、规范、可复用的数据基础设施和数据仓库体系。2、负责离线数仓、实时数仓、指标体系、数据集市、数据服务等方向的架构设计与落地,推动数据从采集、清洗、建模、加工到应用的全链路建设。3、负责数据平台和数据工具能力建设,包括数据开发平台、任务调度、数据质量、元数据管理、血缘分析、权限管理、指标管理、标签体系、报表看板等。4、负责数据治理体系建设,推动数据标准、指标口径、数据质量、数据资产沉淀和数据安全管理,提升数据的准确性、一致性和可用性。5、负责数据开发团队的管理工作,包括团队规划、人员培养、技术方案评审、项目排期、跨部门协作和交付质量管理。6、持续优化数据链路性能、资源成本和开发效率,提升数据系统的稳定性、时效性和可扩展性。任职要求:1、本科及以上学历,计算机、软件工程、数据科学、统计学等相关专业优先。2、8 年及以上数据开发/数据仓库/大数据平台相关经验,3 年及以上团队管理经验,有 15 人以上团队管理经验优先。3、具备扎实的数据仓库建设经验,熟悉数仓分层、维度建模、主题域规划、指标体系建设、数据治理等方法论。4、熟悉大数据技术体系,了解 Hive、Spark、Flink、Kafka、Hadoop、ClickHouse、Doris、StarRocks、Airflow、DolphinScheduler 等常见组件中的一种或多种。 投递...

Premium Full-time
BOKE Technology Co., Ltd  29 days ago
Seagate Technology jobs

About our group: We are a proactive, highly solutions oriented and collaborative team that works with all the various business groups across the organization. Our purpose is capturing massive amounts of data is to transform this

Seagate Technology  22 days ago
Makro PRO jobs

Job Summary: This is the contact point for the local team to work closely with the headquarter teams. We are seeking an experienced Senior Data Engineer to design, implement, and maintain our data infrastructure and pipelines.

Makro PRO  22 days ago
加入XD Inc. jobs

TapTap 大数据开发实习生(上海) 上海 实习 互联网 / 电子 / 网游 技术大类 TapTap 职位描述 1、参与 AI 数据研发能力建设,探索自然语言数据分析、Text-to-SQL、AI 辅助数据校验、智能报表生成等方向;2、参与数据 Agent / AI 数据工具建设,将数据表、指标口径、元数据、知识库等能力封装为可被 AI 调用的工具,提升数据分析和研发效率;3、面向商店、内容、开发者运营等业务方向,参与专题数据建设、指标开发、看板底表和数据分析支持,帮助业务理解用户行为、内容表现和产品效果;4、参与离线 / 实时数据研发,包括数据清洗、建模、任务开发、数据校验和链路监控,保障数据产出的准确性和稳定性;5、参与 TapTap 基础数据建设,沉淀公共数据表、指标口径、数据质量校验等通用数据能力,提升业务分析和产品决策效率。 职位要求 1、研究生及以上学历,计算机、软件工程、数据科学、统计学等相关专业优先;2027 届、2028 届在校生,能连续实习 6 个月及以上,每周到岗 4-5 天;2、对 AI 与数据工程结合有兴趣,愿意参与

Premium Full-time AI
加入XD Inc.  22 days ago
ThunderSoft jobs

车载测试(仪表、T-box、导航、ADAS) 保定 全职 研发 - 测试 职位 ID:A173586 职位描述 职责描述:对自动驾驶数据闭环系统的数据测试,包括1. 基于自动驾驶大数据处理平台(例如Hadoop/Spark),利用数据挖掘、机器学习等相关算法,解决自动驾驶业务需求,为自动驾驶评测、功能迭代,运营决策提供测试支持2. 用java/python/shell/javascript其中至少一种编程语言,能够开发自动化测试脚本完成数据验证3. 负责自动驾驶领域的数据测试,从场景,评价,用户,运营等多个维度挖掘数据价值,发现数据和业务背后规律,应用于产品研发、用户运营、商业等各种领域4.有hadoop, hive,Zookeeper,Hbase,Spark,ElastivSearch,Kafka,Flink,flume等分布式开源软件测试和应用经验。掌握基于分布式系统的ETL,数据仓库,BI报表的测试流程及方法。 职位要求 任职要求:1、具备数据一致性、完整性、准确性、安全性测试设计及实施经验2、具备处理大量数据和复杂算法的测试技巧,包括不限于能编写针对数据化产品类的自动化框架和脚本3、具备良好的数据分析和问题解决能力,能够快速定位问题,提出解决方案,同时具备良好的沟通能力,能有效地与开发团队、产品团队和其他测试团队合作4. 具备扎实的测试理知识,有测试需求分析经验能独立设计数据相关和编写测试用例5.熟悉Mysql/mongoDB,熟练掌握SaL,具备较强的思维逻辑能力,可完成复杂查询。6.有hadoop, hive,Zookeeper,Hbase,Spark,ElastivSearch,Kafka,Flink,flume等分布式开源软件测试和应用经验。掌握基于分布式系统的ETL,数据仓库,BI报表的测试流程及方法。7.熟练使用java/python/shell/javascript其中至少一种编程语言,能够开发自动化测试脚本完成数据验证8、3年以上相关工作经验,有汽车行业相关云平台、数据闭环平台、互联网或智驾相关领域经验者优先;9、面试优秀者,学历可放宽至专科 投递...

Premium Full-time
ThunderSoft  22 days ago
NielsenIQ jobs

Job Description Job Summary Responsible for executing technical and statistical aspects of modeling and analytical projects and for ensuring that projects are delivered to the high-quality standards and timeline agreed with clients. This role will involve

NielsenIQ  20 days ago
Jabil jobs

At Jabil (NYSE: JBL), we are proud to be a trusted partner for the worlds top brands, offering comprehensive engineering, supply chain, and manufacturing solutions. With 60 years of experience across industries and a vast network

Jabil  20 days ago
NIO jobs

提前批-数据分析 上海 校招 正式 职能与支持 - 数据分析 本科及以上 2027届校园招聘-技术提前批 职位 ID:A179663 职位描述 1. 为售后多业务场景提供数据服务,包括不限于构建自动化、可视化模型报表/看板,支持总部&区域公司业务数据化运营;2. 基于NIO数据平台建立数据模型,包括业务底层数据建模、开发&指标可视化;3. 支撑业务自动化、智能化运营,应用机器学习/AI技术,建立实时/离线数据挖掘模型,并协同产品&开发团队实现模型算法产品化。 职位要求 1. 本科及以上学历,专业不限,大数据、计算机、统计学、数据、自动化等专业优先考虑;2. 具备统计模型、大数据挖掘算法、机器学习/AI模型等学科知识,对基础理论和常用算法有深刻理解和工程实践能力;3. 了解大模型基础架构,能够利用大模型+RAG/智能体实现一些业务智能化应用;4. 熟练应用SQL、Hive、Python等工具,具备扎实的算法和数据结构功底;5. 业务理解和责任心强,乐于并擅长内外部沟通、协调。 投递...

Premium Full-time
NIO  16 days ago
易宝支付 YeePay jobs

风控Java研发工程师 北京 全职 金融 职位描述 期待拥有开放心态、拥抱持续进化的你成为易宝的事业伙伴,共绘 “一群人的浪漫”。1、负责支付风控中台核心子系统的设计与开发,包括但不限于规则引擎、实时决策引擎、变量平台、名单管理系统、人工审核工作流等,支撑每秒万级的高并发实时风控请求。2、与风控策略团队紧密配合,将复杂的反欺诈、反洗钱、反盗刷业务逻辑转化为高效、可维护的技术实现,支持策略的快速上线与A/B测试。3、基于Flink/Spark等大数据技术建设实时特征计算平台,为风控模型与策略提供准实时的指标支持;参与数据清洗、标签体系建设。4、攻克支付场景下的业务技术难题,如防重放、幂等性设计、分布式事务,以及对突发流量(如大促场景) 的弹性伸缩与限流降级。 职位要求 1、本科及以上学历,计算机相关专业,3-5年Java开发经验,其中至少1年以上风控、金融、支付或安全领域研发经验;2、扎实的JAVA基础,熟悉JAVA核心原理,熟练掌握多线程开发,有JVM调优经验优先;3、熟悉分布式系统设计与开发,熟悉Spring等主流框架,熟悉Redis、ES、Sqoop、Kafka、Hive其中的一种或几种中间件4、理解支付/信贷业务中常见的风险类型(盗刷、套现、薅羊毛、商户二清等),了解基本的反欺诈规则(如设备指纹、IP画像、行为序列)。5、有对接三方风控产品经验(如Sift Science、Forter、同盾、邦盛)或自建规则引擎(Drools/EasyRule/Aviator)深度优化经验。 投递...

Premium Full-time
易宝支付 YeePay  16 days ago
易宝支付 YeePay jobs

数仓研发工程师 北京 全职 金融 职位描述 1、理解公司业务和数据,建设数据仓库,业务数据模型持续优化2、负责数据的采集清洗加工处理的脚本开发,为数据挖掘提供有效的数据资产。3、负责响应离线数据需求对数据资产进行数据统计、分析、提取处理4、参与业务分析、抓取等数据相关工作。满足业务方的数据需求,提供面向业务的OLAP、报表、数据提取等数据服务5、参与数据产品和标签体系建设:根据业务发展的不同阶段,围绕用户、商户、客户等,参与建设、优化业务数据指标和标签体系 职位要求 1、计算机相关专业优先,有3年以上大数据处理相关工作经验2、熟悉数仓常见分层架构,熟悉大数据集群的HIVE、HDFS、HBASE等常见组件的使用及性能调优3、强大的SQL能力,能编写常用的SHELL脚本、python脚本,熟练使用常见的azkaban等数仓ETL工具4、熟悉常见离线数仓处理流程、有实时数据处理者优先。5、有pySpark开发经验的优先 投递...

Premium Full-time
易宝支付 YeePay  16 days ago
Xiaomi jobs

高级算法工程师 北京 社招 全职 职位 ID:A229937 职位描述 1. 负责排线、道口均衡、配载均衡等模型的开发与优化工作,通过先进的算法设计,解决多供应商、多工厂入厂运输过程中的复杂问题,提高运输效率,降低运输成本。2. 针对场内排产、排程、VDC路径规划等场景,开发高效的算法模型,确保工厂内部物流运作的顺畅和高效,满足生产计划和调度的要求。3. 负责库存优化算法的开发与实施,通过数据分析和建模,优化库存水平,降低库存成本,同时确保供应链的稳定性和响应能力。4. 与供应链管理、物流运营、生产计划等部门紧密合作,深入了解业务需求,确保算法模型能够有效支持业务目标的实现。5. 跟踪国内外供应链物流领域的最新算法研究成果和技术动态,结合公司业务需求,探索新的算法应用方向和技术创新点。 职位要求 1. 计算机、数学、统计学或人工智能等相关专业硕士学历以上;博士优先。有工厂域排产排程经验者优先。2. 熟练掌握运筹学、数学建模、优化算法等基础知识,具备扎实的数学功底和逻辑思维能力。3. 精通Python、Java等编程语言,熟悉常用数据结构和算法。4. 熟悉机器学习、深度学习、运筹优化、统计学等算法,了解大模型相关理论,有大模型部署、微调经验,熟悉Qwen、ChatGPT、InternVL等大模型。5. 熟悉大模型(如 LLM)的微调技术(如 LoRA)和部署流程,具备 Prompt 调优的经验,能够根据业务需求设计和优化 Prompt,提升模型的性能和输出质量。6. 熟悉数据挖掘和大数据处理工具(如Hadoop、Hive、Spark),熟练使用算法框架(如TensorFlow、PyTorch)和优化工具(如Gurobi、Ortools)。7. 具备在复杂业务场景下独立开展算法项目的能力,能够从问题定义、数据收集与分析、模型构建与优化到实际部署的全流程进行有效推进。 投递...

Premium Full-time
Xiaomi  16 days ago
Xiaomi jobs

小米汽车-TSP基础平台开发工程师-智能网联 南京 社招 全职 职位 ID:A179282 职位描述 1. 负责智能网联TSP平台技术规划、技术选型;2. 负责智能网联TSP平台架构设计、开发;3. 负责智能网联TSP平台日常维护与优化工作,确保系统平台的稳定运行;4. 负责智能网联TSP平台业务监控,应急响应,运维工具化。 职位要求 1. 5年以上工作经验;2. 熟悉车联网TSP技术架构,具备车联网网关、数据转发路由、计算存储等开发经验;3. 熟悉Hadoop/Kafka/Spark/Hive/Flink/DataX的组件开发,掌握Spring,SpringBoot,SpringCloud框架,了解消息中间件;4. 熟练使用Git,Jenkins等版本管理与自动化部署工具;5. 熟悉云原生技术,熟悉Redis、Nginx、Docker等常用开源软件;6. 熟练掌握TCP、MQTT通讯开发技术,熟悉车联网808、1078、32960通信协议;7. 具备较强的学历能力、逻辑分析能力,问题排查能力;8. 做过车联网TSP平台。 投递...

Premium Full-time
Xiaomi  16 days ago
Xiaomi jobs

高级大数据研发工程师 北京 社招 全职 职位 ID:A94598 职位描述 1、负责小爱内容资源数据流及数据服务建设;2、负责小爱内容数据、搜索推荐服务架构优化;3、负责小爱用户画像、LLM通用知识库建设。 职位要求 1、熟悉大数据相关技术:Spark/Flink/Hadoop/HBase/Hive/Iceberg等;2、熟练使用Java、Scala、Python语言中的一种或者多种,熟悉java常见数据结构、多线程并发、JVM等;3、熟悉常用基础组件:Mq/Redis/Es等;具备数据库系统理论知识,熟悉Mysql/Tidb等,精通SQL;4、有过分布式、高并发业务系统搭建经验优先;5、熟悉大模型(LLM)技术,对向量数据库、RAG等有过深入调研优先;6、责任心强,具有较强的学习、沟通和问题解决能力。 投递...

Premium Full-time
Xiaomi  16 days ago
Xiaomi jobs

高级大数据开发工程师 北京 社招 全职 职位 ID:A140743 职位描述 1、负责国际BI、零售通、米网相关数据相关数据应用、数仓底层开发和维护;2、理解和拆解数据产品需求,完成数据分析、数据建模以及编码工作;3、跨团队与服务端、前端、测试等完成需求沟通和协作,完成项目; 职位要求 1、有数据仓库研发经验,熟悉数据仓库、数据体系建设及优化,理解数据的价值;2、熟悉理解常用建模理论,可独立把控数仓的各层设计;3、掌握数据管理治理的相关理论,熟悉数据治理、数据标准、企业数据建模、元数据管理等方法论;4、熟悉大数据架构,具备实时或离线数据研发能力,熟悉hive,kafka,spark,flink、hbase等相关技术并有相关开发经验5、本科及以上学历,8年以上工作经验,有AI工作优先 投递...

Premium Full-time
Xiaomi  16 days ago
Xiaomi jobs

大数据开发工程师 北京 社招 全职 职位 ID:A103073A 职位描述 1、负责小米集团核心业务的数仓开发和维护,确保数据准确、及时、好用2、深入理解产品需求,独立高效完成数据建模以及数仓开发工作3、跨团队与服务端、前端、测试等团队紧密协作,确保数据解决方案的顺利实施 职位要求 1、具备丰富的数据仓库研发经验,熟悉数据仓库、数据体系建设及优化,深刻理解数据的商业价值2、深入理解并掌握常用的数据建模理论,能够独立主导数仓各层级的设计与实施3、掌握数据管理的相关理论,熟悉数据治理、数据标准、企业数据建模、元数据管理等方法论4、精通大数据架构,具备实时和离线数据研发能力,精通Hive、Spark、Flink、Hbase、Kafka等大数据技术,能够高效解决大数据处理中的技术难题【具备以下能力者优先】1、具备汽车行业数据仓库建设经验者优先2、具备超大数据量处理能力者优先3、具备实时数仓建设经验者优先 投递...

Premium Full-time
Xiaomi  16 days ago
Xiaomi jobs

小米汽车-高级软件研发工程师(后端) 南京 社招 全职 职位 ID:A198124 职位描述 1. 负责核心模块和关键技术方案的设计、开发与维护,确保系统的高性能、高可用性和高安全性,并沉淀团队的技术知识库;2. 与产品、架构等团队紧密协作,深刻理解业务需求,提供具有前瞻性的技术解决方案,确保技术方案与业务目标的高度一致性;3. 深入业务,识别系统中的性能瓶颈、架构弱点和安全隐患,主导技术方案的制定与落地,保障系统的稳定性和可扩展性;4. 通过Code Review、技术分享、方案评审等方式,指导和培养团队中的初中级工程师,提升团队整体技术水平和工程质量;5. 跟踪行业内的技术动态,站在业务全局视角,参与制定团队中长期的技术规划和架构演进路线图,将前沿技术(如Al、Agent等)与业务场景结合,构建面向未来的技术体系。 职位要求 1. 计算机科学、软件工程等相关专业,5年以上后端开发经验;2. 扎实的 Java 编程知识,熟悉各种设计模式,熟料掌握JAVA生态技术栈,精通Spring\SpringBoot\SpringCloud\Mybatis框架以及常用的数据库;3. 有主导大型复杂业务系统或分布式系统架构设计的成功经验,能够独立完成从0到1的系统建设或主导核心模块的设计或重构;4. 熟悉分布式系统理论,对分布式事务、服务治理、负载均衡、弹性伸缩等有丰富的实践经验;熟悉微服务架构思想;5. 掌握以下大数据框架或组件,如Hadoop/Kafka/rocketmq/Spark/Hive/Flink/Redis/ElasticSearch的组件开发,了解消息中间件技术;6. 具备优秀的线上问题分析和解决能力,逻辑严谨,有始有终,自驱力强;7. 具备出色的沟通表达能力和团队协作精神,能够有效推动复杂项目落地,对团队有积极的技术影响力。 投递...

Premium Full-time Java
Xiaomi  16 days ago
玖龙纸业(控股)有限公司 jobs

大数据开发工程师 东莞 职能部门类 本科及以上 3-5 年 职位描述 (1)大数据开发1、负责大数据离线开发,使用Sqoop等组件开发每日离线数据采集任务,使用Hive/Spark SQL编写ETL作业过程,处理各种复杂的业务逻辑,根据业务逻辑配置合理的调度顺序;2、负责大数据实时开发,使用Flink/Spark实时计算引擎开发实时流作业,读取接口/文本/数据库日志/消息队列中间件等数据源,经过业务逻辑加工处理后写入大数据平台;3、保障数据产出时效稳定,每天监控数据产出时间,采取调度链路优化,作业优化,SQL优化等手段,提升数据产出效率。(2)集团数据资产建设1、根据各个业务领域项目推进过程中沉淀的数据分析体系,维护成可方便检索,查找和应用的数据资产,包含业务口径,出数频率,数据样例等关键业务和技术元数据;2、根据数据分析师提供的数据质量规则,开发相应的数据校验程序,确保跑数完成后即刻校验,确保高质量的数据资产;3、生成相应的数据服务接口,可供前端应用,BI工具和业务系统调用。(3)数据仓库模型设计1、根据业务领域数据特征以及维度建模的方法,横向划分数据仓库分析主题域,纵向划分层次,达成数据重复利用率高且能快速开发数据需求的目的;2、定义各个数仓分层,考虑数据写入和查询的性能,提升作业的运行速度,报表查询数据时的高复用性和易扩展性;3、通过合理的数据模型设计,提高数据的查询性能和分析效率,降低维护成本。(4)制定规范1、制定公司数据仓库架构设计原则,输出数据仓库模型设计的基本原则;2、制定公司数据开发的开发规范。 职位要求 (1)教育程度:本科毕业3年以上,计算机,信息工程,数学等相关专业毕业;(2)相关经验:具有3年以上大数据开发相关经验;(3)专业能力:1.具备数据仓库架构和设计能力,熟悉维度建模的方法;2.良好的沟通和逻辑思维能力,能够对业务需求进行抽象并据此进行架构设计;3.有过数据资产目录建设和维护的经验;4.熟悉大数据离线和实时开发使用的组件,Hive、Spark、Flink等,熟悉分布式计算和存储的相关原理及高可用机制原理,并可独立排查故障问题;5.熟练使用Dataworks,DolphiScheduler,kettle或其它数据开发工具中的一种;6.熟悉SQL的执行原理,具备优化复杂SQL的能力;7.掌握shell,python,java等编程语言中的一种;8.具有很好的沟通表达能力,勤奋好学,具有很好的团队合作意识。 职位信息 部门: 集团IT部 招聘数量: 1 投递...

Premium Full-time
玖龙纸业(控股)有限公司  15 days ago

Subscribe for job alerts and resources to make your job search easier!

Confirmation email sent to

Check your email and click on the link to start receiving your job alerts

Receive the latest job openings for:

hive

You also might be interested in:

开发工程师

Consultant

研发工程师

Data Engineer

实习生

AI

Big Data Technologies

Spark

Scala

Data Quality

Confirmation email sent to

Check your email and click on the link to start receiving your job alerts

All Filters Apply
Sort by
Company
Employer/Recruiter
Experience