At NVIDIA, we’re solving the world’s most ambitious problems with our groundbreaking developments in Artificial Intelligence, High-Performance Computing and Visualization. We are looking for a Developer Relations Manager to work with China industrial/research community to integrate
SummaryAt Apple, we dont just build products; we create magical experiences that reshape entire industries. Our innovation is fueled by the diverse and brilliant minds that come together to dream bigger, think differently, and push the
Job Description Have clear and solid relationships with software development departments. Plan and document work and projects. Build and continuously optimize CI/CD process and streamline automation effort for server provisioning and applications deployment. Build a resilient
共创-运维开发工程师-觅蜂子公司 上海、北京 校招 正式 技术族 - 解决方案类 职位 ID:A96385B 职位描述 觅蜂科技(Maniformer)是全球领先的一站式物理AI数据服务平台,致力于打造具身智能数据的 “平台型供给” 基础设施,实现数据的体系化、标准化、规模化供给。1. 部署与交付- 在私有化 / 混合云 / 边缘集群等场景完成 Genie Studio 平台的安装、部署与基础配置(云主机/物理机/K8s 集群)。- 根据项目方案协助环境勘察与规划:服务器配置、网络拓扑、域名与证书、存储与备份策略等。独立处理交付中的常见问题(安装失败、服务启动异常、网络不通、权限配置等),对复杂/陌生问题能清晰描述现象并完成初步排障,必要时与二线/研发协同远程解决。- 能独立部署高可用 Kubernetes 集群,理解业务流量走向并完成常见资源(Pod/Service/Deployment/StatefulSet/PVC/Ingress 等)的排障。2. 客户对接与日常支持- 作为一线窗口承接客户咨询与问题反馈,理解客户诉求并给出初步解决方案或使用建议。- 将功能缺陷、体验问题与客户需求沉淀为问题单/需求单,完成问题分拣并跟进至闭环。- 配合产品与平台团队,参与并持续优化智能客服/自助知识库(FAQ、操作指南、排障流程),提升客户自助解决率、降低一线重复工作量。- 规范使用与维护飞书/企业微信/工单系统等沟通与支持渠道。3. 文档与规范- 编写/完善安装部署文档、标准作业手册(SOP)、常见问题与解决方案等交付文档。- 参与项目全流程并推动标准化:需求澄清
Join our Team About this opportunity We are looking for a Korean speaking senior Software Solution Lead to join Ericsson’s Software & Cloud Solution organization, supporting the MNEA market with focus on South Korea from a
公司描述 Do you want beneficial technologies being shaped by your ideas? Whether in the areas of mobility solutions, consumer goods, industrial technology or energy and building technology - with us, you will have the chance to
SummaryImagine what you could do here. At Apple, great ideas have a way of becoming great products, services, and customer experiences very quickly. Bring passion and dedication to your job and theres no telling what you
高级基础架构工程师(存储&备份) 热招 深圳 全职 研发 热招职位 职位描述 1. 存储系统规划与运维: - 负责公司全球数据中心及分支机构的存储架构规划与实施,管理包括SAN(FC/iSCSI)、NAS(NFS/CIFS/SMB)及对象存储在内的多类型存储资源。 - 负责主流存储设备的日常配置、扩容、固件升级及健康监控。 - 针对高科技制造场景(如海量设计图纸、测试数据、各类日志),制定分级存储策略(冷热数据分离),平衡性能与成本。2. 备份系统与数据保护: - 主导企业级备份系统的建设与运营,确保核心业务系统(内网服务器资源池、数据库、文件服务器)的备份成功率达到100%。 - 制定并执行严格的数据备份策略(RPO/RTO指标管理),实施异地备份和防勒索病毒的不可变备份(Immutable Backup)机制。 - 定期组织数据恢复演练,验证备份数据的完整性与可用性,确保在紧急状况下能快速恢复业务。 3. 混合云存储管理: - 管理公有云(AWS/阿里云)上的存储资源(如S3、EBS、OSS),优化云上存储成本,设计并维护本地IDC到云端的数据归档与灾备链路。4. 性能调优与故障排查: - 通过性能监控工具分析IOPS、延迟、吞吐量等指标,解决存储层面的性能瓶颈。 - 作为二线/三线专家,处理存储相关的复杂故障,对接原厂技术支持进行根因分析并彻底解决。5. 容灾体系建设: - 参与公司业务连续性计划(BCP)的制定,主导存储层面的容灾(DR)方案设计(如存储双活、异步复制)并定期进行切换演练。 职位要求 1.
Du utgjør hele forskjellen! Vi som jobber i Coor er lidenskapelig opptatt av å yte god service, brenner for å gi våre gjester gode matopplevelser og skape en hyggelig arbeidsdag for alle med mat og drikke
Job Description: 工作职责 1. Doris 集群全生命周期管理 - 负责 Apache Doris 集群的部署架构设计、高可用配置(3FE/3BE+)、日常运维与监控体系建设 - 主导大版本升级(如 2.1→3.0 存算分离)、灰度发布、回滚预案设计与演练 - 7×24 小时稳定性保障,快速响应并解决 FE/BE 故障、Tablet 异常、Compaction 积压、OOM 等问题 - 建立完善的巡检、告警(Prometheus/Grafana)、故障复盘与 SOP 沉淀机制 2. 性能调优与治理 - 基于业务场景进行 Doris 表模型选型(Duplicate/Unique Key/Aggregate)、分区策略、分桶设计与 Sort Key
AIGC图像数据工程师 Beijing Full-time R&D - Data mining Responsibilities - 负责图像与多模态数据全生命周期建设:围绕业务目标与模型训练需求,搭建数据获取 → 清洗 → 标注/弱标注 → 评估 → 版本管理 → 回流迭代的闭环流程。- 参与端到端多模态统一模型的数据体系:图文交错序列、多轮长轨迹、理解 + 生成联合数据、跨帧一致性(角色/场景/光线/风格/世界观)数据的构造、清洗、标注与配比。- 数据采集与合规治理:推进数据来源梳理、授权/版权风险排查、敏感内容过滤与安全策略落地,建立可审计的数据资产规范。- 清洗与质量提升:实现去重(近重复/语义重复)、质量筛选(清晰度/噪声/美学/主体完整性等)、异常检测(NSFW/水印/低质/违规)与长尾数据治理。- 数据标注体系建设:设计并迭代标注 schema(caption、tag、属性、风格、构图、人物/商品信息、图文交错结构、多轮对话轨迹等),制定标注指南与质检规则,推动标注一致性与效率提升。- 难例挖掘与数据配比:围绕线上问题(如一致性、可控性、编辑失败、风格偏移、长程一致衰减等)挖掘难例与负例,构建训练集/验证集配比策略与覆盖度分析。- 数据工程化与平台化:参与数据管线工程建设(ETL/调度/缓存/存储/索引),支持大规模数据处理与高吞吐读取,提升训练数据供给效率与稳定性。- 数据评估与可观测性:建立数据质量指标与报表(分布漂移、覆盖率、噪声率、标注一致性等),支持「数据 → 训练 → 评测」的问题定位。- 跨团队协作:与算法/训练工程/产品/运营协作,将业务问题沉淀为可复用的数据策略、工具链与最佳实践文档。 Qualifications
人形专项-后端开发工程师 深圳 社招 全职 互联网 / 电子 / 网游 职位描述 1. 数采器通信服务:设计并实现手机/PC客户端与数采器在局域网内的数据交互协议,支持设备发现、连接管理和数据拉取。 2. 数据上传服务:构建高可用的文件上传服务,支持大体积 tar 包从客户端经公网稳定上传至阿里云 OSS,包含断点续传、分片上传和完整性校验。 3. 数据管理平台:负责采集数据(tar 包)的存储管理、元数据索引、检索和下载服务,设计合理的数据库表结构。 4. API 服务开发:为前端(手机 APP / PC 客户端)提供 RESTful API,包括设备管理、数据列表、上传状态查询等功能。 5. 服务部署运维:负责后端服务在阿里云上的部署、监控和日常维护。 职位要求 - 学历:本科及以上学历,计算机相关专业 - 经验:3~5 年后端开发经验
高级存储工程师 惠州 全职 职位描述 1. 全栈存储运维管理对象存储、块存储、分布式存储、云存储(AWS S3/阿里云OSS)及高性能存储(Lustre/GPFS),涵盖部署、监控、调优与故障处理针对传统业务与HPC场景(CAE仿真/AI训练)优化存储架构,提升IO效率与资源利用率2. 性能与可靠性保障建立跨平台监控体系,分析IOPS/延迟/吞吐量等指标,实施QoS策略与负载均衡设计PB级数据容灾方案,包括备份恢复、多活架构及超算存储容灾标准3. 技术演进规划推动混合云/多云存储落地,探索超算与云存储融合架构(如热数据分级迁移)研究存储新技术(软件定义存储/STaaS/NVMe-oF)并推动试点 职位要求 1. 5年以上存储运维经验,含2年超算/HPC存储管理(Lustre/GPFS/BeeGFS)2. 精通以下至少两个领域:云存储集成(Terraform/AWS EBS)、HPC优化(MPI-IO调优/RDMA网络/元数据扩展)、容灾方案(Veeam/异地多活)3. 熟练使用Python/Shell实现运维自动化优先条件:1. 有PB级存储集群管理经验,熟悉超算硬件(DDN/HPE Apollo)2. 持云平台存储认证(AWS/Azure)或HPC认证(Intel HPC Academy)3. 熟悉容器存储(Kubernetes CSI)及AI训练数据管道 投递...
At NVIDIA, we’re solving the world’s most ambitious problems with our groundbreaking developments in Artificial Intelligence, High-Performance Computing and Visualization. We are looking for a Developer Relations Manager to work with China industrial/research community to integrate
We are looking for a Software Test development engineer in NVIDIA’s AI SWQA team. The position is in NVIDIA AI Software Quality Assurance team that defines, develops and performs tests to validate robustness and measure the
Nvidia is looking for an outstanding passionate and talented Senior SW & System Architect to join our SW Architecture group. The position includes researching new technologies with focus on architecture definition of groundbreaking technologies in different
【27届校招】云原生AI平台研发工程师-杭州 杭州 正式 技术类 2027届秋季校园招聘项目 职位描述 1、负责云原生AI平台的研发工作,包括 模型训练和推理服务工作流的设计开发,模型训练引擎和推理引擎的建设;2、负责大语言模型(LLM)、CV/搜广推/社区/客服等相关的通用CNN、RNN、NLP、多模态等模型的训练和推理效率提升, 解决规模增长带来的技术和业务问题;3、参与AI基础设施资源管理,包括GPU/NPU/CPU、存储、网络等算力资源的调度能力建设,OSS/NAS/RBD等存储资源的管理等,持续提升资源利用率,为业务提供一个满足企业级稳定性和性能要求的AI平台;4、编写相关业务、技术文档等。 职位要求 1、2027届毕业生,本科及以上学历,计算机类、软件类、通信类等相关专业优先;2、具备扎实的计算机操作系统、网络、数据结构基础;熟悉Golang,Python等编程语言的一种或多种,编码风格良好;3、熟悉PyTorch、Tensorflow等基础框架,具备AI模型训练和推理相关的基础知识,有相关项目开发经验者优先;4、具备容器、Kubernetes、Kubeflow、Argo Workflow等基础知识,有相关项目开发经验者优先;5、CET4及以上,能够看懂技术相关的英文文档。加分项:1、有Llama系列、Qwen系列、DeepSeek系列以及其它开源/闭源大模型相关落地项目经验者优先;有StableDiffusion相关项目经验者优先;2、熟悉Linux内核,有相关经验者优先。 投递...
【27届校招】计算平台软件工程师 上海、广州 正式 研发 - 算法 职位描述 1、参与自动驾驶海量数据的采集、管理、处理与高效调度,设计与开发自动驾驶全链路数据平台,包括但不限于数据湖、数据仓库、分布式存储、流批一体计算与智能数据标注、数据治理等;2、研发大规模分布式计算与训练平台,基于Spark、Flink、Ray、PyTorch等技术实现自动驾驶大模型的数据清洗、预处理、并行训练与推理,支持多GPU/多集群高性能任务编排与资源调度;3、优化存储与检索架构,探索和实现包括OSS、CPFS、Iceberg、Delta Lake、Hudi、StarRocks、ClickHouse、ElasticSearch、Milvus等新一代高性能存储与检索方案,提升数据读写、索引、管理效率,赋能AI训练和推理;4、参与团队架构设计与技术攻关,跟进学术前沿与业界动态,解决自动驾驶场景下数据一致性、扩展性、高可用、智能调度等核心难题;5、推进工程实践落地与持续优化,深度参与端到端系统开发、自动化测试、上线发布与持续运维,推动数据与AI平台的稳定迭代和性能进化。 职位要求 1、教育背景:计算机、软件工程、人工智能、数据科学等相关专业,本科及以上学历,硕博优先;2、理论基础扎实: 精通分布式系统原理、并行计算、存储系统、数据库原理、数据湖/数据仓库理论、大规模机器学习等学科知识,有相关顶会/顶刊论文经历者优先;3、技术能力突出:(1)熟练掌握至少一种主流分布式计算框架(如Spark、Flink、Ray等)和一种深度学习框架(如PyTorch、TensorFlow等);(2)具备大数据存储与处理系统(如OSS、CPFS、Iceberg、Delta Lake、Hudi、StarRocks、ClickHouse、ElasticSearch、Milvus等)实操经验;(3)具备高性能数据检索、索引优化、海量数据管理等工程经验;4、编程与工程能力强(1)熟练掌握Python/Java/Scala/C++/Rust等主流开发语言中的至少一种,具备良好的工程实践和代码规范;(2)有高并发、大规模分布式系统、流式/批式混合计算平台相关项目经验者优先;5、创新与解决问题能力:具备独立分析复杂系统、定位瓶颈、提出创新性解决方案的能力,对技术钻研有热情,善于跨界学习;6、沟通协作与主动学习:良好的团队协作能力、沟通表达能力及自驱力,乐于分享、敢于挑战难题;7、加分项:(1) 在数据库、分布式系统、云原生计算、向量数据库、机器学习系统等领域有顶会(SIGMOD、VLDB、ICDE、NeurIPS、ICML等)论文、竞赛获奖或开源项目贡献;(2)有阿里云、腾讯云、AWS、GCP等云平台大数据相关实习、项目或竞赛经历;(3) 具备自动驾驶、机器人、智能感知领域大规模数据处理或AI应用落地经验;(4)英语或技术写作能力优秀,有技术博客、专利、文档经验。 投递...
Onsite Support Engineer - Backfill Hong Kong • 1–3+ years of IT support experience • Windows 10/11 & Office 365 support • Hardware/software troubleshooting • Ticketing system experience (ServiceNow/Jira) • User support & customer service skills