AI运维工程师(大模型推理 / AI Infra) 深圳 全职 互联网 / 电子 / 网游 职位描述 岗位职责负责 AI 功能(语音助手、AI 问答、Agent、多模态等)的大模型推理服务部署、运维与稳定性保障。负责大模型推理框架部署与性能优化,包括 vLLM、TensorRT-LLM、SGLang 等。负责 GPU 集群与 AI Infra 建设,包括 Kubernetes、容器化、监控告警及自动化运维。参与模型量化、推理加速、显存优化、吞吐优化等工作,提升推理效率并降低成本。配合算法团队完成模型上线、压测、问题排查及线上稳定性优化。 职位要求 任职要求本科及以上学历,计算机相关专业。熟悉 Linux、Python/Shell,具备自动化运维能力。熟悉 Docker、Kubernetes 等云原生技术,有 GPU 集群运维经验。熟悉大模型推理部署,了解 vLLM、TensorRT-LLM、LMDeploy、TGI 等推理框架。理解 Transformer、大模型推理流程及 GPU 加速原理,有推理优化经验优先。有高并发 AI 服务、语音 AI、多模态或智能硬件相关经验优先。
AI Infra工程师-灵犀业务部 深圳 正式 职位描述 灵犀是智元半尺寸人形机器人的核心产品线,也是智元最年轻、最具创新活力的团队之一。我们打造了智元首个爆款产品灵犀X2,累计销量超6000台。这里技术大牛汇聚、工程师文化浓厚,你将深度参与从技术创新、产品定义到规模化落地的全过程,与顶尖团队共同定义下一代人形智能交互服务终端。1、负责感知导航团队 AI 基础设施建设,支撑大规模端到端模型的数据、训练与推理全链路高效运转。2、数据管线:构建机器人多模态数据(图像、点云、轨迹、语言指令等)的采集、清洗、标注、存储与管理平台,打造高效的数据闭环。3、训练基建:搭建并优化大规模分布式训练框架,支持多机多卡训练、混合精度、并行策略(DP / TP / PP / FSDP),提升训练吞吐与资源利用率。4、推理基建:负责模型在机端 / 边缘 / 云端的高性能部署,实现模型量化、剪枝、蒸馏、算子优化与推理引擎集成(TensorRT / ONNX / TVM 等)。5、建设实验管理、模型版本管理与 CI/CD 流程,提升算法团队整体研发效率。 职位要求 1、2027 届本科及以上学历,计算机科学与技术、软件工程、电子信息等相关专业。2、扎实的计算机系统、数据结构与算法基础,熟悉 Linux 开发环境与分布式系统原理。3、熟悉以下至少一个方向并有实际经验:(1)大规模数据处理(Spark / Ray / 数据湖 / 流式处理);(2)分布式训练(PyTorch DDP