AI全栈开发工程师(B端平台 & B端产品) 北京 全职 互联网 / 电子 / 网游 - 研发 职位描述 1. 构建与迭代B端Agent平台与产品能力:工作流编排(DAG / State Machine)、多智能体协作、会话与任务系统(异步/长任务)、记忆与上下文管理。2. 负责 Agent 工具体系工程化:工具注册/版本与兼容策略、参数 Schema(JSON Schema/Pydantic)、鉴权与租户隔离、幂等/重试/限流、失败降级、回放与审计。3. 落地企业级 RAG:多源数据接入(文档 / DB / ES / 内网系统)、切分与索引、混合检索(Milvus / PGVector + ES)、重排、引用溯源、增量更新、权限过滤(ACL /
大模型应用开发专家 北京 全职 互联网 / 电子 / 网游 - 研发 职位描述 1. 架构设计与开发:负责基于大模型(LLM)的复杂应用系统架构设计与核心代码实现,确保系统的高可用性、高并发性与可扩展性。2. 后端与AI工程化:精通Python/Java后端开发,构建高性能、高可用的AI服务接口;深度集成LangChain、LlamaIndex等AI框架,实现业务逻辑与大模型能力的无缝对接。3. AI技术落地:主导RAG(检索增强生成)系统的优化、Agent(智能体)任务编排及多轮对话逻辑的实现,提升AI在实际业务场景中的响应准确率与用户体验;主导GraphRAG(知识图谱增强检索)与向量检索的深度融合,负责复杂知识关联的建模与查询优化。4. 中间件与基础设施:负责向量数据库(如Milvus/Pinecone/Weaviate)、图数据库(如Neo4j/NebulaGraph)、缓存、消息队列等中间件的选型、集成与维护。5. 协同与工程化:与模型团队紧密配合,推动模型接口协议标准化,负责AI服务的CI/CD、监控告警及生产环境的稳定运行。 职位要求 1. 计算机、软件工程、电子信息等相关专业本科及以上学历,5年以上后端开发经验,其中至少2年专注于AI应用开发。2. 精通Python后端开发,具备扎实的编程能力、数据结构与算法功底,熟悉异步编程及性能优化;深入理解RAG与Agent开发,能熟练运用LangChain、LlamaIndex、LangGraph等框架解决复杂业务问题。3. 深入理解大模型生态,有实际的大模型应用落地项目经验,熟悉Function Calling、Tool Use等Agent核心技术。4. 熟悉常用后端技术栈,包括但不限于MySQL、Redis、Kafka、Docker/K8s等,具备构建高可用服务的工程能力。5. 知识图谱与检索增强:深入理解知识图谱在RAG场景下的落地路径,熟悉NebulaGraph、Neo4j等主流图数据库的使用及查询语言(如Cypher/nGQL)。6. 语义建模能力:掌握实体识别(NER)、关系抽取(RE)等知识构建技术,具备将非结构化数据转化为结构化知识库的实际项目经验。7. 掌握向量数据库的使用与原理,了解语义搜索、重排序(Rerank)等RAG关键技术。8. 具备优秀的工程化思维,能解决复杂系统中的稳定性、并发及安全问题。加分项1. 有高并发、大流量分布式系统开发经验者优先。2. 同时掌握Python和java生态,有大规模后端系统开发经验者优先。3. 熟悉模型部署工具(如vLLM, TGI, TensorRT-LLM)或有模型微调工程经验者优先。4. 在GitHub有知名AI相关开源项目贡献,或在技术社区有深度技术分享。5. 具备Prompt Engineering高级技巧,能够通过调优显著提升应用端效果。
算法实习生 北京 实习 互联网 / 电子 / 网游 职位描述 1、负责大模型算法的适配和调优;2、负责大模型的推理,训练相关的工程优化;3、负责大模型的推理,训练相关框架的国产芯片适配;4、根据行业场景需求设计微调工具等; 职位要求 1、计算机科学、人工智能、自然语言处理或相关专业领域;2、 熟悉常见的深度学习框架,如:Pytorch 等3、了解Megtron,Deepspeed等大模型通用框架;4、了解vLLM,TGI,Transforms等大模型通用框架;5、出色的问题解决能力,良好的owner意识,能够持续推动问题解决;6、良好的团队合作和沟通能力,能够与跨职能团队合作,推动项目进展;7、在预训练语言模型(如Llama,GPT等)的设计、训练和优化方面有实际项目经验者优先; 投递...
AI技术实习生-深圳 深圳 实习 互联网 / 电子 / 网游 职位描述 1. 参与大模型全流程技术工作,包括算法适配与调优、推理训练工程优化、国产芯片框架适配等,根据项目需求承担相应模块任务;2. 结合行业场景需求,参与大模型微调工具的设计与开发,协助业务团队完成模型定制化训练,支撑场景化应用落地;3. 跟踪大模型领域算法、工程、硬件适配等方向的前沿技术,参与技术调研与验证,为团队技术选型提供参考;4. 参与团队技术讨论与分享,协助整理项目技术文档,推动团队技术能力共同提升。 职位要求 1、计算机科学、人工智能、自然语言处理或相关专业领域;2、 熟悉常见的深度学习框架,如:Pytorch 等3、了解Megtron,Deepspeed等大模型通用框架;4、了解vLLM,TGI,Transforms等大模型通用框架;5、出色的问题解决能力,良好的owner意识,能够持续推动问题解决;6、良好的团队合作和沟通能力,能够与跨职能团队合作,推动项目进展;7、在预训练语言模型(如Llama,GPT等)的设计、训练和优化方面有实际项目经验者优先。 投递...
大模型算法框架实习生 北京 实习 互联网 / 电子 / 网游 职位描述 大模型算法适配与优化:参与主流大模型(如Llama、GPT等)在国产芯片上的算法适配和性能调优,包括模型结构优化、算子优化等;推理与训练工程优化:对大模型的推理和训练过程进行工程化优化,提升性能、降低资源消耗,包括但不限于模型量化、剪枝、蒸馏等技术的应用;国产芯片适配:大模型推理、训练框架(如Megatron、DeepSpeed等)在国产芯片上的适配与优化,解决兼容性问题,充分发挥硬件性能;微调工具链开发:根据不同行业场景需求,设计并实现高效的大模型微调工具链,包括数据预处理、参数配置、效果评估等功能模块;技术方案设计与评估:参与大模型相关技术方案的制定,进行技术可行性评估和性能测试,撰写技术文档。 职位要求 计算机科学、人工智能、自然语言处理或相关专业本科或硕士在读,每周到岗4-5天,实习3个月以上熟悉至少一种主流深度学习框架(PyTorch优先),熟悉深度学习模型开发全流程;熟悉大模型训练和推理框架,如Megatron、DeepSpeed、vLLM、TGI、Transformers等;具备良好的编程能力,熟练掌握Python/Go/Java/C++,有良好的代码风格和工程实践;出色的问题解决能力和技术攻关能力,具备owner意识,能够独立负责技术模块并推动问题解决;良好的团队合作和沟通能力,能够与跨职能团队高效协作,推动项目进展。【加分项】有国产芯片(如昇腾、寒武纪、海光等)上的模型适配和优化经验者优先;熟悉模型压缩、量化、蒸馏等相关技术并有实践经验者优先 投递...
AI院-GLM团队-大模型评测算法工程师(实习) 北京 实习 互联网 / 电子 / 网游 职位描述 1. 参与大语言模型代码能力的多维度评测工作;2. 跟踪和研究行业内最新的大语言模型技术和评测方法,将学界业界前沿、有价值的基准测试加入模型评估体系中;3. 设计和执行评测方案,收集和分析评测数据,提供有价值的反馈和建议; 职位要求 1. 本科及以上学历,计算机、软件工程、人工智能等相关专业;2. 对大语言模型和代码方向有浓厚的兴趣;3. 工作细心、耐心,有较强的责任心和团队合作精神;4. 有扎实的计算机科学基础,具有优秀的编程基础和执行力;5. 熟悉 vLLM/sglang/TGI 等模型推理框架和 docker 等容器化部署方案; 投递...
大模型算法工程师(上下文工程)-2027届 AI 重庆、北京、成都、杭州、深圳、上海 正式 互联网 / 电子 / 网游 职位描述 1、负责动态上下文优化、长上下文窗口扩展(1M+ tokens),优化RoPE/ALiBi位置编码外推及注意力稀疏化算法。2、研发上下文压缩与记忆池化技术,提升Agent多轮交互中的信息利用率。3、构建上下文评估基准,解决长文本“迷失在中间”问题。4、上下文证据增强大模型推理,缓解大模型幻觉问题。5、配合推理引擎团队优化KV Cache管理与显存调度。 职位要求 1、2027届硕博,计算机/AI/数学等相关专业,顶会论文(NeurIPS/ICML/ICLR/ACL等)一作优先。2、精通Transformer底层原理(Attention、位置编码、Layer Norm),能手推复杂度。3、Python/PyTorch熟练,熟悉vLLM/TGI等推理框架,了解KV Cache量化与Page Attention。4、有长上下文、稀疏注意力或Agent相关项目经验者加分。5、有开源贡献或CUDA/Triton编程经验者加分。 投递...
具身大模型部署与优化实习生 深圳 实习 互联网 / 电子 / 网游 职位描述 负责将大语言模型、多模态模型和具身智能模型高效部署到机器人端侧芯片和云端,实现低延迟实时推理。1、负责VLA(操作模型)等大模型在自研芯片上的端侧部署,完成模型量化(INT8/INT4/FP8)、图优化和推理加速;2、设计和优化模型推理服务(基于 vLLM/TensorRT-LLM),支撑 VLA 推理的低延迟需求;3、建立模型部署的标准化流程:模型转换→量化→性能基准测试→端侧验证→上线发布;4、模型优化,参与大模型的量化部署工作,探索模型在嵌入式端侧的高效运行;5、与算法团队协作,从模型设计阶段介入,提供部署可行性评估和性能预估。6、实验验证: 协助将算法部署至真实人形机器人平台,进行效果调试与性能评估。 职位要求 1、计算机、人工智能、自动化、机器人等相关专业在读硕士、博士、优秀本科生;2、 具备扎实的深度学习基础,熟悉 Transformer 架构,对 VLA 等主流模型有深入理解;3、熟悉 C++/Python,具备良好的代码风格和算法实现能力;4、有以下至少一项经验:-模型量化(PTQ/QAT/混合精度)与精度-速度 trade-off 调优;-CUDA 编程与 GPU kernel 优化;-嵌入式 NPU 部署(高通/联发科/NVIDIA Orin);-熟悉至少一种推理框架:TensorRT / ONNX Runtime / vLLM
AI Agent算法工程师 上海 校招 正式 算法类 2027届校园招聘计划 职位描述 岗位职责负责 AI Agent 智能体系统研发,包括数据构建、模型训练(Pretrain/SFT/Post-training)、Agent 能力优化及业务场景落地;基于 LangGraph、LangChain、AutoGen 等框架,构建具备规划、推理、工具调用、记忆及多 Agent 协作能力的智能体系统;基于 MCP(Model Context Protocol)构建工具生态,开发和接入各类 Tools/Skills,打通代码、知识库、办公、研发等业务系统,提升 Agent 能力边界; 负责 Agent 推理策略(ReAct、Plan-Act、Tree-of-Thought 等)、RAG 检索增强及复杂任务执行能力优化,持续提升 Agent 的效果、效率和稳定性。 职位要求 岗位要求硕士及以上学历,计算机、人工智能等相关专业,有 AI Agent或大模型相关项目或实习经验;熟悉主流 Agents 框架与范式,具有
【27届校招】语音大模型算法工程师(北京/上海) 北京、上海 正式 研发 - 算法 职位描述 1、参与大模型相关核心算法的研发、迭代优化与业务落地,涵盖模型预训练、微调、Prompt / 对齐优化、RAG 检索增强、多模态融合等关键能力的工程化与落地应用;2、跟进大模型、强化学习、多模态等领域的前沿技术(顶会论文 / 开源项目 / 行业主流方案), 通过实验对比与方案迭代,解决模型泛化性、推理精度、场景适配等核心问题;3、参与数据闭环工作:数据集构建、清洗、标注、质量管控与持续迭代,完成模型训练、评测、复盘全流程,输出规范的实验文档与技术报告;4、协同团队完成算法测试、业务实验与项目推进, 保障大模型相关项目高效落地与持续迭代。业务方向: 大模型算法 / 语音多模态算法 / Agent 与记忆系统 职位要求 1、硕士及以上学历,计算机科学、人工智能、数学、电子工程、自动化、语音语言学等相关专业;2、基础能力:-扎实的机器学习 / 深度学习理论基础 (Transformer、Attention、Loss 设计、训练范式)-熟练使用 PyTorch 等主流深度学习框架,有实际模型训练 / 调优经验-熟练 Python, 具备扎实的工程实现能力-良好的数学基础(概率论、线性代数、最优化)3、学习能力: 能快速阅读英文顶会论文