SummaryApple is a place where extraordinary people gather to do their best work. Together we build products and experiences people once couldn’t have envisioned — and now can’t imagine living without. If you’re excited by the
SummaryDo you want to help build some of the largest and most consequential enterprise and customer technology systems in the world? Join Apple’s Information Systems and Technology (IS&T) organization.IS&T is the engine behind everything Apple does
大模型算法-应用方向 北京 社招 全职 技术 - 算法 职位 ID:A205248 职位描述 Agent算法工程师,方向涵盖但不限于:大模型应用、自主智智能体、多智能体协同等。岗位职责:1. 参与对话式AI产品的全流程研发,探索大模型在办公、教育、金融等垂直领域的创新应用,并推动技术落地;2. 构建和优化端到端智能体系统,覆盖Agent loop搭建、Harness调优、Skill演化、Memory构建等方面,持续提升交互体验; 3. 针对具体业务场景,构建体系化数据集,并结合线上数据反馈,不断优化Agent系统的整体效果。 职位要求 1. 计算机、人工智能或相关专业硕士及以上学历,具备1年以上相关工作经验; 2. 编程基础扎实,熟悉至少一种主流语言(Java/Python/C++等);具备Claud Code、Codex开发工具的实际使用经验;3. 理解并掌握Agent工作机制、检索算法(如倒排索引、语义检索)、Prompt工程、微调与对齐、多智能体协作技术等核心能力;4. 在ACL、ICLR、NeurIPS等顶级学术会议或期刊上发表过相关论文者优先;5. 有大型大模型相关项目的参与经验,具备项目落地与迭代优化能力者优先; 投递...
AI全栈开发工程师(B端平台 & B端产品) 北京 全职 互联网 / 电子 / 网游 - 研发 职位描述 1. 构建与迭代B端Agent平台与产品能力:工作流编排(DAG / State Machine)、多智能体协作、会话与任务系统(异步/长任务)、记忆与上下文管理。2. 负责 Agent 工具体系工程化:工具注册/版本与兼容策略、参数 Schema(JSON Schema/Pydantic)、鉴权与租户隔离、幂等/重试/限流、失败降级、回放与审计。3. 落地企业级 RAG:多源数据接入(文档 / DB / ES / 内网系统)、切分与索引、混合检索(Milvus / PGVector + ES)、重排、引用溯源、增量更新、权限过滤(ACL / RBAC
AI全栈开发工程师 北京 全职 互联网 / 电子 / 网游 - 研发 职位描述 1. 构建与迭代B端Agent平台与产品能力:工作流编排(DAG / State Machine)、多智能体协作、会话与任务系统(异步/长任务)、记忆与上下文管理。2. 负责 Agent 工具体系工程化:工具注册/版本与兼容策略、参数 Schema(JSON Schema/Pydantic)、鉴权与租户隔离、幂等/重试/限流、失败降级、回放与审计。3. 落地企业级 RAG:多源数据接入(文档 / DB / ES / 内网系统)、切分与索引、混合检索(Milvus / PGVector + ES)、重排、引用溯源、增量更新、权限过滤(ACL / RBAC / ABAC)。4.
3D立体视觉算法工程师- Genie业务部 北京、上海 校招 正式 技术族 - 算法类 职位 ID:A20949 职位描述 1. 负责单目/双目深度估计算法的研发与优化,包括自监督/有监督,重点提升弱纹理、遮挡、反光等困难场景下的鲁棒性2. 负责MVS算法的研发,构建从稀疏重建到稠密点云生成的完整pipeline,优化深度图融合与点云后处理3. 负责三维前馈网络实现稠密点云/深度图的高精度重建,并包括6D位姿估计、类别级物体理解、开基语义等任务的能力升级4. 负责负责6D位姿估计算法的研发,覆盖Instance-level、category-level等位姿估计方法5. 参与立体视觉系统架构设计,实现和下游任务的联合优化,负责算法的工程落地,包括模型训练、部署、性能评估与持续迭代 职位要求 1. 计算机、 Robotics、自动化、电子工程等相关专业;2. 精通C++/Python,掌握OpenCV/CUDA及深度学习框架(PyTorch/TensorRT),扎实的多视图几何基础(对极几何、相机模型、Bundle Adjustment);3. 有深度估计、6D位姿估计,Nerf,3DGS相关经验者优先4. 面对未知领域的问题,有很强的自学能力。5. 在CVPR/ICCV/ECCV/NeurPS/ICLR/ACL/EMNLP等学术顶会有相关论文发表,或在相关国际竞赛中取得优异成绩者优先。 投递...
网络工程师 深圳 职位描述 1、负责公司云平台网络系统体系建设和维护;2、负责公司官网前台页面内容的更新、调整、开发等工作;3、负责网络设备的管理、调试、配置、维护等;4、负责网络系统的定期巡检、备份、以及应急响应工作,确保公司网络系统的定期巡检、备份、以及应急响应工作,确保公司网络系统的安全性、可靠性及可用的;5、负责网络故障排错,维护公司链路的稳定; 对公司网络提出优化方案,提高网络运行效率;6、协助完成日常维护公司pc,服务器,IT相关硬件等设备的维护;7、负责弱电实施,项目管理。 职位要求 1、精通网络架构,防火墙,VPN及无线技术、安全防护等主流IT产品(网络设备深信服+H3C);2、精通TCP/IP、OSPF、静态路由、ACL、NAT、VLANIF等等,能独立完成设备调试及复杂情况下的故障排错;3、熟悉网络安全设备,能自行维护各类防火墙、网络准入系统等;4、具有HCIP、CCNP等以上相关认证者及系统网络集成经验优先考虑;5、积极主动, 有很强的责任心;主动沟通,具有良好的团队意识,善于学习新知识。 投递...
网络工程师 上海 实习 智能制造 / 工业互联网 / 工业自动化 职位描述 1.协助办公网络及云网络的日常运维,保障网络稳定运行。2.协助交换机、路由器、防火墙、无线 AP 等网络设备的部署、配置、调试及故障排查。3.参与办公区网络建设,包括设备上架、网络开通、网络割接及验收等工作。4.协助网络监控、巡检、故障分析及性能优化,提升网络稳定性和可靠性。5.协助维护网络拓扑、IP 地址规划、设备配置及运维文档。6.参与企业网络建设、网络优化及自动化运维等相关项目。7.完成导师安排的其他网络相关工作。 职位要求 1.本科及以上学历,计算机科学、网络工程、通信工程等相关专业在读。2.每周可实习 5 天,实习周期 6 个月及以上。3.熟悉 TCP/IP、VLAN、STP、OSPF、ACL、DHCP、DNS 等网络基础知识。4.了解交换机、路由器、防火墙等网络设备的基本原理及配置。5.熟悉 Windows、Linux 基本操作,具备一定的网络故障分析与排查能力。6.责任心强,学习能力强,具备良好的沟通能力和团队协作能力。7.持有 HCIP、HCIE、CCNP、CCIE 等网络相关认证者优先。8.有网络项目实践、实验室项目或企业实习经验者优先岗位福利:1.深度参与企业级网络建设及运维项目,积累真实项目经验。2.接触园区网络、数据中心网络、云网络等企业级网络架构。3.导师一对一带教,快速提升网络规划、实施及故障排查能力。4.学习企业级网络设备及云网络相关技术,提升综合技术能力。5.表现优秀者可提供转正机会,优先录用为网络工程师。 投递...
大模型预训练研究员 北京、上海 校招 正式 职位 ID:A39294 职位描述 1、聚焦机器人具身操纵场景,负责VLA相关算法的设计与研发;2、深入研究VLM,VLA预训练前沿技术,提升算法的准确性与效率;3、在模型训练范式、模型结构、数据配比探索最佳实践方案,取得业务效果大幅提升的同时实现前沿技术突破;4、持续跟踪VLM,VLA领域的最新技术动态,并将其应用于实际业务场景中,推动技术落地。 职位要求 1、研究生及以上学历,计算机、AI、Robotics等相关专业优先;2、优秀的问题分析与解决能力,能够深入解决大模型训练及应用中的复杂问题;3、具备数据构建、指令微调及模型开发经验;4、熟悉大模型相关技术,对大模型预训练、指令微调、RL等方向有深入研究和实践。加分项:1、有Pretrain研究或应用经验者优先,熟悉具身领域预训练方法者优先;2、以第一作者在ICML、ICLR、NeurIPS、ACL、RSS、ICRA等顶级学术会议发表过高影响力研究成果者优先;3、在ACM/ICPC、NOI/IOI、Kaggle等编程或AI竞赛中获奖者优先;4、主导或参与过具有广泛影响力的具身开源或闭源项目者优先。 投递...
大模型音频算法工程师 上海 校招 正式 技术族 - 算法类 职位 ID:A216161 职位描述 参与大模型音频算法(ASR/AudioLLM/TTS等)的研究与落地,负责模型的SFT有监督微调训练、优化及部署;针对语音合成、语音识别、语音理解等场景,设计高效的微调策略,提升模型在垂直领域的性能与鲁棒性;负责音频数据预处理、质量分析及训练数据集构建,持续优化数据管线;跟进AudioLLM、FlowMatching、Diffusion TTS等前沿技术,推动技术在业务场景的工程化落地;撰写技术文档,沉淀模型训练方法论与最佳实践。 职位要求 硕士及以上学历,计算机科学、人工智能、信号处理等相关专业;扎实的深度学习基础,熟悉Transformer、LLM架构及训练流程,有语音相关项目经验者优先;熟练使用PyTorch、DeepSpeed、Transformers等深度学习框架及工具,具备大模型SFT/RLHF实操经验;熟悉至少一个音频任务:ASR(语音识别)、TTS(语音合成)、Voice Conversion、Audio Codec等;具备优秀的编程能力(Python/C++),良好的逻辑思维与沟通能力,能够快速复现前沿论文。加分项在Interspeech、ICASSP、NeurIPS、ACL等顶会发表过语音/音频相关论文;熟悉主流开源AudioLLM项目(如Qwen-Audio、Gemini Audio、CosyVoice、FishSpeech等);具备多机多卡大模型训练经验,熟悉Megatron-LM、FSDP等分布式训练框架;有Kaldi、WeNet、ESPnet等传统语音工具链使用经验。 投递...
大模型评测算法 北京 社招 全职 技术 - 算法 职位 ID:A00198 职位描述 本职位将及时跟踪AIGC技术前沿,承担高性能基础模型与创新应用的效果评估工作,驱动模型迭代与优化,直接影响前沿技术落地效果与用户体验:1、研究并跟踪国内外最新的大模型技术进展,搭建和维护科学、高效、可扩展的模型评测体系;2、深入参与团队内部模型训练的性能分析与评估,尤其聚焦在基础模型、多模态(图像、语音、Agent)和前沿技术(如强化学习对齐、Prompt工程)等方向的能力定量分析;3、分析评测结果,挖掘模型潜在瓶颈并提出改进建议,持续提升模型的质量与用户体验;4、参与制定模型评测的中长期规划,推动评测工具与流程自动化和标准化,构建业界领先的评测体系。 职位要求 1、计算机、人工智能相关专业本科及以上学历;2、具备2年以上机器学习、数据挖掘或算法评测相关工作经验,熟悉当前前沿模型的评测方法和指标体系,能力优秀的同学可适当降低年限要求;3、具备深厚的机器学习、自然语言处理、多媒体理解、语音合成、数据挖掘理论功底,能够深入理解并独立设计评测方案;4、熟练掌握Python/Java/C++中至少一种编程语言,熟悉常见深度学习框架(如PyTorch、TensorFlow)以及常见的评测框架(如OpenCompass/VLMEvalKit/EvalScope等等);5、具备优秀的分析问题与解决问题的能力,对前沿技术具备敏锐的洞察力。加分项:1、有大模型训练、模型应用落地和性能优化相关经历;2、有大规模模型评测框架搭建或优化经验,或者熟悉业界主流评测工具与方法者;3、在NeurIPS、ICML、ACL、SIGKDD、CVPR等国际顶级会议上发表论文,或有相关竞赛获奖经历者。 投递...
AI院-GLM团队-预训练算法工程师 北京 全职 研发 - 算法 职位描述 职位描述1. 参与数学或代码大模型预训练的研发工作,包括模型的预训练、对齐和评测等2. 负责构建和优化数学或代码的预训练和对齐数据,提升模型在数学或代码任务上的效果3. 探索针对数学或代码任务的数据合成方法,提升模型在数学或代码任务上的泛化能力 职位要求 职位要求1. 自然语言处理、机器学习等相关专业,硕士及以上学历;2. 较强的算法开发能力,熟悉常用的机器学习、深度学习算法;3. 熟练使用Pytorch、Huggingface、DeepSpeed等框架;4. 对Transformer的架构有较为深入的理解,了解Transformer的各种变体,有相关的研究经验者优先;加分项:1. 在ACL,NeurIPS,ICLR,EMNLP等顶级会议或期刊上发表过论文者优先;2. 熟悉并行训练框架,有多机多卡训练经验者优先;3. 熟悉CUDA编程/Triton编程,有相关算子加速经验者优先; 投递...
智谱*清华联合培养博士后-AIforscience方向 北京 全职 互联网 / 电子 / 网游 职位描述 岗位职责:1. 从事大语言模型(LLM)与智能体(AI Agent)的前沿研究,重点探索自主学习、复杂推理、自我进化等方向的新理论、新方法。2. 参与构建下一代大规模预训练模型,优化其在多任务、多模态场景下的推理效率与泛化能力。3. 推动LLM与垂直领域(如生物医药、知识图谱、学术数据挖掘)的深度融合,解决实际应用中的关键技术难题。4. 在NeurIPS、ICML、ICLR、ACL等顶级会议/期刊上发表高质量论文,提升团队学术影响力。 职位要求 任职要求:1. 计算机科学、人工智能、计算生物学等相关专业博士毕业(或即将毕业),年龄一般不超过35周岁。2. 在大语言模型、AI Agent、知识图谱、图神经网络等方向有深入研究,并以第一作者身份在CCF-A类会议/期刊(如NeurIPS、ICML、ICLR、KDD、AAAI等)发表过论文。3. 熟悉Transformer、预训练、微调、提示学习等技术,具备大规模模型训练或推理优化经验者优先。4. 熟练掌握Python及主流深度学习框架(PyTorch/TensorFlow),具备良好的代码实现与调试能力。5. 具备独立科研能力、团队协作精神和良好的英文写作与沟通能力。 投递...
AI院-多模态音频-算法实习生 北京 实习 互联网 / 电子 / 网游 职位描述 【团队介绍】智谱多模态大模型团队是全球领先的多模态研究团队之一,专注于推动视觉语言大模型的认知与推理能力的突破。团队拥有从多模态理解到生成的全栈自研技术体系,依托强大的计算资源和全链路研发能力,持续引领行业创新。团队负责多模态基座模型研发(视觉语言模型+多模态生成模型),先后推出GLM-V系列多模态基座模型,以及GLM-Image、CogView、CogVideo等前沿生成模型。2025年连续发布GLM-4.1V-Thinking、GLM4.5V和GLM-4.6V系列模型,其中GLM-4.1V-Thinking创新性地引入思维链推理机制,采用课程采样强化学习策略,系统性提升模型跨模态因果推理能力与稳定性,在28项业界权威评测中有23项达成10B级模型的最佳成绩(SOTA);而GLM-4.5V采用MoE架构(总参数106B、激活参数12B),在100B级视觉推理模型中树立起新的标准,在41个业界主流benchmark上达到同级别SOTA,且OCR、视频理解、AI解题、长文档解读、前端复刻、空间定位与推理等核心能力获得显著提升;GLM-4.6V则在多模态感知和深度推理方面进一步增强,且支持128k long-context、多模态工具调用和图文交错输出,为执行复杂、长程、多模态Agentic任务奠定坚实基础;9B版本的GLM-4.6V-Flash整体表现超过 Qwen3-VL-8B,106B参数12B激活的GLM-4.6V表现比肩2倍参数量的Qwen3-VL-235B。顺应技术发展趋势和业界需求,2026年初团队研发和开源GLM-Image和GLM-OCR。前者是智谱新旗舰图像生成模型,全程基于国产芯片完成训练,采用独创的「自回归+扩散解码器」混合架构,兼顾全局指令理解与局部细节刻画,克服了海报、PPT、科普图等知识密集型场景生成难题,是面向以Nano Banana Pro为代表的新一代「认知型生成」技术范式的一次重要探索。GLM-OCR则是轻量级OCR和文档解析专用模型,以“小尺寸、高精度”树立新标杆,其性能登顶 OmniDocBench,擅长公式、手写体、表格等高难场景,仅 0.9B 参数,推理高效易部署,在HuggingFace上获得超过360万下载量。【岗位职责】1. 从事音频算法研究、训练、应用,具体业务包括Omni-音频理解、同声传译、video-audio联合生成等2. 探索语音/音频技术前沿技术,探索音频理解、音频表征、音视频联合生成的新范式3. 负责模型的多机多卡训练、高性能推理、数据集构建、评测系统搭建等 职位要求 【职位要求】1. 自然语言处理、机器学习、人工智能、软件工程等相关专业,硕士及以上学历;2. 较强的算法开发能力,熟悉常用的机器学习、深度学习算法;3. 熟练使用Python和Pytorch/Tensorflow深度学习框架;4. 熟悉以下至少一种,且有相应研发经验优先,大模型的框架&理论(如Diffusion、Vall-E/SpearTTS/AudioLM、MusicLM等);5. 具备优秀的代码能力和基础算法功底,有较为丰富的工程经验,有大规模训练经验或大规模数据处理经验。加分项:1. 在ACL,NeurIPS,ICLR,EMNLP,ICML等顶级会议或期刊上发表过论文者优先;2. 熟悉并行训练框架,有多机多卡训练经验者优先。 投递...
AI院-多模态团队-多模态生成算法研究员 北京 全职 互联网 / 电子 / 网游 职位描述 【团队介绍】智谱多模态大模型团队是全球领先的多模态研究团队之一,专注于推动视觉语言大模型的认知与推理能力的突破。团队拥有从多模态理解到生成的全栈自研技术体系,依托强大的计算资源和全链路研发能力,持续引领行业创新。团队负责多模态基座模型研发(视觉语言模型+多模态生成模型),先后推出GLM-V系列多模态基座模型,以及GLM-Image、CogView、CogVideo等前沿生成模型。2025年连续发布GLM-4.1V-Thinking、GLM4.5V和GLM-4.6V系列模型,其中GLM-4.1V-Thinking创新性地引入思维链推理机制,采用课程采样强化学习策略,系统性提升模型跨模态因果推理能力与稳定性,在28项业界权威评测中有23项达成10B级模型的最佳成绩(SOTA);而GLM-4.5V采用MoE架构(总参数106B、激活参数12B),在100B级视觉推理模型中树立起新的标准,在41个业界主流benchmark上达到同级别SOTA,且OCR、视频理解、AI解题、长文档解读、前端复刻、空间定位与推理等核心能力获得显著提升;GLM-4.6V则在多模态感知和深度推理方面进一步增强,且支持128k long-context、多模态工具调用和图文交错输出,为执行复杂、长程、多模态Agentic任务奠定坚实基础;9B版本的GLM-4.6V-Flash整体表现超过 Qwen3-VL-8B,106B参数12B激活的GLM-4.6V表现比肩2倍参数量的Qwen3-VL-235B。顺应技术发展趋势和业界需求,2026年初团队研发和开源GLM-Image和GLM-OCR。前者是智谱新旗舰图像生成模型,全程基于国产芯片完成训练,采用独创的「自回归+扩散解码器」混合架构,兼顾全局指令理解与局部细节刻画,克服了海报、PPT、科普图等知识密集型场景生成难题,是面向以Nano Banana Pro为代表的新一代「认知型生成」技术范式的一次重要探索。GLM-OCR则是轻量级OCR和文档解析专用模型,以“小尺寸、高精度”树立新标杆,其性能登顶 OmniDocBench,擅长公式、手写体、表格等高难场景,仅 0.9B 参数,推理高效易部署,在HuggingFace上获得超过360万下载量。【岗位职责】负责图像/视频生成模型训练及数据优化 职位要求 1、985高校计算机、电子、自动化等相关专业硕士或博士学位(优秀本科生亦可考虑);2、深入理解常用多模态算法;具备多模态大模型和视频理解相关项目经验者优先;3、在CCF-A类会议发表过多模态相关论文者优先考虑;4、熟练运用Pytorch、transformers、megatron等主流框架;5、工作态度认真负责,具备良好的团队协作能力。 【加分项】 - 在ACL,NeurIPS,ICLR,EMNLP,ICML等顶级会议或期刊上发表过论文者优先; - 熟悉并行训练框架,有多机多卡训练经验者优先。 投递...
大模型算法实习生-行业应用-上海 上海 实习 互联网 / 电子 / 网游 职位描述 部门介绍:我们团队专注于将GLM系列大型模型推向商业市场,服务于中央企业、国有企业、金融机构、能源行业等高端企业客户。我们致力于帮助这些客户迅速搭建起新一代人工智能的平台架构,培育技术力量,并实现场景化的应用部署。依托于我们构建的企业级原生大模型应用开发平台,我们为用户提供了一系列专业化的产品与服务,覆盖音视频智能分析、多源异构知识整合管理、项目全生命周期研发支持、零代码的大模型应用快速开发,以及客户关键业务流程的智能化应用等多个领域。我们的目标是通过提升企业的运营效率,推动客户智能化转型,从而为企业带来更加深远的价值增长。1、参与大模型的研究和应用,包括但不限于LLM、SFT、Agent/MultiAgent、 Tool Learning、RAG、RLHF等技术探索,研究前沿模型训练和优化方法,开发国际顶尖级大模型;2、根据业务场景需求设计微调方案、适配算法和调优工程方案;3、参与智谱AI的行业大模型语料知识库建设和训练语料优化,知识图谱、知识FAQ、知识增强大模型等基础算法方向;4、研究和跟踪前沿技术发展,探索AI在助力数字民生服务普惠和智能化方面的新方法和新范式,推动相关领域技术创新。 职位要求 1. 在读本科及以上学历,计算机、人工智能、自然语言处理等相关专业:2.熟悉大模型的基础原理,有数据、模型结构以及微调方面的理论基础,有经验更佳;对NL2SOL、RAG、SFT有一定的算法实践基础;3. 认真负责、热爱学习和探索;熟练使用办公类软件(Office、Xmind等);4. 对大模型有兴趣、可长期业务陪伴、有Python编程能力优先;有顶会论文 (ACL、NeurIPS、ICLR、EMNLP等)成果或者算法比赛 (kaggle、天池等)优异成绩者优先。 投递...
AutoGLM-Agent算法工程师 北京 全职 互联网 / 电子 / 网游 职位描述 1. 负责大模型智能体相关的基础性和应用性算法开发和调优,包括任务定义,数据构造,SFT/RL 等算法设计开发,以及智能体能力评测;2. 跟进工业界/学术界最新动态,在骨干模型上实现和尝试新的算法和方案,开发包括 API 调用、GUI 智能体、Function Call 等新的 LLM 系统性应用;3. 在专业领域和应用场景适配基座模型,并取得专用领域的良好表现; 职位要求 1. 统招硕士及以上学历(优秀者本科亦可),有较强的算法和工程能力,熟练掌握 PyTorch、DeepSpeed、Megatron、VeRL、OpenRLHF框架,有文本/多模态大模型的强化学习训练经验;2. 良好的沟通能力和跨团队协作能力,表达能力清晰,善于与人沟通;3. 有良好的自我驱动能力,能快速推进新任务的完成;对于新技术的学习抱有热情,有持续自我学习和提高的意识和能力;4. 在 ICML、NeurIPS、ICLR、ACL、EMNLP、KDD 等人工智能顶级会议或期刊上发表论文,取得过 ICPC、NOI、ACM 等比赛奖项者优先;5. 在大模型相关岗位有实习和工作经验者优先;6. 有超算经验和大规模分布式计算知识和经验者优先; 投递...
大模型算法实习生 北京 实习 互联网 / 电子 / 网游 职位描述 1. 大模型训练与优化: - 参与大规模语言模型(LLM)的预训练、微调、对齐(Alignment)及性能优化(如SFT、DPO、RLHF等)。 2. 应用场景落地: - 结合业务需求(如对话系统、内容生成、ChatBI、Agent),熟练运用不同训练方法解决实际问题, 有实际项目经验者优先。3. 前沿技术研究: - 跟踪大模型领域最新论文(如Transformer架构改进、多模态融合、Agent技术等),复现并验证创新点。 4. 经验总结: - 协助撰写技术文档、报告 职位要求 必需项: 1. 技术基础: - 熟悉Python和主流深度学习框架(PyTorch/TensorFlow)。 - 掌握NLP基础知识(如Transformer/BERT/GPT等模型原理)。 2. 经验要求: -
AutoGLM-算法实习生 北京 实习 互联网 / 电子 / 网游 职位描述 部门介绍我们是一支专注于 AIAgent 研发创新的技术与产品团队——智谱 AutoGLM。团队成员来自多所国内外知名高校,覆盖人工智能、数据科学、软件工程等多个领域,具备丰富的算法创新研究、智能系统设计和产品落地经验。我们致力于打造智能、通用、可拓展的 AIAgent 应用产品与解决方案,赋能多领域行业的智能升级,为使用者带来全新的人机交互体验。目前,基于技术团队在语言模型、多模态模型和工具使用等多方面努力的成果,AutoGLM 的使用场景覆盖手机、电脑、网页等多端设备,涵盖生活提效、深度研究等多个领域方向,并且能力持续提升中。同时,我们也等在内的多个领域客户展积极开展深入合作,不断推动产品的商业化落地与实际业务的深度融合。AutoGLM 算法实习生(Agent方向)岗位职责:1、参与大模型智能体相关的基础性和应用性算法开发和调优,包括任务定义,数据构造,SFT/RL 等算法设计开发,以及智能体能力评测;2、跟进工业界/学术界最新动态,在骨干模型上实现和尝试新的算法和方案,开发包括 API 调用、GUI 智能体、Function Call 等新的 LLM 系统性应用;3、在专业领域和应用场景适配基座模型,并取得专用领域的良好表现;任职要求:1、统招硕士及以上(优秀者本科亦可)在读,有较强的算法和工程能力,熟练掌握 PyTorch、DeepSpeed、Megatron、VeRL、OpenRLHF框架,有文本/多模态大模型的强化学习训练经验;2、良好的沟通能力和跨团队协作能力,表达能力清晰,善于与人沟通;有良好的自我驱动能力,能快速推进新任务的完成;对于新技术的学习抱有热情,有持续自我学习和提高的意识和能力;3、在 ICML、NeurIPS、ICLR、ACL、EMNLP、KDD 等人工智能顶级会议或期刊上发表论文,取得过 ICPC、NOI、ACM 等比赛奖项者优先;4、在大模型相关岗位有实习经验者优先;5、有超算经验和大规模分布式计算知识和经验者优先; 职位要求 - 投递...
AutoGLM-强化学习工程师 北京 全职 互联网 / 电子 / 网游 职位描述 工作职责:1.负责 LLM 强化学习用于大模型智能体 GUI/API Agent 的模型整体优化,包括数据探索与增强、奖励模型优化、RL策略迭代及效果评估等,持续提升算法的效率与效果2.强化学习技术前瞻探索,包括但不限于离线强化学习、环境模型学习、约束强化学习等方向3.改进和完善大语言模型的强化学习的分布式工程框架,实现更高效的模型训练 职位要求 岗位基本需求:1.扎实的算法基础,熟悉强化学习、自然语言处理和机器学习技术,对技术开发及应用有热情;2.具备RL算法优化和工程项目实践经验,在ICML、NeurIPS、ICLR、JMLR、ACL、KDD等顶级会议或期刊上发表过论文,或在RL应用相关的大型比赛中获得名次;3.了解 Agent 相关的前沿进展,并对于将强化学习应用在LLM Agent训练中感兴趣;有大语言模型算法优化和大规模分布式RL框架优化经验优先4.良好的沟通能力和跨团队协作能力,能够梳理繁杂的工作并建立有效机制,推动上下游配合完成目标岗位亮点:1.能专注LLM底层算法和工程研发,利用强化学习与LLM解决大模型能力提升中的有实际价值的难题2.加入一个专注技术研发的人工智能模型的团队,与各个方向的算法专家交流学习 投递...