算法工程师 - LLM后训练 Beijing Full-time R&D - Algorithm Responsibilities 参与公司AI算法相关工作,专注于提升大语言模型(LLM)的生成质量,推动技术创新和产品落地,具体职责包括但不限于:1. 监督微调:深入研究和实施大语言模型(LLM)的SFT、RFT等技术方案,优化AI的情感表达能力和剧情设计能力,突破长期记忆、行为一致性等技术难点2. 奖励模型:基于海量用户交互日志和反馈数据,深入挖掘真实用户偏好信号,构建高质量的偏好数据集;设计并实现包括生成式奖励模型(GRM)、过程奖励模型(PRM)等在内的多维度奖励函数3. 强化学习:深入理解PPO、DPO、GRPO等常用LLM强化学习方法,结合具体业务目标(如上下文一致性、逻辑正确性、OOC等),设计定制化的奖励组合与训练策略4. Agent:面向复杂、多步骤的业务场景,设计并实现基于大语言模型的Agent架构;集成工具调用(Tool Use)、记忆机制(Memory)、反思(Reflection)、多智能体协作等范式实现复杂任务的能力跃迁 Qualifications 1. 优秀的代码能力、数据结构和基础算法功底,熟练C/C++或Python,ACM/ICPC、NOI/IOI、Top Coder、Kaggle等比赛获奖者优先;2. 熟悉NLP、CV相关的算法和技术,熟悉大模型训练、RL算法者优先;3. 在虚拟角色生成、角色扮演、情感陪伴等方向有项目经验或论文成果者优先;4. 能系统性拆解角色类模型在生成一致性、长期记忆等场景的挑战,提出创新解决方案;5. 具备较强自驱力,能与产品、算法团队紧密协作,推动技术从研究到落地的全链路闭环。 Apply...
The Engineer Senior I, Technology, in accordance with established policies, procedures, and standards, is responsible for the activities related to assigned programs and projects. What You Will Do: Identifies and proposes Technology programs and projects in
The Engineer, Principal, Technology is responsible for normally planning, conducting and supervising engineering design reviews and analysis assignments involving larger, more critical projects or multiple projects. These projects by nature of their complexity and difficulty require
算法工程师 - Agent Beijing Full-time R&D - Algorithm Responsibilities 负责公司AI Agent方向的算法研究与落地工作,围绕个性化内容生成与长期记忆构建,将大模型训练技术(SFT、RL等)应用于Agent能力的持续提升,具体职责包括但不限于:1. Agent架构设计:面向个性化内容生成和角色交互场景,设计并实现基于大语言模型的Agent架构;定义Agent的编排流程、工具调用(Tool Use)、反思(Reflection)等核心范式,使Agent能够基于用户画像和历史交互生成高度个性化的内容与回复2. Agent训练与优化:运用SFT、RFT、PPO、DPO、GRPO等训练方法,针对Agent场景设计专项训练方案;构建Agent行为轨迹数据集,通过强化学习优化Agent的个性化生成质量、记忆调用准确性和多轮对话一致性3. 训练环境设计:构建Agent训练所需的真实可执行交互环境(工具调用沙箱、用户模拟器、多轮对话场景等),定义状态空间、动作空间和反馈信号,为Agent提供高质量的训练闭环4. 奖励建模:设计Agent专用的奖励函数与评估体系,针对个性化程度、内容一致性、记忆调用准确性、用户满意度等多维目标,结合过程奖励模型(PRM)、生成式奖励模型(GRM)以及个性化奖励模型(Personalized RM,基于用户偏好和交互历史动态调整奖励信号),实现对Agent行为链路的细粒度奖励,解决奖励稀疏、奖励欺骗等核心难题5. 记忆与个性化系统:构建可解释、可迁移、可控的Agent记忆架构,支持用户偏好的长期建模与动态更新;实现记忆的版本化管理,支持精确遗忘(通过token删除)和跨模型迁移,保障个性化体验的连续性与可控性6. 持续学习(Continual Learning):研究并实现Token Space下的持续学习机制,通过更新Agent的learned context(系统提示、记忆库、工具定义等)而非模型权重来实现Agent的持续进化;解决context poisoning(上下文污染)/ context rot(上下文退化)等有限上下文窗口下的记忆退化问题,在避免灾难性遗忘的前提下实现Agent知识的增量积累8. 快速实验与迭代闭环:具备从eval构建、数据准备、方案实现到结果评估的全链路快速实验能力;参与Agent的线上A/B实验设计,通过线上效果度量和用户反馈分析定位算法瓶颈,驱动下一轮训练与模型优化的方向 Qualifications 1. 优秀的代码能力、数据结构和基础算法功底,熟练C/C++或Python,ACM/ICPC、NOI/IOI、Top Coder、Kaggle等比赛获奖者优先;2. 熟悉NLP相关的算法和技术,具备大模型训练和RL算法的实践经验;3. 对LLM-based Agent系统有深入理解,具备Agent训练或Agent系统相关的项目经验;4. 能系统性拆解Agent在长期记忆管理、个性化内容生成、上下文窗口利用等场景的挑战,提出创新解决方案;5. 具备较强自驱力,能与产品、算法团队紧密协作,推动技术从研究到落地的全链路闭环。加分项:1. 在Agent记忆机制、个性化生成、持续学习、上下文优化(如DSPy等prompt optimization方法)等方向有论文成果;2.
Job Summary: Provides technical support on health, safety and environmental to production and site personnel under the guidance of the site HSE leader. Assists in the implementation, analysis, review and sustainability of Health, Safety and Environmental
Job Summary: Operates machines and production equipment in accordance with quality and productivity requirements safely in a manufacturing environment with direct guidance. Key Responsibilities: Health, Safety & Environmental (HSE) Stop work and immediately report any major
We are hiring immediately for a part time CASHIER/FOOD SERVICE WORKER position. Location: East China Schools - 1585 Meisner Road, East China, MI 48054. Note: online applications accepted only. Schedule: Part time schedule; Monday through Friday,
Job Summary: Partner and collaborate with hiring managers, interview teams, recruiters, human resources, shared services and other key stakeholders to provide support services across talent acquisition and onboarding processes. Key Responsibilities: Always On Support Accountable for
大模型算法工程师(LLM)-校招【27届】 北京 AI车青年 职位 ID:A214507 职位描述 1. 负责大语言模型(LLM)及智能体(Agent)在汽车垂类场景的端到端落地,覆盖AI销售、智能客服等公司级核心产品功能;2. 构建基于 智能体协作(Tools/Skills/Handoffs) 的智能体系统,实现多步骤任务规划能力;3. 探索并应用 思维链(Chain-of-Thought, CoT)、自我反思(Reflection)等机制,提升模型在复杂购车咨询、对比分析、金融贷款等高阶推理任务中的表现;4. 参与LLM强化学习优化链路建设,包括偏好数据构建、可验证奖励强化学习(RLVR);5. 与产品、工程、业务团队紧密协作,推动算法模型从实验到上线的全链路工程化落地,并建立科学的效果评估与迭代机制; 职位要求 1. 计算机、人工智能、自动化、数学或相关专业,硕士及以上学历;2. 扎实的机器学习理论基础,深入理解Transformer架构及主流大模型(如LLaMA、Qwen、DeepSeek、GPT系列)的训练与推理机制;3. 具备完整的LLM应用落地经验,熟悉 Prompt Engineering、SFT、DPO 等技术路径,并有实际项目验证效果;4. 对智能体(Agent)技术栈有实践积累,包括但不限于:基于CoT的任务分解与推理、多工具调用(Function Calling)与执行反馈闭环、自主规划(Planning)与状态记忆(Memory)机制、基于用户行为或模拟反馈的策略优化方法5. 熟练掌握Python,具备良好的工程实现与系统设计能力,了解服务端部署、模型监控与AB测试流程;6. 精通PyTorch/TensorFlow等框架,了解分布式训练、推理加速(vLLM/TensorRT-LLM等)、模型量化等优化技术;7. 具备优秀的逻辑思维、业务抽象能力与跨团队协作意识,能将复杂用户需求转化为可量化的技术方案;加分项(优先考虑)1. 有垂直领域(汽车、电商、客服等)智能体或强化学习落地经验;2. 在ICLR、NeurIPS、ICML、ACL、EMNLP等顶会发表过LLM、Agent或RL相关论文;3. 熟悉多智能体协作(handoffs architecture)、可验证奖励强化学习(RLVR);4. 参与过开源Agent框架(如LangChain、LlamaIndex、AutoGen)的二次开发或优化;5. 具备大模型评估体系设计经验,尤其在事实一致性、工具调用准确率、任务完成率等维度有方法论沉淀。 投递...
We are hiring immediately for part time FOOD SERVICE WORKER positions. Location: East China Schools - 1585 Meisner Road, East China, MI 48054. Note: online applications accepted only. Schedule: Part time schedule; Monday through Friday, 9:00
Company Description Do you want beneficial technologies being shaped by your ideas? Whether in the areas of mobility solutions, consumer goods, industrial technology or energy and building technology - with us, you will have the chance
Agentic AI Engineer Position ID: P946333 Location: Hangzhou, China Employment Type: Full-time Role Summary We are seeking an experienced Agentic AI Engineer to design, build, and evolve enterprise-grade Agentic AI platforms and solutions supporting investment management,
We are the global test and automation specialists, powering next-generation technologies through sophisticated solutions. Behind every electronic device you use, Teradynes test technology ensures your device works right the first time, every time! Our portfolio of
Job ID:43825 Location:LRQA - Shenzhen - Guomao Commerc Position Category:Business Development Position Type:Employee Regular Role Purpose Our team conducts a thorough supply chain risk analysis and due diligence that considers country, region, commodity, and other factors
Job Summary: Works in a variety of finance roles, during a two-year developmental program. Based on assigned location, responsibilities will vary, including the preparation of analyses, forecasts and reports, support of the annual budget process, and
The Surveyor I is an entry or junior-level position for new graduates and/or those candidates with less than five (5) years of experience in an applicable industry. The Surveyor I, under a direct supervisor, performs work
大模型领域后训练算法工程师 北京、上海 社招 全职 数字技术 本科及以上 工作年限不限 职位描述 1. 设计并实现面向车载人机智能交互系统的后训练算法流程,优化多轮对话决策、任务规划等agent能力。2. 负责调研、复现LLM agentic RL等post-training相关的前沿研究,探索将新技术应用于实际产品。3. 协助实车数据问题挖掘、分析及解决方案制定等。4. 协助设计并实现增强基模agent相关能力的交互环境、user simulator、world model、reward function等关键模块。 职位要求 1. 本科及以上学历,计算机、自动化、信号处理等相关专业,数理基础扎实,乐于在强化学习方向深入探索。2. 熟练掌握Python/JAVA/TypeScript/JsonScript等编程语言(一门及以上)。3. 熟悉LLM agent相关概念,深入理解ReAct、function call、TIR、reflection等相关范式。4. 熟练掌握LLM RL主流算法原理,如PPO、GRPO、DAPO等,对agentic RL范式有研究兴趣,有实际项目经验为佳。5. 熟悉相关蒸馏算法,包括off-policy distillation及on-policy distillation等范式。6. 熟悉常见后训练、强化学习框架,包括但不限于Verl、Slime、ms-swift、OpenRLHF、TRL等。对大规模分布式机器学习框架有一定了解,对training、inference相关infra工作感兴趣。7. 熟悉语音对话系统,或有高水平论文发表者优先。 投递...
大语言模型后训练/Agentic算法工程师 上海、北京 社招 全职 数字技术 本科及以上 工作年限不限 职位描述 岗位亮点参与构建面向智能座舱场景的下一代大模型 Agent,推动 LLM 后训练、Agentic RL、多工具调用、多轮推理决策等前沿技术在真实车载产品中落地,持续提升模型在真实用户、真实车辆、真实场景中的可靠性与体验。面向智能座舱与车载交互场景,探索大语言模型与 Agent 在真实产品中的应用,负责车载对话系统、任务型助手、多轮交互Agent等方向的研究、训练优化、效果评估与产品迭代。跟踪并复现 LLM 后训练与 Agentic Training 前沿技术,包括 On-policy Distillation、Agentic RL、RLHF / RLVR 等,推动其在车载智能体、复杂任务执行、多工具调用和多轮推理决策中的落地。参与构建 Agent 能力增强所需的训练与交互环境,包括 Tool 系统、User Simulator、World Model、Reward Function、Agent Harness、任务编排与自动化评测框架等。基于实车交互数据和线上反馈,进行问题挖掘、错误归因与方案优化,建设数据生产、模型训练、离线评测、在线分析和失败案例回流的闭环体系,推动大模型能力从“可用”走向“好用、可靠、可持续进化”。 职位要求 研究生及以上学历,计算机、人工智能、自动化、信号处理、数学等相关专业,具备扎实的机器学习与
Embodied AI Research Intern 深圳、上海 实习 互联网 / 电子 / 网游 职位描述 1、参与具身智能(Embodied AI)基础模型的研发,探索 Vision-Language-Action(VLA)、Vision-Language Model(VLM)、World Model 等技术在人形机器人中的应用;2、参与机器人“大脑(Agentic VLM)”相关能力开发,包括场景理解(Perception)、任务规划(Planning)、推理决策(Reasoning)、反思纠错(Reflection)、长期记忆(Memory)以及工具调用(Tool Use)等核心能力建设;3、参与 World Model / Action Model 的设计与训练,探索长时序任务建模(Long-Horizon Modeling)、未来状态预测(Future Prediction)以及机器人控制策略学习;4、与机器人平台、仿真平台及硬件团队紧密合作,推动算法在真实机器人系统上的部署与验证;5、跟踪具身智能、机器人基础模型以及多模态大模型领域的前沿研究,推动新技术快速落地。 职位要求 1、计算机科学、人工智能、机器人、自动化、电子工程等相关专业硕士及以上学历;2、具备扎实的机器学习与深度学习基础,熟悉 Transformer、Diffusion Model、Vision Transformer(ViT)、CLIP、LLM、VLM 等主流模型架构;3、熟悉 PyTorch 深度学习框架,具备良好的工程实现能力和代码开发能力;4、对机器人学习(Robot Learning)、计算机视觉(Computer
资深 Agent 工程师(Tripo Studio · Canvas Agent) Beijing Experienced Full-time Responsibilities 【我们在做什么】Tripo 做 3D 生成:把文本、图片和交互变成可交付的 3D 资产。https://tripo3d.ai本岗位在 Agent 团队,负责 Studio 中的 Canvas Agent:把自然语言、参考图和画布操作,编排成可执行的创作流程。工作重点是 Agent 架构、评测,以及效果、成本、时延之间的取舍。【你将负责】1. 端到端创作链路:基于自然语言、参考图和画布交互,规划并执行「生成 → 检查 → 分割 / 局部编辑 → 贴图 → 重拓扑