自动驾驶基础模型研究员 北京 全职 互联网 / 电子 / 网游 职位描述 岗位介绍面向下一代自动驾驶技术路线,打造以视觉为核心的基础模型能力。区别于传统“感知结果驱动规划”的范式,构建从图像中直接学习对驾驶动作有因果意义表征的模型体系,让 Planner 更直接地利用视觉特征完成决策,并通过端到端训练持续提升复杂场景、长尾场景和闭环驾驶表现。团队当前重点方向包括:视觉 foundation model、泛特征建模、世界模型(World Model / World-Action Model)、几何监督、自监督学习、时序建模、场景理解,以及面向自动驾驶任务的大规模训练与迭代优化。岗位职责1. 负责自动驾驶基础模型的架构设计、训练与效果迭代,推动视觉泛特征在自动驾驶任务中的建模与落地;2. 研究视觉表征学习、世界模型、未来状态预测、inverse dynamics、latent planning 等方向,并结合自动驾驶场景形成可验证的技术方案;3. 探索 Planner 与 Vision Encoder 更深度耦合的端到端训练方式,提升模型对复杂交通参与者、长尾障碍物和开放场景的理解与决策能力;4. 设计并验证多种辅助学习任务,包括但不限于几何监督、自监督任务、时序建模、场景理解、视觉辅助任务等,持续增强模型表征能力;5. 负责关键实验设计、离线/闭环指标分析、问题归因和版本迭代,形成高效稳定的研发闭环;6. 与感知、规划、数据、训练系统、工程部署等团队协同,推动研究方案向工程可落地和量产可演进方向发展。。 职位要求 任职要求1. 硕士及以上学历,计算机、人工智能、自动化、机器人、数学、电子工程等相关专业;2. 具备扎实的深度学习基础,熟悉 Transformer、ViT、视频理解、时序建模、自监督学习等核心方法;在以下一个或多个方向有较深入的研究或实战经验:视觉基础模型