端到端双足导航算法实习生 上海 实习 职位描述 - 负责端到端自主导航算法研发,构建面向全尺寸人形机器人的自主导航能力,包括多模态感知、轨迹预测、导航决策等核心模块,持续提升导航智能化水平。- 负责VLM-Nav/VLN/VLA相关算法研发,构建视觉-语言-动作闭环能力,实现自然语言理解、语义目标定位、路径规划及自主执行。- 负责多模态感知模型研发,包括RGB、Depth、LiDAR、IMU等多源信息融合,研究BEV、Occupancy、语义地图等环境表征,为导航规划提供统一场景理解能力。- 负责导航Planner模型研发,探索基于Transformer、Diffusion、World Model等新一代规划算法,实现Waypoint预测、轨迹生成、动态避障及复杂环境下的自主决策。- 负责双足机器人导航感控融合算法研发,构建导航规划与运动控制协同框架,实现规划轨迹与步态控制、全身控制(WBC)、地形感知等模块的高效协同,提升复杂地形、人群环境及动态场景下的运动稳定性与导航成功率。 职位要求 - 硕士及以上学历,计算机、机器人、人工智能等相关专业。- 熟悉机器人导航、Embodied AI、VLM/VLA、VLN等相关方向,具有较扎实的算法基础。- 熟悉以下一个或多个方向: - 端到端自主导航(End-to-End Navigation) - Planner模型(Transformer、Diffusion、World Model等) - 多模态感知(BEV、Occupancy、3D Perception、多传感器融合) - 轨迹预测与运动规划(Trajectory Prediction、Motion Planning) - VLM-Nav / Vision-Language Navigation- 熟悉深度学习框架(PyTorch等),具备模型训练、调优、部署及性能优化经验。- 具备较强的问题分析及工程实现能力,能够独立完成算法设计、实验验证、性能分析及线上问题定位。- 具有良好的团队协作能力,能够推动跨团队合作及复杂系统集成落地。-加分项- 熟悉具身智能(Embodied AI)、VLA、世界模型(World
具身感知算法工程师-通用业务部 上海 校招 正式 技术族 - 算法类 职位 ID:A228075 职位描述 - 负责3D视觉感知算法研发:围绕双目/单目深度估计、三维重建、3D场景理解、Occupancy预测等方向,提升机器人空间感知能力。- 攻关复杂环境下多模态感知问题:研究多相机、LiDAR等多传感器融合,跨视角特征交互、时空信息建模及动态环境理解。- 负责感知-规划联合模型研发:研究3D视觉表征、多模态融合与Planner/Policy模型协同优化,提升机器人空间理解、行为预测与自主决策能力。- 探索具身基础模型中的3D空间理解能力:面向VLA/WMA等模型,构建视觉-语言-空间联合表征,研究3D场景理解、多模态对齐与空间推理方法。- 建立数据闭环与模型评测体系:负责多模态数据采集、自动化标注、难例挖掘、仿真/真实场景评测及算法持续优化。 职位要求 - 硕士及以上学历,计算机、机器人、人工智能等相关专业。- 具备计算机视觉或深度学习项目/科研经验,熟悉视觉语言模型(VLM)、多模态模型或大模型相关技术。- 熟练掌握PyTorch等深度学习框架,具备模型训练、调优、推理优化及工程落地能力。- 具备独立算法研发能力,能够完成数据处理、模型训练、实验分析、性能评测及失败案例定位。加分项- 顶级会议论文、专利或开源贡献经验(CVPR、ICCV、ECCV、NeurIPS、ICLR、RSS、CoRL等)。- 具备3D视觉基础模型或多模态大模型经验(VLM、Vision-Language-3D等)。- 具备大规模机器人数据闭环、仿真环境(Habitat、Isaac、Omniverse等)或具身智能系统研发经验。 投递...
Company Description Do you want beneficial technologies being shaped by your ideas? Whether in the areas of mobility solutions, consumer goods, industrial technology or energy and building technology - with us, you will have the chance