VLA算法工程师-酷拓子公司 深圳 校招 正式 技术族 - 算法类 职位 ID:A29754 职位描述 酷拓是智元旗下专注四足机器人的独资子公司,以全地形智能移动与作业平台为核心定位。依托智元“三智一体”技术底座,彻底打破传统机器人“腿长脑子空”的局限,将其升级为具备自主决策能力的AGI四足新物种。1. 参与四足机器人+机械臂的VLA大模型全链路研发(数据处理、预训练、后训练、真机部署),实现多模态信息驱动的移动操作任务,并提升VLA的在线学习与泛化能力。2. 以量产落地为导向,设计并实现VLA算法方案,参与数据采集-模型训练-真机部署的全链路构建,实现模型实际场景的落地需求。3. 持续跟踪具身智能和VLA领域的前沿进展(包括最新论文、开源项目等),快速验证并将先进技术落地到产品中,推动模型性能持续迭代4. 将 VLA 模型输出与底层运控控系统(如 WBC、阻抗控制、RL policy)进行对接,实现稳定、安全、可靠的移动操作能力。 职位要求 1. 硕士及以上学历,计算机、自动化、机器人等相关专业。2. 深入理解模仿学习与强化学习(RL/RLHF),有大规模型预训练或真机后训练落地经验。3. 熟悉主流VLA架构(Genie Operator-2、π0/π系列、RT-2、ACT、Diffusion Policy),熟悉π0.7等VLA基座模型算法框架与部署。4. 深入理解VLA核心能力:场景理解、任务 / 行为规划、多模态感知、移动操作与闭环执行。5. 熟悉PyTorch、ROS/ROS2、Isaac Sim/MuJoCo,有推理部署优化(量化/TensorRT)经验。 投递...
AIGC导演实习生(视觉方向) 北京 校招 实习 内容制作 - 导演 日常实习生招聘 职位 ID:A169763 职位描述 -协助AIGC导演完成项目的视觉风格探索与美术方向执行,参与角色设计、场景构建、色彩氛围、关键帧绘制等视觉环节的AI辅助创作;-运用Stable Diffusion、Midjourney、ComfyUI等AIGC工具进行概念图、风格参考、视觉素材的生成与迭代,协助建立风格控制与角色一致性方案;-参与AI视觉生产流程的搭建与优化,协助整理模型训练、LoRA微调、提示词模板等视觉资产,提升美术环节的生成效率与质量稳定性;-配合导演、美术、技术团队完成视觉创意与故事表达、角色塑造、情绪氛围的协同落地,确保视觉呈现符合项目要求;-参与视觉素材的整理、归档与版本管理,协助完成项目美术资产的规范化沉淀。 职位要求 -动画、数字媒体、影视、美术、设计等相关专业在读本科或研究生,具备扎实的美术基础与审美能力,对构图、色彩、光影、造型有基本认知;-熟悉主流AIGC视觉工具,有实际作品产出经验,了解提示词工程、ControlNet应用或LoRA训练者优先;-对动画、影视、游戏等数字内容领域有浓厚兴趣,关注视觉趋势与AIGC技术发展,具备快速学习与主动探索能力;-具备良好的沟通协作能力与责任心,能够在快节奏项目中高效执行任务。注:投递时请上传AI短片作品,若为小组共创,请在描述中注明本人负责的环节与部分。请勿上传非AI辅助创作作品,请勿上传非AI辅助创作作品,请勿上传非AI辅助创作作品。 投递...
大模型算法专家/TL 北京、深圳、上海 全职 互联网 / 电子 / 网游 职位描述 - 定义和主导端到端自动驾驶算法的长期技术路线图,负责从模型架构(如Transformer、Diffusion Model等)选型到整体方案设计的关键决策。- 深入一线,解决研发过程中最棘手的技术难题,如长尾场景处理、模型收敛性、部署效率等。- 推动端到端模型在量产项目中的评估、测试和部署,对最终的产品性能和用户体验负责。 职位要求 职位要求- 计算机科学、人工智能、机器人学、电子工程或相关领域。- 3年以上在强化学习、深度学习、多模态大模型领域的研发经验,其中至少2年作为技术负责人或团队管理者的经验。- 有直接从事端到端(End-to-End)自动驾驶模型研发的经验者优先,经历过量产经验。- 在CVPR、NeurIPS、ICLR、ICRA、CoRL等顶级学术会议上有相关论文发表者优先。- 对自动驾驶技术充满热情,具备出色的沟通能力、自驱力和解决问题的决心。 投递...
AI创意设计专家 深圳 社招 全职 职位描述 岗位定位一个能把 AI 变成可复用的生产力、产出高质量商业级视觉内容、同时推动团队 AI 工作流持续进化的资深角色。既要深入节点图和模型训练,也能前瞻性地思考品牌资产沉淀与流程优化。岗位职责AI workflow 与模型库的工程化落地通过对 ComfyUI / Flux / SDXL / LoRA 训练 / 视频模型等主流工具的深度掌控,搭建可复用的 AI 设计 workflow,并沉淀为团队级模型库与风格资产,直接服务于产品线和品牌项目的日常产出。关键 AI 视觉资产交付完成高复杂度、高传播度的 AI 原生视觉内容(品牌 KV、产品渲染、营销视频、社交媒体素材等),这些资产本身就是对外作品,确保达到行业一线水准。品牌风格的 AI 化沉淀(前瞻性)在落地过程中,逐步构建品牌私有数据集,训练并优化品牌专属的风格模型 / LoRA,使 AI 生成内容能够高效、精准地匹配品牌
Super Sparks-校招-具身智能/机器人研究员(Embodied AI / Robotics Researcher) 上海 校招 正式 数字技术 - 算法 博士及以上 Super Sparks 招聘计划 职位 ID:A258152A 职位描述 -探索具身智能前沿技术,制定技术路线,统筹内部研发方向;-开发、微调视觉-语言-动作(VLA)大模型(如 RT-2、OpenVLA、Groot、pi0 等),实现环境理解、任务分解与动作生成;-设计基于 Transformer、Diffusion Policy 的抓取与运动规划算法,提升操作泛化性;-领导或参与核心算法研究,覆盖具身交互、感知、操作、仿真、训练等方向,提升具身能力与可靠性;-对特定场景使用仿真数据集或模型数据集强化训练,确保操作成功率;-在机器人平台部署 VLA 模型,通过模型量化、推理加速等方式提升整体执行效果;-推动相关工具建设,高效训练与验证部署,加快具身智能的产品化落地。 职位要求 -计算机/机器人/人工智能等相关领域硕士或博士;-精通 Python/C++,掌握 PyTorch/TensorFlow 框架;-深入理解强化学习基本原理与核心算法(PPO、SAC 等)及常用框架;-深入理解大模型(VLM、VLA)开发流程(训练、微调、部署),并有实际项目经历;-深入理解机器人学习算法,具备强化学习用于机器人领域的项目经验;-在顶会(CoRL、ICRA、IROS、CVPR、ICLR 等)发表具身智能或大模型相关论文优先;-具备 OpenVLA、Groot、pi0 等 VLA
提前批-大模型算法工程师(主动安全方向) 上海、北京 校招 正式 数字技术 - 算法 硕士及以上 2027届校园招聘-技术提前批 职位 ID:A31065 职位描述 负责端到端决策模型算法的研发量产工作,主要聚焦于主动安全业务,重点方向包括但不限于。模仿学习(如自回归生成、Diffusion Policy 等)强化学习(涵盖轨迹生成、闭环训练、世界模型等相关技术)一段式端到端模型的研发构建高质量数据集,支持模型迭代优化持续跟踪人工智能领域的前沿技术动态,推动先进算法在量产项目中的实际应用与落地。 职位要求 硕士及以上学历,计算机 / 软件工程 / 人工智能等相关专业。扎实的深度学习算法基础,精通常见的深度学习和机器学习算法。面对未知的领域和问题,有非常强的自学能力,善于通过基本的研究方法对问题本身进行拆解,并找到每个步骤的解决办法。有着良好的团队合作精神,能够同公司内部的不同团队保持合作关系。加分项相关领域的博士研究生。具备端到端路径/轨迹生成相关经验,熟悉主流模仿学习方法,如diffusion,自回归等具备强化学习在轨迹预测、决策规划的相关经验,熟悉主流强化学习方法,如 DQN、DDPG、SAC、PPO、GRPO 等有过相关领域的顶级会议论文发表(CVPR、ICCV、ECCV等等)或在相关领域的学术竞赛(ImageNet、COCO、Kitti、Waymo等等)中取得较好成绩者优先 投递...
优才-具身算法工程师- Genie业务部 上海、北京 校招 正式 职位 ID:A227925 职位描述 1、设计和开发创新性的模仿学习和强化学习算法,应用于人形机器人场景任务,具备泛化能力。2、研究并构建具备视觉、触觉、语言等多模态感知和决策能力的大模型,实现机器人在开放世界中的物理交互。3、优化具身算法模型结构,以支持具身算法的实现和高效运行。4、与跨职能团队合作,推动具身算法在实际场景中的应用。5、撰写技术文档和学术论文,分享研究成果并在技术社区中展示创新技术。 职位要求 1、计算机视觉、多模态大模型等相关领域的硕士或博士;2、精通Python编程语言,熟悉PyTorch、TensorFlow等深度学习框架;3、熟悉机器人模仿学习、强化学习理论,有相关领域有影响力的Paper者优先;4、有ACT、MT-ACT、RT1、RT2、Diffusion Policy等算法相关研究背景经验者优先;5、熟悉LLM/VLM/VLA,了解R3M、RFM、PaLM-E、OpenVLA等多模态具身大模型经验者优先;6、有目标检测、图像分割、视频处理、6D位姿估计、深度估计、立体视觉、3D点云处理、GraspNet、AnyGrasp等研究背景经验者优先;7、有实际的机器人、自动驾驶项目经验者优先。 投递...
具身智能仿真开发工程师-觅蜂子公司 上海 校招 正式 技术族 - 算法类 职位 ID:A153894 职位描述 觅蜂科技(Maniformer)是全球领先的一站式物理AI数据服务平台,致力于打造具身智能数据的 “平台型供给” 基础设施,实现数据的体系化、标准化、规模化供给。1.负责具身智能基础仿真能力和端到端仿真能力研发,支持传感器仿真渲染、物理仿真交互等2.负责机器人本体在仿真中的运动学、动力学模型模拟,以及仿真智能体功能研发3.理解算法与系统等团队仿真工具需求,支持相关仿真工具研发4.负责具身智能仿真real-sim-real算法研究和应用,提升视觉和物理仿真真实性,为具身智能算法提供高保真仿真数据和评测环境5.负责大规模场景的三维重建算法研发和性能优化,提升场景重建的效率和真实度6.调研具身智能仿真相关的最新AIGC算法和技术并落地,突破现有仿真工具的功能瓶颈 职位要求 1.硕士及以上学历,优先计算机科学、数据科学、机器人、人工智能等相关专业2.精通Linux和Docker开发环境,熟悉C++、Python等编程语言,掌握规范git工作流,具备良好编程规范3.精通lsaac Sim/Mujoco//Genesis/Unreal Engine等至少一种仿真软件,能够搭建复杂的仿真场景4.熟悉ROS/DDS/AimRT等机器人系统通信中间件,对机器人传感器系统、机器人操作、运动控制和路径规划有一定了解5.熟悉3D建模和计算机图形学,熟悉基于神经网络的三维重建,如传统3DGS/前馈重建等,有场景重建的实际项目经验者优先6.对数据仿真、数据生成等领域有深入了解。熟悉常见AI生成模型框架,包括VAE/diffusion等。熟悉多模态如CLIP等transformer跨模态表征模型,AIGC等方向实践经验,对深度学习或大模型学习领域有深刻理解 投递...
语义动作生成算法工程师 上海 校招 正式 技术族 - 算法类 职位 ID:A88389 职位描述 结合TTS(文本转语音)的韵律特征(音素时长、基频、能量),生成与语音同步的口型、头部姿态、手势等副语言动作设计多模态对齐机制,确保动作生成与语音合成的节奏、停顿、情感表达精准同步构建语音合成与动作生成的流式协同框架,支持实时对话场景下的低延迟、高同步度输出将算法能力封装为可复用的动作生成SDK/服务,支撑多元业务场景与机器人控制、交互系统团队紧密协作,推动技术方案的产品化落地 职位要求 •计算机、机器人学、图形学、人工智能等相关专业硕士及以上学历,博士优先,相关领域研究或开发经验•扎实的深度学习基础,精通PyTorch,有生成模型(Diffusion、VAE、GAN、Flow-based)的实际项目经验•深入了解动作生成领域,熟悉MotionGPT、HumanML3D、MotionDiffusion、PhysDiff、ASE等代表性工作•熟悉机器人运动学、计算机图形学中的角色动画基础,了解正向/逆向运动学、骨骼动画原理•具备语音合成(TTS)相关基础知识,了解声学模型、声码器、韵律建模熟悉动作表示与处理:SMPL/SMPL-X、BVH、AMC、运动学图(Kinematic Trees)、四元数/旋转矩阵表示加分项•顶级会议期刊论文发表•有真实机器人平台或虚拟人引擎的实际落地经验•熟悉实时动作生成管线,或有游戏/影视动画行业经验•有语音合成(TTS)或语音识别(ASR)的深入研发经验,具备多模态联合训练经验•熟悉物理驱动的动作生成、强化学习(RL)在动作控制中的应用•有开源项目贡献或相关专利 投递...
具身智能算法工程师(训练效率方向)-觅蜂子公司 上海 校招 正式 技术族 - 算法类 职位 ID:A11632 职位描述 觅蜂科技(Maniformer)是全球领先的一站式物理AI数据服务平台,致力于打造具身智能数据的 “平台型供给” 基础设施,实现数据的体系化、标准化、规模化供给。1. 负责具身智能训练效率的度量、分析与系统性优化,覆盖预训练与后训练全链路。2. 深入理解不同模型架构(Transformer / Diffusion / Flow Matching 等)与训练算法(IL/RL/BC 等)的计算特性,针对性设计优化方案。3. 构建训练效率监控体系,包括 GPU 利用率、训练吞吐、通信效率、数据加载延迟等核心指标的可视化与自动化追踪。4. 模型训练效率优化:算子融合、CUDA graph、kernel 调优等,提升单卡和多卡计算效率。5. 并行与通信效率优化:梯度同步、云边通信、权重分发等通信开销分析与优化,支撑百台规模训练不退化。6. 数据加载效率优化:数据预处理 pipeline、IO 吞吐优化,消除数据侧瓶颈。 职位要求 1. 计算机、AI 等相关专业硕士及以上学历。2. 具备扎实的
具身智能算法岗 - VLA方向-智鼎子公司 上海 校招 正式 技术族 - 算法类 职位 ID:A222991 职位描述 参与具身智能 VLA 大模型的研发,涵盖模型架构设计、预训练与后训练/微调全流程; 跟踪并复现业界前沿 VLA 工作(如 π0 / π0.5、RT-2、OpenVLA、RDT、GR00T 等),针对真机场景做算法改进与创新; 参与机器人多模态数据(视觉、语言、本体感知、动作)的采集、清洗、标注与处理 pipeline 建设,构建高质量训练数据集; 负责模型训练、评测与部署,在仿真与真机上完成闭环验证与快速迭代; 探索模仿学习、强化学习、flow matching / diffusion policy 等技术的应用。 职位要求 2026/2025 届应届毕业生,计算机、人工智能、自动化、机器人、电子工程、数学等相关专业,硕士及以上学历; 扎实的机器学习/深度学习基础,熟悉 Transformer、多模态大模型、扩散模型/流匹配等核心原理;
SUN-品牌创意策划 广州 美术类 职位描述 1、负责IP产品营销物料的内容与视觉创意策划、设计执行及产出把控;2、与IP与美术环节(演出/动画/角色美术等)、市场营销团队、外部供应商紧密协作,推进项目落地;3、产出内容包括视觉/平面创意策划案、Mood Board、脚本/风格需求文档、动态分镜(Animatic)及相关反馈、复盘文档;4、持续钻研多元视觉风格与表现技法,结合产品调性,推动创意在宣发物料中的落地实施;5、挖掘、评估并维护外部视觉创意供应商/合作伙伴资源,建立稳定的合作网络。 职位要求 1、3年以上游戏视觉创意/内容策划相关经验,有大DAU、高在线产品经验者优先;2、具备扎实的美术功底与独立审美判断,对内容创意和IP调性有较强敏感度;3、深度游戏玩家,对主流游戏品类有独立见解和内容审美(可根据产品品类具体标注,如二次元/开放世界/竞技等);4、熟悉B站、抖音、TapTap、YouTube等主流内容发布平台的内容形式与调性差异;5、熟练使用PS、AI、AE、PR等设计/剪辑软件,了解Midjourney、Stable Diffusion等AI绘图工具者优先;6、具备良好的跨部门沟通协作与项目推进能力,能在多方协作中把控创意质量与进度;7、需提交个人作品集,注明本人在项目中负责的具体部分。加分项有IP内容、动画短片或宣发大片制作经验;有外部供应商资源库或长期合作经验。 投递...
CG实验艺术家(Generative AI / 动画方向) 广州 美术类 职位描述 1、熟练运用 ComfyUI、Stable Diffusion、Midjourney、Runway、Seedance、Pika、Kling、Luma、Sora(或同类视频生成工具)等主流生成式 AI 工具,根据剧本、分镜、故事大纲或导演创意,高效产出概念设计图、角色探索稿、风格参考帧、镜头气氛图及场景环境设计; 2、持续跟踪并实验评估行业最新生成式 AI 技术与工作流,包括图像生成、视频生成、3D生成、动作生成、语音与多模态方向,在项目全周期内积极测试并验证新技术的实际制作价值; 3、 结合生成式 AI 与 Photoshop、Maya、Houdini、Blender、Cinema 4D、Harmony、Substance Painter、ZBrush 等传统 DCC 软件,制作可直接进入镜头流程的高质量资产,包括角色、道具、环境、特效与动画内容; 4、负责图像模型、视频模型及风格模型的搭建、训练、微调与优化,包括 LoRA、ControlNet、IPAdapter、Flux、SDXL、Wan、AnimateDiff 等技术方向,提升模型输出质量、稳定性与风格统一性; 5、 系统性测试不同 AI 工具、模型与混合工作流方案,输出标准化实验报告、技术文档及最佳实践建议,推动团队 AI 制作能力持续升级; 6、 与导演组、制片组、技术美术(TA)、动画团队及研发团队协同,共同开发 Generative
大模型推理架构师 上海 社招 全职 互联网 / 电子 / 网游 职位描述 1. 参与 Soul 大模型、多模态模型、推荐模型等核心 AI 任务的训练与推理基础设施建设,提升模型从实验到线上部署的整体效率。2. 负责大规模分布式训练系统的性能优化,包括数据并行、张量并行、流水线并行、专家并行、参数/梯度/优化器状态切分、显存优化、通信调度等方向,提升 GPU/NPU 集群利用率。3. 参与高性能推理引擎建设,围绕大模型在线服务中的低延迟、高吞吐、弹性扩缩容、多租户隔离、KV Cache 管理、批处理调度、量化部署等问题进行系统优化。4. 针对 Soul 的实时社交、多模态内容理解、AIGC 互动等场景,设计和优化端到端 AI 系统架构,降低训练和推理成本,保障核心业务的稳定性和体验质量。5. 参与异构计算算子优化和计算图优化,包括 CUDA、Triton、CUTLASS、Ascend C、TileLang 等方向,针对 Attention、MoE、Embedding、推荐模型特征交互、多模态编码等关键模块进行性能调优。6. 参与 AI 编译器和模型编译优化相关工作,围绕
算法实习生(智驾大模型) 上海、北京 实习 互联网 / 电子 / 网游 日常实习生 职位描述 1.端到端模型研发: 负责新一代 End-to-End 自动驾驶算法的研发,包括但不限于基于 World Model(世界模型)、Video Generation(视频生成) 或 VLM(视觉语言模型) 的驾驶策略生成。2.模型架构探索: 探索 Transformer、State-space Model (如 Mamba)、Diffusion Model 、IL/RL在轨迹预测与决策规划中的应用,验证 Scaling Law 在自动驾驶规控领域的有效性。3.数据闭环与评测: 搭建针对生成式规划算法的自动化评测体系,利用大模型进行数据挖掘、自动标注(Auto-labeling)及场景重建,通过数据闭环持续提升模型性能。 职位要求 基础要求:1.在读硕士 / 博士,计算机、人工智能、自动化等相关专业2.熟悉 Python,具备扎实的编程能力3.了解深度学习基础,熟悉 PyTorch
端到端大模型算法实习生 急招 北京 实习 互联网 / 电子 / 网游 - 研发 日常实习生 职位描述 1.负责端到端智驾大模型的算法预研、算法突破与验证工作;2.基于端到端大模型,进行世界模型算法预研,提升端到端模型效果和泛化性。 职位要求 1.计算机、人工智能、自动化、机器人等相关专业硕士及以上学历;2.熟练掌握 Python/C++,精通 PyTorch 等主流深度学习框架,具备良好的数学基础(线性代数、概率论、最优化);3.熟悉端到端自动驾驶技术栈(如 UniAD、SparseDrive、VAD、DriveVLM 等),理解感知-预测-规划一体化建模方法;4.深入理解 Transformer、Diffusion Model、自回归生成模型等主流架构,有 World Model(如 JEPA、UniSim、DriveDreamer、GAIA、WoVogen 等)研发或复现经验;5.有 BEV/OCC 感知、时序建模、轨迹预测或运动规划模块落地经验者优先。加分项1.在 CVPR、ICCV、ECCV、NeurIPS、ICLR、ICML、CoRL、ICRA 等顶级会议或期刊发表过相关方向一作/共一论文;2.有 ACM/ICPC、RoboMaster、RoboCup 等顶尖赛事获奖经历;3.有端到端模型车端部署(TensorRT/ONNX/量化)或仿真闭环(nuPlan/CARLA/Waymax)实战经验。 投递...
提前批-世界模型算法工程师 上海 校招 正式 数字技术 - 算法 硕士及以上 2027届校园招聘-技术提前批 职位 ID:A252148 职位描述 1. 参与视觉大模型的训练、调参与性能优化,包括 diffusion / autoregressive / latent dynamics 等范式;2. 基于模型结果与中间表征进行效果分析,定位问题(如时序不一致、结构崩塌、motion drift 等)并提出改进方案;3. 参与模型实验设计与评估体系建设(如 FVD、IS、CLIP-score、temporal consistency 等),完成结果分析与对比;4. 支持数据闭环,包括视频数据清洗、标注策略设计、数据分布分析及对模型能力的影响评估;5. 隐式3D建模、时空建模等学术前沿方向论文、方案跟进(spatio-temporal modeling、camera/control建模等) 职位要求 教育背景硕士及以上学历,2027届应届生,计算机/软件/AI/自动化/电子等相关专业必备能力Linux/Git:熟练Linux开发环境,熟悉Git及CI/CD基本流程C++:熟悉C++11/14/17标准,掌握内存模型、智能指针、STL、多线程编程Python:熟悉多进程/多线程/协程,理解GIL与内存管理机制PyTorch:熟悉PyTorch及分布式训练基本概念,有课程/项目实操经历加分项CUDA/GPU加速实践经历了解LMDB/Arrow/WebDataset等数据格式了解DDP/FSDP/DeepSpeed/Megatron等分布式策略接触过Perf/Nsight/Triton / ASan等性能工具有训练框架阅读或小改动经历有智能辅助驾驶/机器人/大模型训练相关项目或竞赛经历 投递...
提前批-车端大模型与世界模型系统架构工程师 上海 校招 正式 数字技术 - 软件测试 博士及以上 2027届校园招聘-技术提前批 职位 ID:A159991A 职位描述 岗位定位我们正在建设下一代智能汽车 AI 计算与系统架构。未来车端将同时承载智能辅助驾驶世界模型、VLA / VLM 模型、座舱多模态大模型、车端 Agent、安全 Agent 等多类 AI 工作负载。架构团队不直接以训练模型为唯一目标,而是负责把模型能力、模型演进趋势和业务体验目标,转化为芯片、OS、内存、存储、通信、隔离、数据闭环和软件平台的系统架构设计。我们希望招聘具备大模型后训练、世界模型或 VLA 模型背景的博士校招生,成为 AI 模型团队和整车系统架构团队之间的桥梁。你将负责跟踪和理解大模型后训练、强化学习、偏好对齐、多模态模型、世界模型、VLA / VLM 等方向的技术演进,判断其对车端系统架构的影响。将模型需求转化为可落地的系统架构指标,包括但不限于算力、显存 / 内存容量、内存带宽、KV cache、上下文长度、模型并发、模型隔离、端侧推理延迟、功耗和热设计约束。面向智能辅助驾驶、智能座舱、车端 Agent 等场景,参与设计下一代车端 AI
具身算法研究员 上海 校招 正式 职位 ID:A154653 职位描述 1、设计和开发创新性的模仿学习和强化学习算法,应用于人形机器人场景任务,具备泛化能力2、研究并构建具备视觉、触觉、语言等多模态感知和决策能力的大模型,实现机器人在开放世界中的物理交互。3、优化具身算法模型结构,以支持具身算法的实现和高效运行。4、与跨职能团队合作,推动具身算法在实际场景中的应用5、撰写技术文档和学术论文,分享研究成果并在技术社区中展示创新技术。 职位要求 1、计算机视觉、多模态大模型等相关领域博士2、精通Python编程语言,熟悉PyTorch、TensorFlow等深度学习框架3、熟悉机器人模仿学习、强化学习理论,有相关领域有影响力的Paper者优先4、有ACT、MT-ACT、RT1、RT2、Diffusion Policy等算法相关研究背景经验者优先5、熟悉LLM/VLM/VLA,了解R3M、RFM、PaLM-E、OpenVLA等多模态具身大模型经验者优先6、有实际的机器人、自动驾驶项目经验者优先。 投递...
灵巧手算法研究员 上海、北京 校招 正式 职位 ID:A166756 职位描述 根据需求完成算法开发与代码维护,协助测试团队优化算法性能。开展算法在真机环境的性能对比测试;探索具身智能领域前沿灵巧手操作算法,掌握最新技术趋势,进行创新研究;构建具身智能领域灵巧手操作模型,优化并提升算法能力;推进灵巧手在具身智能领域的应用落地。 职位要求 机器人、计算机视觉、多模态模型等相关领域博士;有大语言模型/视觉模型/多模态大模型预训练/后训练/微调研发经验,如llava/llama/vit/diffusion等模型架构;熟悉机器人相关的模仿学习或强化学习算法,有灵巧手算法经验者优先;有实际机器人项目经验者,具备机械臂、相机、灵巧手等硬件调试经验者优先;一作顶会/顶刊论文发表者优先,包括不仅限rss/icra/iros/corl/neurips/icml/iclr/cvpr/eccv/iccv等;工作积极主动,具备良好的团队合作与问题解决能力。 投递...