智能辅助驾驶算法工程师(端到端模型 / 强化学习) AD内推 蔚来自动驾驶研发团队 北京 社招 全职 数字技术 - 算法 硕士及以上 3-5 年 职位描述 负责端到端智能辅助驾驶轨迹生成算法的研发与优化,重点方向包括但不限于:端到端模仿学习(如 VLA/世界模型、自回归生成、Diffusion Policy 等);强化学习(涵盖轨迹生成、闭环训练、世界模型等相关技术)。持续跟踪人工智能领域的前沿技术动态,推动先进算法在量产项目中的实际应用与落地。 职位要求 硕士及以上学历,计算机、软件工程、人工智能或相关专业;具备扎实的深度学习理论基础,熟悉常见深度学习与机器学习算法;熟练掌握至少一种主流深度学习框架,具有 TensorFlow 或 PyTorch 深度开发经验者优先。【加分项】①具备端到端路径/轨迹生成相关经验,熟悉以下任一方向者优先:主流模仿学习方法(如行为克隆);主流 BEV 任务(如动态/静态目标检测与跟踪等);时序建模方法(RNN/LSTM/GRU等)。②具备强化学习相关经验,熟悉以下任一方向者优先:主流 RL 算法(如 DQN、DDPG、SAC、PPO、GRPO 等);强化学习在轨迹预测、决策规划或仿真环境中的应用;世界模型(World Model)、模型预测控制(MPC)或基于强化学习的闭环仿真技术。③具备 VLA/VLN/世界模型等相关项目实践经验,熟悉以下任一方向者优先:主流 VLA 方法(如 OpenVLA、PAI0 等);主流世界模型方法(如
世界模型研发工程师 北京、上海、苏州 社招 全职 互联网 / 电子 / 网游 职位描述 负责自动驾驶领域世界模型(World Model)相关算法设计,推进世界模型在闭环仿真、稀有数据生成、端到端闭环训练等领域的落地和应用;负责模型训练与工程实现,搭建并优化大规模训练pipeline,包括数居集处理、训练加速、推理加速等,并建设模型评估体系(fidelity, controllability,consistency,generalization) 职位要求 计算机、自动化、人工智能、电子工程、数学等相关专业硕士上及以上学历,有良好的数理基础,熟悉概率论线性代数、优化理论等数学基础;熟悉深度学习原理,熟练Pytorch框架,分布式训练,良好的工程实现能力和代码规范;有3DGS、Diffusion、视频生成等领域的算法研发和落地经验:具备较强的学习能力,逻辑及沟通能力,问题分析解决能力,以及良好的团队合作精神;有自动驾驶相关研发经验、视频生成研发经验或有相关论文者优先 投递...
作为一名凯谛思人,您已经帮助我们为自然环境和建筑资产提供了世界领先的可持续设计、工程和咨询解决方案。我们的全球业务在30多个国家拥有约34000多名员工致力于提高生活质量,而您是其中一员。每一位员工对我们都至关重要。我们集思广益,可以共同解决世界上最复杂的挑战以及发挥更大的影响力。 岗位职责 -商业空间视觉生成:深度参与商业综合体、零售空间及办公园区等项目的建筑与室内方案,熟练运用AI工具进行概念发散、场景渲染及视觉表达,精准传达商业空间的设计意图。 -前沿技术工作流落地:作为团队的“AI技术先锋”,持续研究并测试最新的AIGC工具流,将新技术有效融入商业设计生产环节,提升前期提案效率与效果图表现力。 -商业文本排版与包装:基于良好的平面设计基础,负责商业项目汇报文本的版式设计、信息梳理及多媒体视觉包装,确保最终交付物兼具商业逻辑与高级审美。 -资产库建设:协助建立并优化团队内部的AI提示词库、商业风格模型及高质量素材资产,沉淀团队技术经验。 任职要求: -专业背景不限:我们看重你的审美潜力、学习能力以及对新技术的热情,建筑、室内、平面、数字媒体甚至跨专业爱好者均可投递。 -AI工具重度玩家:对AIGC领域有浓厚兴趣或深入研究,熟练掌握Stable Diffusion、Midjourney、ComfyUI等主流AI绘图工具,有实际项目应用案例或丰富的个人实验作品者优先。 -扎实的设计软件功底:熟练使用常规设计软件,具备良好的空间理解力或图形处理能力。 -优秀的平面审美:具备扎实的平面设计基础,对版式、色彩、字体及信息层级-有敏锐的感知力,能独立完成高水准的商业汇报排版。 -自驱力与好奇心:保持对行业新技术的敏感度,乐于分享,愿意在快节奏环境中不断探索AI设计的边界。 作为凯谛思人,继续实践您的职业生涯 只有每个人都全力以赴,我们才可能达到我们的目标。我们坚信每个人的贡献都很重要。因此,我们倡导基于技能的晋升途径,您可以利用您个人经验和专业知识来开拓您的职业道路,并和我们一起创造出最大的影响力。 您正在参与有意义的工作,无论下一个凯谛思职位带您往何处,您也将会帮助提供可持续的解决方案以令地球更繁荣。 在您的职业生涯、您的同事、您的客户、您的生活和您周围的世界上,留下您的印记。 我们可以一起创造传奇! 我们对平等、多样性、包容性和归属感的承诺 我们希望您每天都能在工作中展现最好的自己,这就是我们认真对待平等和包容并让自己为自己的行为负责的原因。我们的目标是成为首选雇主,并为所有员工提供理想的工作场所。在 Arcadis,您将有机会建立适合您的职业。因为每个凯谛思人都有自己的动机,自己的职业目标。而且,作为“以人为本”的企业,这就是为什么我们会花时间倾听,了解您在此期间想要什么,并提供您实现抱负所需的支持。...
大模型训练加速工程师 / 高级专家 北京 全职 通用智能板块 职位描述 【岗位职责】训练加速与优化: 负责大模型训练场景下的性能分析 (Profiling) 与全链路优化,包括显存管理、计算加速及通信优化 (NCCL),提升集群训练吞吐率。算子开发与协同设计 (Co-design): 负责高性能算子 (Kernel) 的开发与调优;与算法团队紧密协作,针对特定模型结构(如 Transformer, MoE)进行定制化算子设计。分布式框架建设: 基于 Megatron-LM, DeepSpeed, FSDP 等框架进行二次开发与优化,设计适应大规模集群的并行训练方案。稳定性保障: 负责大规模训练过程中的问题定位与解决,包括但不限于 NCCL 超时、显存溢出 (OOM)、训练速度波动等,保障训练任务的高效稳定运行。 职位要求 理论基础: 计算机基础扎实,深刻理解深度学习训练原理(计算图、自动微分、混合精度),熟悉主流并行策略及 FlashAttention 等加速算法。编程能力: 熟练掌握 Python/C++,熟悉 GPU 编程模型,具备
Company Description At Canva, were building a future powered by AI thats as magical as it is impactful. As an LLM Agent Research Scientist at Canva, youll advance the frontier of agentic AI—building autonomous systems that
Company Description At Canva, were building a future powered by AI thats as magical as it is impactful. As a Research Scientist at Canva, youll be responsible for advancing the future of AI by experimenting with
SummaryIf you are passionate about advancing video generation, building state-of-the-art models that synthesize high-quality and controllable video, and optimizing them for on-device deployment, Apple is the right place for you. We are looking for engineers who
SummaryIf you are passionate about advancing video understanding, video generation, and photography intelligence, and are driven to pursue excellence, embrace challenges, collaborate with others, and learn new things along the way, Apple is the right place
Company Description At Canva, were building a future powered by AI thats as magical as it is impactful. As a Research Scientist at Canva, youll be responsible for advancing the future of AI by experimenting with
世界模型算法专家—视频生成方向 北京 全职 互联网 / 电子 / 网游 职位描述 岗位定位: 对标Seed、Kling等顶尖视频生成团队,负责自研视频生成大模型与世界模型的从0到1构建,打造具备物理规律真实、时空一致性、高可控性的下一代视觉智能底座。岗位职责核心模型研发:负责大规模视频生成模型(DiT、MMDiT架构)及世界模型的算法设计与训练,重点突破长视频时序连贯性、物体运动物理规律建模与多视角空间一致性等核心难题。前沿技术攻关:探索基于Diffusion Transformer、Flow Matching及RLHF的后训练算法,解决视频生成中的“幻觉”问题,构建具备可交互、可编辑的物理世界仿真引擎。工程落地与优化:主导视频生成模型在千卡/万卡级GPU集群上的大规模预训练、分布式微调及推理优化,攻克高分辨率(如1080p/4K)视频生成的高成本与低效率瓶颈。技术对标与超越:深度分析并跟进业内顶尖模型(如Seedance、Kling、Veo、Sora)的技术路线,制定具有差异化竞争优势的自研技术演进路线。 职位要求 任职要求教育背景:计算机科学、人工智能、数学或相关专业,硕士及以上学历(博士优先)。硬核技术栈:精通PyTorch等主流深度学习框架,具备极强的分布式训练调优能力与工程落地能力。深入理解Stable Diffusion、DiT、MMDiT、VAE、Flow-based Models等生成模型原理,必须有大规模(千万级参数以上)视频生成模型从0到1的预训练或深度调优经验。熟悉ControlNet、IP-Adapter、AnimateDiff等可控生成与视频编辑技术。业务洞察(加分项):熟悉Seedance、Kling、Veo等SOTA模型的技术特点与优缺点,并有基于此类模型进行逆向优化或二次开发的实践经验。学术影响力:在CVPR、ICCV、NeurIPS、SIGGRAPH等顶会发表过生成模型/视频理解相关一作论文者优先。加分项有自动驾驶、游戏物理引擎或具身智能领域世界模型研发经验;熟悉NeRF、3D Gaussian Splatting(3DGS)等3D重建与渲染技术;拥有开源重量级视频生成项目或参加过国际级AI竞赛并获奖。 投递...
自动驾驶基座模型(世界模型方向) 北京 社招 全职 职位 ID:A49702A 职位描述 负责World Action Model在自动驾驶场景中的前沿算法研究,;参与World Action Model模型开发,数据闭环构建和创新型技术研发,为下一代自动驾驶技术提供基础支撑; 职位要求 教育背景:计算机科学、人工智能、机器人学、自动驾驶或相关领域的博士学位,或具备等效的研究经验;世界模型,视觉表征学习,视觉自监督算法研究经验;对DIffusion-based和AE-based视频生成模型的原理有深刻的理解理论与实践能力:扎实的机器学习、深度学习理论基础,具有视觉理解、自然语言处理与行为决策的交叉领域研究背景;编程能力:熟练掌握Python及主流深度学习框架(如PyTorch、TensorFlow等),有高效模型训练与大规模数据处理经验;学术能力:具有在国际顶级会议(NeurIPS、ICLR、CVPR、ICCV等)上发表过论文的经验,或参与过具有影响力的学术竞赛(如COCO、Kitti、nuScenes等);跨学科能力:具备跨学科协作能力,能够有效将计算机视觉、自然语言处理与机器人学的知识融合,推动自动驾驶机器人领域的创新;加分项:在大规模视觉预训练模型训练、蒸馏等方面有深入研究;具有实际项目经验,熟悉典型的算法V-JEPA, DINO系列;具有自动驾驶平台(如CARLA、Waymo、nuScenes等)上的实验经验。 投递...
机器人物理角色动画算法工程师 北京 社招 全职 职位 ID:A148547 职位描述 1. 负责机器人物理角色动画数据生成; 2. 负责算法移植到机器人上并完成相应的功能实机验证; 3. 持续跟踪国内外计算机图形学前沿研究成果,并进行相关算法复现。 职位要求 1. 硕士及以上学历,计算机图形学、人工智能、机器学习、机器人、应用数学等专业,理论功底深厚,有相关足式机器人控制经验更优; 2. 扎实的数学基础,精通线性代数,优化方法,统计理论等,并熟悉这些技术在计算机图形学/3D视觉中的应用;3. 掌握诸如MDM、priorMDM、MLD、MoFusion等主流角色动画生成算法,对Diffusion、Transformer等基础算法具有深入的理解;4. 扎实的C++、python编程能力;5. 熟悉NVIDIA Isaac 平台使用,可以处理大规模数据,利用PyTorch、TensorFlow等框架进行大规模训练;6. 了解3D建模软件(例如Maya,3DS Max, Blender)的使用,熟悉常用的3D模型格式;7. 在相关领域的期刊/会议上以一作身份发表过文章,例如SIGGRAPH/TVCG/PAMI/IJCV/CVPR/ICCV/ECCV者优先。 投递...
音乐生成高级算法工程师 北京 社招 全职 职位 ID:A105118 职位描述 1. 算法研发: - 设计并优化基于深度学习(如Transformer、Diffusion、GAN、VAE等)的音乐生成模型,涵盖旋律、和声、节奏、音色等多维度生成任务。 - 探索多模态音乐生成(如文本/图像/视频驱动音乐创作、哼唱转谱等)。 - 研究音乐符号(MIDI/乐谱)与音频(波形/频谱)的联合建模技术。2. 工程落地: - 将算法部署到生产环境,优化推理效率(模型压缩、蒸馏、边缘端适配)。 - 构建高质量音乐数据集,设计数据清洗、标注与评估流程。3. 跨领域协作: - 与音乐制作人合作调试生成结果的艺术性,平衡“可控性”与“创造性”。 - 参与产品需求定义,将技术转化为用户可感知的音乐创作工具。 职位要求 - 计算机科学、人工智能、信号处理、音乐技术等相关专业本科及以上学历。- 熟悉Pytorch等深度学习框架,具备4年以上序列建模或多模态生成经验。- 熟悉音乐理论(和声/调式/节奏)或具备数字音频处理(DSP)基础,能解读乐谱/MIDI。- 主导过1个以上音乐AI项目(如旋律生成、歌声合成、风格迁移等)的完整生命周期。加分项:- 发表过ICLR/NeurIPS/ISMIR等顶会论文,或拥有音乐生成相关专利。- 精通音频信号处理(STFT、CQT、声码器如HiFi-GAN、NSF)。- 熟悉音乐制作工具(Ableton Live、Logic Pro)或DAW插件开发(VST/AU)。- 参与过开源音乐AI项目(如Magenta、Jukebox、MusicLM)。
机器人具身智能算法工程师(技术预研方向) 北京 社招 全职 职位 ID:A144931 职位描述 1. 参与具身智能算法模型在技能学习、动作规划、抓取操作等应用上的研发,实现多场景多任务的泛化;2. 设计、训练、部署模仿学习、强化学习、迁移学习、多模态学习等算法,构建机器人各类应用的通用技能;3. 与大模型、运控等团队合作,推动具身智能数据集、机器人平台等各项目落地实施;4. 紧跟最新技术进展,将学术界前沿创新内容进行快速复现并创新,参与相关方向的论文与专利积累。 职位要求 1. 硕士及以上学历,机器人、计算机、人工智能、机器学习、应用数学等专业,理论功底深厚,有机器人、机械臂、自动驾驶、大模型从业经历者优先;2. 掌握机器人操作快慢双系统设计理念(VLM+VLA),掌握相关ACT/Diffusion Policy/RDT/Pi0等基础算法,有相关GROOT、AgiBot GO1、Helix等模型实施经验者优先;3. 在多模态模型、自监督学习、迁移学习、强化学习、知识蒸馏、CoT等方向具备 SOTA 项目经验或具备坚实知识基础;4. 扎实的Python、C++编程能力,熟悉Pytorch、TensorFlow机器学习框架,掌握规范 git 工作流;5. 有创新的想法,乐于接受技术挑战,具备相关英文读写能力。 投递...
AIGC导演实习生(视觉方向) 北京 校招 实习 内容制作 - 导演 日常实习生招聘 职位 ID:A169763 职位描述 -协助AIGC导演完成项目的视觉风格探索与美术方向执行,参与角色设计、场景构建、色彩氛围、关键帧绘制等视觉环节的AI辅助创作;-运用Stable Diffusion、Midjourney、ComfyUI等AIGC工具进行概念图、风格参考、视觉素材的生成与迭代,协助建立风格控制与角色一致性方案;-参与AI视觉生产流程的搭建与优化,协助整理模型训练、LoRA微调、提示词模板等视觉资产,提升美术环节的生成效率与质量稳定性;-配合导演、美术、技术团队完成视觉创意与故事表达、角色塑造、情绪氛围的协同落地,确保视觉呈现符合项目要求;-参与视觉素材的整理、归档与版本管理,协助完成项目美术资产的规范化沉淀。 职位要求 -动画、数字媒体、影视、美术、设计等相关专业在读本科或研究生,具备扎实的美术基础与审美能力,对构图、色彩、光影、造型有基本认知;-熟悉主流AIGC视觉工具,有实际作品产出经验,了解提示词工程、ControlNet应用或LoRA训练者优先;-对动画、影视、游戏等数字内容领域有浓厚兴趣,关注视觉趋势与AIGC技术发展,具备快速学习与主动探索能力;-具备良好的沟通协作能力与责任心,能够在快节奏项目中高效执行任务。注:投递时请上传AI短片作品,若为小组共创,请在描述中注明本人负责的环节与部分。请勿上传非AI辅助创作作品,请勿上传非AI辅助创作作品,请勿上传非AI辅助创作作品。 投递...
具身世界模型推理INFRA工程师 - XiaomiRobotics 北京 社招 全职 职位 ID:A258619 职位描述 对具身世界模型进行推理阶段的加速,包括Multi-Token-Prediction在推理端的适配、张量并行和专家并行在推理框架的适配、CFG并行适配、模型的FP8量化和NVF4量化等,与算法团队协作优化最终上线/开源模型的推理速率 职位要求 硕士及以上学历有丰富的Diffusion模型和多模态AR大模型推理加速经验参与多模态大模型/视频模型的推理加速和商业化落地 投递...
ITP 设计负责人 北京 社招 全职 职位 ID:A76313 职位描述 一、产品设计统筹主导 ITP 平台全线产品的设计策略制定与落地,包括云平台、数据中台、AI 平台、MiMo产品矩阵等方向重点参与MiMo 大模型业务的 MaaS平台、Agent 产品等方向的设计工作建立并持续迭代平台级设计规范与组件库,确保跨模块、跨端的体验一致性深度参与产品规划与需求评审,从设计视角驱动产品决策,平衡用户体验与技术实现成本管理设计团队日常工作,合理分配资源,把控交付质量与节奏二、AI 驱动设计创新探索并落地 AI 辅助设计工作流(如 AI 生成设计方案、智能布局、自动化设计走查等),提升设计效率主导平台产品体系中 AI 相关功能的产品设计,包括 AI 对话交互、智能推荐、自动化工作流等场景的体验定义关注 LLM/Agent/Multimodal 等前沿技术在 B 端产品中的应用趋势,持续输出设计洞察与落地方案与算法、工程团队紧密协作,推动 AI 能力从原型到产品化的体验闭环三、团队与协作搭建并培养设计团队,建立人才梯队,营造追求极致的团队文化与产品经理、前后端工程师、数据团队高效协同,建立顺畅的跨职能协作机制推动设计评审、用户调研、可用性测试等流程的规范化运作 职位要求 本科及以上学历,设计类、计算机类、人机交互等相关专业优先8 年以上互联网产品设计经验,3 年以上设计团队管理经验有 B 端平台
大模型推理优化工程师 北京 社招 全职 职位 ID:A234561 职位描述 1. 负责图像/视频/多模态等方向AIGC大模型推理加速研究,包括模型蒸馏、模型量化、模型剪枝、推理加速框架移植等2.实现高性能LLM/VLM/AIGC模型推理引擎,优化计算图编译、动态Batching及KV Cache管理,打造极致低延迟与高吞吐的线上服务架构3.续跟进业界最新的Infra技术(如FlashAttention演进、高效通信库、FP8/INT8量化、稀疏蒸馏等训练部署方案),配合实际业务驱动技术预研并转化为生产力 职位要求 1、本科及以上学历,计算机相关专业优先,熟练掌握C++/Python,精通数据结构与算法,并有并发编程基础;2、熟练使用PyTorch/TensorFlow或其他深度学习框架,熟练掌握深度学习性能加速技术包括但不限于算子性能优化,通信优化等;3、具有AIGC(VLM、Diffusion)模型训练/推理优化经验,熟悉TensorRT-LLM、vLLM、LightX2V等推理效率优化工具;4、熟悉大模型蒸馏、量化、剪枝等常用压缩技术,熟练使用常见推理加速工具,如TensorRT、vLLM等;5、积极主动有热情,具备较强的沟通能力以及优秀的团队协作能力 投递...
机器人VLA算法研究员 - XiaomiRobotics 北京 社招 全职 职位 ID:A237923 职位描述 1. 研究并构建融合世界建模和动作生成的 VLA 模型2. 结合机器人数据、视频数据、视觉语言数据等,构建可扩展的数据引擎和训练pipeline3. 开展大规模的 VLA 训练,建立真实可靠的评测系统,持续迭代模型能力提升 职位要求 1、硕士及以上学历,计算机、人工智能、机器人、自动化、数学等相关专业,具备扎实的机器学习、深度学习和概率建模基础。 2、熟悉具身智能、多模态大模型、视频生成或动作生成等方向,理解主流方法原理与适用场景,如Transformer、Diffusion、VAE、VQ、MoE等。 3、具备较强的算法研发能力,熟练使用PyTorch等深度学习框架,有从模型设计、训练调优到实验分析的完整研发经验。 4、熟悉多模态数据建模,理解图像、视频、语言、动作轨迹等数据在训练与评测中的关键问题,有跨模态建模或生成任务经验者优先。 5、在机器人、具身智能、多模态、生成式AI等方向顶会/顶刊(如RSS、CoRL、ICRA、CVPR、ICCV、NeurIPS、ICLR等)发表论文,或有代表性开源项目/研究成果者优先。 6、具备优秀的问题分析与科研协作能力,对具身智能方向有强烈兴趣,能够快速学习并验证。 投递...
端到端大模型算法实习生 急招 北京 实习 互联网 / 电子 / 网游 - 研发 日常实习生 职位描述 1.负责端到端智驾大模型的算法预研、算法突破与验证工作;2.基于端到端大模型,进行世界模型算法预研,提升端到端模型效果和泛化性。 职位要求 1.计算机、人工智能、自动化、机器人等相关专业硕士及以上学历;2.熟练掌握 Python/C++,精通 PyTorch 等主流深度学习框架,具备良好的数学基础(线性代数、概率论、最优化);3.熟悉端到端自动驾驶技术栈(如 UniAD、SparseDrive、VAD、DriveVLM 等),理解感知-预测-规划一体化建模方法;4.深入理解 Transformer、Diffusion Model、自回归生成模型等主流架构,有 World Model(如 JEPA、UniSim、DriveDreamer、GAIA、WoVogen 等)研发或复现经验;5.有 BEV/OCC 感知、时序建模、轨迹预测或运动规划模块落地经验者优先。加分项1.在 CVPR、ICCV、ECCV、NeurIPS、ICLR、ICML、CoRL、ICRA 等顶级会议或期刊发表过相关方向一作/共一论文;2.有 ACM/ICPC、RoboMaster、RoboCup 等顶尖赛事获奖经历;3.有端到端模型车端部署(TensorRT/ONNX/量化)或仿真闭环(nuPlan/CARLA/Waymax)实战经验。 投递...