具身数据算法工程师 (博士) Hangzhou Intelligent manufacturing / Industrial Internet / Industrial automation 26届航海计划 Responsibilities 1.推进机器人多模态大模型(VLM/VLA)、3D感知算法的工程化落地:涵盖预训练、微调、训练加速和效果调优。2.基于issac sim搭建仿真环境验证操作模型,设计real2sim2real迁移框架,加速算法验证与落地。3.具身智能算法研发,包括不同数据配比/网络结构/本体构型,在toC场景完成长序列任务和技能泛化。4.研发自动化标注算法(2D/3D/VLA等),降低标注成本和提升标注质量。5.设计多模态数据(图像、视频和点云等)生成算法,增强数据多样性。 Qualifications 1. 2025-2026应届博士毕业生,计算机、人工智能、自动化、机械电子等专业;2. 有机械臂/机械狗的感知、决策、规划、控制等若干领域的算法实践和优化经验;3. 熟悉Transformer、BERT、GPT等模型,熟悉预训练和微调流程,具有相关的工作经验;4. 有ACT、Diffusion Policy、OpenVLA、RDT、Pi0等相关算法研究背景经验者优先;5. 熟悉掌握C/C++,python等编程语言,熟悉ros/ros2系统,熟悉pytorch、tensorflow等深度学习框架。加分项:1. 具备扎实的工程能力,有较强的创新意识和自驱意识。2. 熟悉常见开源VLA算法的实现,有微调部署、实机调试经验,对VLA技术路线有个人见解。在机器人/智能驾驶/计算机视觉领域有顶会论文或竞赛获奖经历(Kaggle、阿里云天池等)。 Apply...
AI分镜师(杭州) 杭州 社招 全职 互联网 / 电子 / 网游 职位描述 1. 剧本拆解与资产清单:接收组长优化批注后的剧本,完成全片分镜拆解,输出标准化分镜表——含景别、画面描述、角色动作与情绪、对白标注、预估时长、关键视觉元素。输出角色资产列表(角色名/外貌特征/服饰风格/出现场次)、场景资产列表(场景描述/风格方向/复用场次),确保可执行、可复用于多镜。提交组长做前置审核。2. 资产协同生产:双人分工协作生成统一风格的角色立绘、场景图、关键道具等视觉资产,提前对齐风格参数与 prompt 模板,避免产出风格分裂。3. 逐镜画面生成:按分镜表分工逐镜产出画面素材(含关键帧与过渡帧),每镜至少保证2-3个可选用素材,为剪辑端预留充足空间。4. 导演思维应用(精品化核心环节):分镜出图时主动判断景别切换节奏、机位逻辑、视线方向匹配。对光影方向做统一管控——根据组长设定的光影参考标准,确保同场次画面光源方向、色温、影调一致。标注每镜的画面意图说明(该镜想传达的情绪/信息),便于剪辑师理解创作意图。5. 粗剪输出:对各自负责场次的素材做初步审查,合并为完整粗剪提交组长中期验收。粗剪需保证:素材可用率≥85%(画面质量、角色一致性、光影连贯性达标)。剪辑冗余空间充足(每镜素材不少于2个备选,关键情绪镜不少于3个备选)。6. 素材补产:接收组长中期验收意见及剪辑师反馈,对缺失或不合格分镜做补充迭代。 职位要求 1年以上AI图像/视频生成实操经验,熟练使用 Midjourney / Stable Diffusion / ComfyUI / Runway / Pika 等工具中的至少2项。具备导演思维(此为硬性要求):懂分镜语言、景别切换节奏、画面构图、光影逻辑,能在生成阶段带着镜头意识产出素材。具备分镜拆解能力,能从剧本独立完成视觉分镜转化。具备视觉审美判断力,能自主识别画面违和点(角色崩坏/光影错乱/透视异常)并修正。了解短剧叙事节奏,能理解该镜在整个叙事流中的位置与功能。有资产管理与批量生产能力,能建立 prompt 模板库与风格参数体系。加分项:有视频AI工具(如 Sora/Kling/Runway Gen-3)实际生产经验,或具备简单合成能力。 投递...