Refine Reset All
新近的搜索 清除
通过
位置
工作类型
雇主/招聘方
发布日期
位置
工作类型
雇主/招聘方
所有筛选

Bss 招聘 在 中国 - 1 Job Positions Available

主要城市:
1 – 1 的 1 招聘
智元创新(上海)科技有限公司 招聘

多模态拾音算法工程师(交互智能方向) 上海、北京 校招 正式 技术族 - 算法类 职位 ID:A62400 职位描述 1. 核心音频算法研发:负责前沿音频信号处理算法的研究与落地,包括但不限于麦克风阵列波束形成(Beamforming)、回声消除(AEC)、声源定位(DOA/SSL)、语音增强(De-noise/Dereverb)及盲源分离(BSS)。2. AI 与传统信号处理融合:探索机器学习(智能降噪/深度空间音频)与经典传统信号处理算法的深度结合,解决移动设备/机器人处于动态旋转、运动、多声源干扰等极端复杂场景下的远场拾音与交互难题。3. 多模态交互智能(特色加分项):研究视听觉多模态融合算法(例如:利用摄像头视觉追踪配合音频波束,实现精准“看谁就听谁”的定向语音增强),提升机器人在嘈杂社交环境下的交互体验。4. 端侧部署与工程协同:配合系统工程团队,推动算法在端侧硬件(如 ARM/DSP/NPU/Thor 等边缘计算平台)上的流式(Streaming)低延迟部署与性能调优。 职位要求 1. 教育背景:硕士及以上学历,声学、信号处理、电子信息、人工智能、应用数学等相关专业。2. 传统信号处理功底:具备极其扎实的数理统计与随机信号处理基础;熟练掌握自适应滤波(LMS, RLS)、空间谱估计、现代谱分析等核心算法;精通 Matlab/Python 算法仿真。3. 深度学习与大模型能力:熟练掌握 PyTorch/TensorFlow,熟悉常规序列模型(RNN/Transformer)及生成式模型(Diffusion/VAE 等在语音生成/修复中的应用),有语音或多模态大模型微调/蒸馏经验者加分。4. Linux与C++工程能力(加分):熟练掌握 Linux 环境开发,具备扎实的 C/C++ 编程能力,熟悉常见音频框架(如 WebRTC 语音引擎、Kaldi 或 Linux

智元创新(上海)科技有限公司  25天前发布

Subscribe for job alerts and resources to make your job search easier!

确认邮件已发送至

请检查邮件并点击链接,开始接收招聘提醒。

接收这类最新招聘:

bss

确认邮件已发送至

请检查邮件并点击链接,开始接收招聘提醒。

所有筛选 Apply
通过
位置
工作类型
雇主/招聘方