进入工作台 →

音频生成式AI算法工程师-多媒体技术

小红书📍 北京招聘
🎯 社招 发布于 2026-09-15 来源:小红书招聘
登录查看完整 JD、匹配评分与一岗一历

岗位描述(节选)

1、负责多媒体各场景音频算法处理和策略的研发,保障高质量的音频发布和消费体验; 2、负责音频生成算法的研发与业务落地:语音美化与人声增强、变声与音色转换、多模态音频生成等方向; 3、负责音频理解模型的构建与应用:音频理解基座、音频美学评价等; 4、负责基于 AI 的音频前处理算法的研究,包括但不限于 NN 语音增强、PVAD 等音频前处理算法; 5、跟踪业界前沿音频技术,包括但不限于前沿多模态模型和空间音频等方向的调研与业务落地。 【任职要求】 1、硕士及以上学历,计算机、信号与信息处理或声学等相关专业,3 年及以上音频算法或深度学习相关经验; 2、精通 Python 编程,熟悉 PyTorch 等深度学习框架,具备良好的代码规范和系统设计能力;有 C/C++ 工程能力者优先; 3、熟悉以下至少一个音频相关领域: ① 扩散模型(Diffusion)、Flow Matching、Neura…… 完整岗位描述与官方投递入口,请登录后在岗位详情页查看。

北京招聘行情

本站当前在招 18762 个北京岗位(全城各职能合计),其中 2681 个公开标注了薪资。按这些标注统计:月薪(税前)主流区间 7K ~ 20K(25~75 分位),中位约 10K,最低 2K、最高 300K。
在招岗位较多的企业:字节跳动 3945 个小米集团 1146 个快手 1017 个阿里巴巴集团(含高德/阿里云) 780 个理想汽车 485 个
统计口径:求职者营地实时在招岗位的公开薪资标注,未标注者不计入;区间为 25~75 分位,非薪酬承诺。

北京 其他在招岗位

按城市浏览招聘

© 2026 求职者营地 · 岗位数据受版权与反爬保护,禁止抓取与镜像