岗位描述(节选)
1. 负责3A核心算法的研发与迭代,包括回声消除(aec)、自动噪声抑制(ans)、自动增益控制(agc),确保算法在复杂声学环境下的鲁棒性,保障全双工通话的高保真音质与交互体验。
2. 推动3A算法的轻量化部署与端侧适配,结合深度学习与传统信号处理技术,平衡算法性能与资源消耗,支撑智能体语音交互技术基座建设。
3. 针对人机语音交互、智能体对话等前沿场景,优化VAD判停和语义完整性检查,实现“快速打断,智能判停,实时响应”的自然对话能力;
4. 研发语音识别(ASR)、语音合成(TTS)技术,并探索交互式语音模型在智能体对话中的应用,搭建可控双流模型的数据,训练和评估体系,优化对话模型的边说边听和情感识别能力;
5. 与产品、工程团队紧密合作,将算法模型落地到实际应用中,并持续优化系统性能。
6. 跟踪学术界和工业界的最新进展,探索前沿技术在对话系统中的应用。
【任职要求】
1. 计算……
完整岗位描述与官方投递入口,请登录后在岗位详情页查看。
本站当前在招 18762 个北京岗位(全城各职能合计),其中 2681 个公开标注了薪资。按这些标注统计:月薪(税前)主流区间 7K ~ 20K(25~75 分位),中位约 10K,最低 2K、最高 300K。
在招岗位较多的企业:字节跳动 3945 个小米集团 1146 个快手 1017 个阿里巴巴集团(含高德/阿里云) 780 个理想汽车 485 个
统计口径:求职者营地实时在招岗位的公开薪资标注,未标注者不计入;区间为 25~75 分位,非薪酬承诺。