岗位描述(节选)
1. 围绕 SpeechLLM 语音大模型开展前沿研究,探索语音与文本统一建模、端到端语音交互及模型后训练,提升语音理解与生成能力。
2. 研究 Voice Agent 技术,优化流式交互、全双工对话、用户打断及轮次判断,提升复杂声学环境下的交互自然度与响应速度。
3. 面向语音助手场景,研究音色定制、韵律控制和情感表达,实现自然、稳定、具有个性化音色的语音答复。
4. 面向同声传译场景,研究流式语音翻译、多语言语音生成及跨语言音色保持,兼顾翻译准确性、自然度与低时延。
5. 建立语音模型与交互系统的评测体系,推进模型压缩、推理优化及端侧部署,推动前沿技术在实际产品中落地。
【任职要求】
1. 语音信号处理、人工智能、计算机、电子信息等相关方向的应届博士毕业生,具备扎实的机器学习、深度学习及语音处理理论基础。
2. 在语音识别、语音合成、语音翻译、语音语言模型等一个或多个方向有深入研究,……
完整岗位描述与官方投递入口,请登录后在岗位详情页查看。
本站当前在招 1102 个深圳技术研发岗位,其中 92 个公开标注了薪资。按这些标注统计:月薪(税前)主流区间 15K ~ 28K(25~75 分位),中位约 20K,最低 6K、最高 100K。
本岗位标注月薪 20K ~ 28K,高于该范围约 67% 的在招岗位。
在招岗位较多的企业:字节跳动 206 个中国平安 47 个迈瑞医疗 45 个富士康 41 个阿里巴巴集团(含高德/阿里云) 39 个
统计口径:求职者营地实时在招岗位的公开薪资标注,未标注者不计入;区间为 25~75 分位,非薪酬承诺。