岗位描述(节选)
1、设计并研发输入输出任意模态(Any-to-Any)的统一架构,重点攻克 Audio-in-Audio-out 的原生建模;
2、研发高性能的神经音频编解码器(Neural Audio Codec),探索连续表征与离散 Token 的最优平衡;
3、利用海量多模态数据(语音、音乐、环境音、视频),负责超大规模参数模型的分布式预训练;
4、探索针对音频模态的指令微调与强化学习算法,优化模型在语音交互中的情感表达、打断机制、副语言(笑声、停顿)以及听感质量。
【任职要求】
1、计算机科学、人工智能、电子工程等相关博士学历;
2、具备大模型(LLM 或多模态)训练经验,深入理解 Transformer 架构及分布式训练框架(Megatron-LM, DeepSpeed,TorchTitan 等);
3、深入掌握以下至少一方向:
• Audio/Text Interleaved Pretrai……
完整岗位描述与官方投递入口,请登录后在岗位详情页查看。
本站当前在招 2674 个上海技术研发岗位,其中 300 个公开标注了薪资。按这些标注统计:月薪(税前)主流区间 15K ~ 25K(25~75 分位),中位约 20K,最低 4K、最高 100K。
在招岗位较多的企业:字节跳动 362 个拼多多 181 个米哈游 161 个哈啰出行 141 个阿里巴巴集团(含高德/阿里云) 110 个
统计口径:求职者营地实时在招岗位的公开薪资标注,未标注者不计入;区间为 25~75 分位,非薪酬承诺。