岗位描述(节选)
【岗位职责】
团队介绍:Data AML是字节跳动的机器学习中台,为抖音/今日头条/西瓜视频等业务提供推荐/广告/CV/语音/NLP的训练和推理系统。为公司内业务部门提供强大的机器学习算力,并在这些业务的问题上研究一些具有通用性和创新性的算法。同时,也通过火山引擎将一些机器学习/推荐系统的核心能力提供给外部企业客户。
1、负责大模型推理引擎底层架构迭代与GPU全链路性能优化,通过算子融合、编译优化等手段,深度优化GPU访存、计算流水线、Stream异步调度,消除推理计算瓶颈,提升单卡推理吞吐、降低推理延迟;
2、适配全系GPU、NPU硬件架构,打磨推理引擎通用性与硬件适配性,搭建高性能、低损耗的大模型推理底层底座,主导大模型推理场景下的分布式并行方案设计、开发与优化,重点落地张量并行(TP)、流水线并行(PP)、序列并行、MoE专家并行等多维度并行策略,解决超大模型多卡拆分部署、跨卡通信……
完整岗位描述与官方投递入口,请登录后在岗位详情页查看。
本站当前在招 2283 个北京技术研发岗位,其中 174 个公开标注了薪资。按这些标注统计:月薪(税前)主流区间 12K ~ 20K(25~75 分位),中位约 20K,最低 2K、最高 70K。
在招岗位较多的企业:字节跳动 687 个理想汽车 236 个长鑫科技 143 个阿里巴巴集团(含高德/阿里云) 106 个小米集团 95 个
统计口径:求职者营地实时在招岗位的公开薪资标注,未标注者不计入;区间为 25~75 分位,非薪酬承诺。