进入工作台 →

多模态识别算法工程师-抖音直播

字节跳动📍 北京招聘
🎯 社招 来源:企业官网(飞书招聘多租户)
登录查看完整 JD、匹配评分与一岗一历

岗位描述(节选)

【岗位职责】 1、负责直播业务的主播多模态内容理解、内容识别和内容挖掘的模型建设,提升直播侧内容供给和增长; 2、负责直播场景下计算机视觉、音频、文本大模型的优化与迭代,包括直播间画面识别和检测、文本语义理解和总结,大模型智能助手等; 3、探索计算机视觉、多模态、LLM等前沿技术,负责算法模型的设计开发和调优。 【任职要求】 1、在计算机视觉、 NLP、多模态、深度学习某个领域有较深入的研究,包括但不限于:图像视频理解、检测、分割、动作识别、多模态、RAG、少样本学习等; 2、熟悉PyTorch/TensorFlow其中一种或多种框架模型的训练和部署,了解混合精度训练、分布式训练、TensorRT部署等; 3、有较强的模型开发和调优能力,在视频内容理解或多模态检索方向有项目经验者优先,在Kaggle、COCO、ActivityNet、ICPC、NOI/IOI等比赛获奖者优先; 4、优秀的…… 完整岗位描述与官方投递入口,请登录后在岗位详情页查看。

北京技术研发岗位行情

本站当前在招 2283 个北京技术研发岗位,其中 174 个公开标注了薪资。按这些标注统计:月薪(税前)主流区间 12K ~ 20K(25~75 分位),中位约 20K,最低 2K、最高 70K。
在招岗位较多的企业:字节跳动 687 个理想汽车 236 个长鑫科技 143 个阿里巴巴集团(含高德/阿里云) 106 个小米集团 95 个
统计口径:求职者营地实时在招岗位的公开薪资标注,未标注者不计入;区间为 25~75 分位,非薪酬承诺。

北京 其他在招岗位

按城市浏览招聘

© 2026 求职者营地 · 岗位数据受版权与反爬保护,禁止抓取与镜像