岗位描述(节选)
岗位介绍
我们正在探索流式视频大模型方向,致力于让模型从"看完再回答"进化为"边看边理解、实时响应"。你将参与构建面向真实世界的实时视觉理解系统,覆盖视频流理解、长时记忆建模、主动式交互等前沿课题,推动模型能力从离线走向在线。
流式理解核心研究
1. 跟踪流式视频理解领域最新进展,输出技术洞察,探索适合业务场景的创新方案
2. 设计高效的流式推理架构,包括记忆压缩模块、时序建模与位置编码方案
3. 构建流式视频训练数据集与训练框架,探索离线到在线的课程学习范式
视频内容理解落地
4. 研发视频内容理解模型:高光识别、场景分类、精彩度评分、人物/物体语义理解
5. 实现智能切片能力:从直播流/点播视频中自动定位高光片段,支持实时和离线两种模式
6. 将内容理解能力接入产品链路,包括直播封面、运营挖掘工具、创作者笔记诊断报告等
评测与工程
7. 构建流式视频评测体系,与人工标注对比,持续提升……
完整岗位描述与官方投递入口,请登录后在岗位详情页查看。
本站当前在招 18762 个北京岗位(全城各职能合计),其中 2681 个公开标注了薪资。按这些标注统计:月薪(税前)主流区间 7K ~ 20K(25~75 分位),中位约 10K,最低 2K、最高 300K。
在招岗位较多的企业:字节跳动 3945 个小米集团 1146 个快手 1017 个阿里巴巴集团(含高德/阿里云) 780 个理想汽车 485 个
统计口径:求职者营地实时在招岗位的公开薪资标注,未标注者不计入;区间为 25~75 分位,非薪酬承诺。