岗位描述(节选)
1.参与多模态感知模型的训练与微调,并将其应用于实际屏幕行为和用户交互场景;
2.探索主动响应的感知技术,通过分析用户屏幕使用轨迹和行为数据,实现对用户意图的实时推断;
3.融合视觉、屏幕和系统事件等多模态数据,研究具备自主环境感知和交互响应能力的感知大模型;
4.搭建端侧屏幕理解能力,实现泛场景的GUI事件感知与自动化响应;
5.关注机器学习与感知领域前沿技术,探索跨领域技术融合,并参与撰写论文或专利;
6.参与OSAgent感知能力预研,包括记忆、决策与主动响应机制。
1. 硕士及以上学历,人工智能、计算机科学、电子、信息工程、机器人等专业,有C++/python开发经验;
2. 熟练掌握至少一种深度学习框架,如Tensorflow、PyTorch等;
3. 对深度学习有深刻认识,熟悉各种神经网络及背后数学原理;
4. 对大模型有设计应用经验者优先;
5. 对声音、图像、视频、各类传……
完整岗位描述与官方投递入口,请登录后在岗位详情页查看。
本站当前在招 18762 个北京岗位(全城各职能合计),其中 2681 个公开标注了薪资。按这些标注统计:月薪(税前)主流区间 7K ~ 20K(25~75 分位),中位约 10K,最低 2K、最高 300K。
在招岗位较多的企业:字节跳动 3945 个小米集团 1146 个快手 1017 个阿里巴巴集团(含高德/阿里云) 780 个理想汽车 485 个
统计口径:求职者营地实时在招岗位的公开薪资标注,未标注者不计入;区间为 25~75 分位,非薪酬承诺。