岗位描述(节选)
AI 正在重塑搜索的底层逻辑。从意图理解到 AIO 聚合生成,从图文到多模态——评测,是这一切发生的地基。我们需要把"搜得好不好"变成可量化、可迭代的评估体系。
1、负责 AI 搜索的评测产品设计,覆盖搜索大盘评估、策略迭代评估及 RL 训练数据支持,建立自动化评估能力
2、与模型、算法团队协作,将搜索质量问题拆解为可量化的评估指标和标注方案
3、探索多模态场景(语音、图片、视频)的评测方法,设计差异化评估框架
4、推动评测结果落地,影响策略方向和产品决策,而不只是出报告
【任职要求】
1、5年以内工作经验,有评测体系设计经验,理解搜索产品逻辑
2、理解 LLM 基本能力边界,对 AI 评测(标注质量、自动化评估、人机协同)有认知
3、逻辑清晰,善于将复杂问题结构化,能有效推动跨团队协作落地
本站当前在招 18762 个北京岗位(全城各职能合计),其中 2681 个公开标注了薪资。按这些标注统计:月薪(税前)主流区间 7K ~ 20K(25~75 分位),中位约 10K,最低 2K、最高 300K。
在招岗位较多的企业:字节跳动 3945 个小米集团 1146 个快手 1017 个阿里巴巴集团(含高德/阿里云) 780 个理想汽车 485 个
统计口径:求职者营地实时在招岗位的公开薪资标注,未标注者不计入;区间为 25~75 分位,非薪酬承诺。