岗位描述(节选)
1. 数据链路搭建与治理:搭建端到端的数据处理链路(采集 → 清洗 → 加工 → 挖掘 → 增广 → 质量校验 → 筛选 → 输出),对接线上 rollout 产生的原始数据(轨迹、日志、执行结果、用户反馈),保证数据可追溯(血缘管理)、可复现(版本管理)、可观测(关键指标监控)。
2. 数据清洗、加工与质量校验:对海量原始 / 脏数据做去重、去噪、过滤无效样本、格式规整、脱敏与结构化,并做二次加工(改写、结构补全、难度分级、标签规范化);建立质量校验机制(规则质检 + 模型质检 + 双标一致性 + 金标抽检),系统性检测脏数据、偏见与分布异常,保证出库数据质量可量化、可迭代。
3. 日志与 Rollout 轨迹分析处理:对模型运行日志、工具调用日志、系统日志做解析、清洗、结构化,从噪声中抽取可用信号;对模型多步执行轨迹做逐步解析与标注(正确性 / 必要性 / 思考质量 / 整体 rewa……
完整岗位描述与官方投递入口,请登录后在岗位详情页查看。
本站当前在招 2283 个北京技术研发岗位,其中 174 个公开标注了薪资。按这些标注统计:月薪(税前)主流区间 12K ~ 20K(25~75 分位),中位约 20K,最低 2K、最高 70K。
在招岗位较多的企业:字节跳动 687 个理想汽车 236 个长鑫科技 143 个阿里巴巴集团(含高德/阿里云) 106 个小米集团 95 个
统计口径:求职者营地实时在招岗位的公开薪资标注,未标注者不计入;区间为 25~75 分位,非薪酬承诺。