岗位描述(节选)
1.负责构建和迭代AI大模型(LLM)的自动化评测体系,包括但不限于医学合理性、安全性、有用性、忠实度、泛化性等维度的量化评估。
2. 设计与开发内部评测平台、工具链和评测数据集(Test Set),实现对模型能力的持续监控和回归测试。
3. 深入分析模型评测结果,定位模型缺陷和短板,为模型迭代优化(微调、Prompt工程、RAG增强)提供数据驱动的决策依据。
4. 与医学团队紧密合作,将抽象的医学标准和业务需求转化为可计算、可执行的评测指标和评测任务。
5. 跟踪学术界和工业界在LLM评测方面的最新进展(如MT-Bench, AlpacaEval等),并引入到实际工作中。
【任职要求】
1. 学历与经验:硕士及以上学历,计算机、统计学、应用数学等相关专业,3年以上机器学习/算法相关工作经验。
2. 工程基础:熟练掌握Python及主流数据科学库(Pandas, NumPy, Sklea……
完整岗位描述与官方投递入口,请登录后在岗位详情页查看。
本站当前在招 10367 个深圳岗位(全城各职能合计),其中 1708 个公开标注了薪资。按这些标注统计:月薪(税前)主流区间 12K ~ 21K(25~75 分位),中位约 16K,最低 1K、最高 100K。
本岗位标注月薪 20K ~ 40K,高于该范围约 90% 的在招岗位。
在招岗位较多的企业:字节跳动 847 个安克创新科技股份有限公司 600 个顺丰 583 个华大基因 472 个华大智造 357 个
统计口径:求职者营地实时在招岗位的公开薪资标注,未标注者不计入;区间为 25~75 分位,非薪酬承诺。