岗位描述(节选)
1. 负责大语言模型(LLM)、多模态大模型(如 LLaMA、Qwen、DeepSeek、GPT、CLIP 等)的领域适配与参数高效微调(PEFT);
2. 深入理解并运用模型后训练三阶段流程(SFT 监督微调、Preference Optimization偏好对齐、RL 强化学习),确保模型从指令遵循、人类偏好对齐到复杂推理能力的全链路能力提升;
3. 构建高质量领域语料库,设计数据清洗、准注、增强与采样方案,开发自动化数据处理工具,搭建“数据-训练-评测”的闭环体系,提升训练数据质量;
4. 探索并实践前沿强化学习对齐技术(如 GRPO、DAPO、RLVR),提升模型在复杂推理任务中的表现与用户需求对齐能力;
5. 设计并实施高效微调方案,包括低秩适应技术(LoRA/QLoRA)及其与混合专家架构(MoE)的融合变体(如 MoE-LoRA),探索动态路由机制以实现多任务自适应学习;
6……
完整岗位描述与官方投递入口,请登录后在岗位详情页查看。
本站当前在招 4552 个广州岗位(全城各职能合计),其中 449 个公开标注了薪资。按这些标注统计:月薪(税前)主流区间 9K ~ 20K(25~75 分位),中位约 12K,最低 2K、最高 70K。
在招岗位较多的企业:小鹏鹏行 967 个越秀资本 285 个越秀地产股份有限公司 164 个字节跳动 158 个保利地产 129 个
统计口径:求职者营地实时在招岗位的公开薪资标注,未标注者不计入;区间为 25~75 分位,非薪酬承诺。