logologo
寻找工作
返回简章2026-08-20 更新

大语言模型训练研究员

宁德
硕士及以上
计算机类·统计学类
使用简历深度优化功能,快速提升简历质量
职位介绍
【职位职责】 1. 参与大语言模型的预训练全流程研发,包括数据清洗与配比、训练策略设计、并行训练优化、训练稳定性与收敛性调优 2. 负责模型后训练技术体系建设,涵盖监督微调(SFT)、奖励模型训练、RLHF、DPO、ORPO、PPO 等对齐算法的实现与迭代 3. 设计并执行模型评测方案,从通用能力、垂直领域能力、安全性、对齐效果等维度量化模型性能,输出迭代方向 4. 跟进预训练与后训练方向前沿技术,持续引入新方法优化模型效果与训练效率 5. 配合工程团队完成训练流水线、数据管线的自动化与平台化建设 【任职要求】 1. 要求硕士及以上学历,博士优先 2. 计算机科学、人工智能、数据科学、数学等相关专业 3. 具备大规模文本数据清洗、去重、质量评估与配比实验的工程实现能力 4. 深入理解SFT、奖励模型训练、RLHF-PPO的完整流程,熟悉DPO/ORPO/KTO等替代对齐算法并有实际调优经验 【学历要求】 硕士及以上 【硬性专业要求】 计算机科学相关专业、人工智能相关专业、数据科学相关专业、数学相关专业
所属批次:宁德时代新能源科技股份有限公司 2027届校园招聘简章企业职位库在招档案