logologo
寻找工作
2026-09-10 更新

大语言模型研发工程师

济南
硕士及以上
计算机类·电子信息类
职位介绍
岗位职责:1、设计并实现高效、可扩展的大语言模型持续预训练框架和方法,实现高效的垂域预训练,并避免灾难性遗忘;2、构建高质量、多源异构的预训练与后训练数据集,包括数据清洗、过滤、增强及自动标注策略;3、研发先进的后训练技术,包括但不限于监督微调(SFT)、直接偏好优化(DPO)和on-policy学习(GRPO/On-Policy SFT等),提升模型的指令遵循、安全性与事实一致性;4、优化大规模分布式训练系统(如基于DeepSpeed、Megatron-LM等),提升训练稳定性、吞吐量与资源利用率;5、建立全面的模型评估体系,涵盖通用能力、领域专精、伦理安全、幻觉控制等维度;6、跟踪前沿研究(如MoE、长上下文、推理蒸馏、在线学习等),推动技术创新落地。任职要求:1.计算机、人工智能、数学或相关专业硕士及以上学历;2.精通PyTorch / Transformers / VeRL / LlamaFactory 等大语言模型训练框架,具备大规模模型训练实战经验;3.深入理解Transformer架构及大语言模型训练全流程;4.熟悉分布式训练技术(如ZeRO、FSDP、Pipeline Parallelism)及高性能计算优化;5.具备优秀的工程实现能力与问题解决能力,能独立推进复杂技术项目。
职位归属:浪潮集团有限公司 企业官方在招库2027届校园招聘简章专页