AI大模型数据训练师(人文社科方向)
成都
本科及以上
不限专业
使用简历深度优化功能,快速提升简历质量
职位介绍
岗位亮点:
1-不做代码开发:无需编程基础,只需发挥文字功底和逻辑思维。
2-与前沿科技同行:参与国内顶级大语言模型的底层建设,教会AI如何像“人类”一样思考和表达。
3-拒绝枯燥流水线:接触多领域文本(法律、历史、文学、教育),每天都是新鲜内容。
岗位背景:
我们正在寻找具有优秀语言敏感度和逻辑能力的文科人才。你的工作不是简单的“画框”或“打点”,而是作为AI的“语言导师”,通过数据标注与模型反馈,帮助大模型更精准地理解人类语言习惯、文化背景与多样化表达。
岗位可能会涉及的工作内容:
1-文本数据精标与清洗: 对海量文本数据进行人工纠错、语义分割和实体关系抽取,确保源数据的准确性与高质量。
2-大模型RLHF训练(人类反馈强化学习): 扮演“评委”角色,对模型生成的多个回复进行相关性、逻辑性、安全性及情感色彩的排序与打分。
3-特定场景内容创作: 根据Prompt(提示词)要求,辅助模型撰写符合不同场景的高质量回复(包括但不限于:营销文案、新闻简讯、公文写作、心理咨询话术)。
4-模型回复质量评估: 依据既定标准,对AI模型生成的多个回复进行多维度评估,包括但不限于:内容相关性、信息准确性、逻辑连贯性、表达流畅度及风格适配度,并进行偏好排序。
5-案例归纳与反馈: 在日常工作中收集、整理典型问题案例(如高频错误类型、模型理解偏差等),形成清晰的数据反馈,为模型优化提供真实场景依据。
6-语音数据标注与质检(TTS / ASR):
①对TTS(语音合成)数据进行文本校对、音素标注、韵律与停顿标记,确保合成语音的自然度和表现力;
②对ASR(语音识别)数据进行语音转写、口音标注、噪音环境判断及发音纠错,提升模型在复杂场景下的识别准确率。
任职资格:
学历专业:本科及以上学历,中文、新闻、外语、法学、历史、哲学、社会学、教育学、艺术类等文科专业优先。
核心能力:
1-阅读理解力:能快速提取长文本核心观点,具备较强的摘要总结能力。
2-文字敏感度:能敏锐识别错别字、语病及逻辑谬误,具备良好的网感。
3-逻辑条理性:思维严谨,能够按照既定标准执行任务,并清晰复述出决策依据。
4-素质要求:细致耐心,责任心强,能持续保持高质量的产出。

