NLP大模型法律标注
北京
本科及以上
法学类
使用简历深度优化功能,快速提升简历质量
职位介绍
【线上线下均可】
岗位职责:
1.法律语料构建:围绕民法、刑法、行政法与行政诉讼法、商法、诉讼法(民事/刑事)、劳动法与劳动合同法、知识产权法、国际法等部门法领域,参与大模型训练所需的法律问答对撰写与数据清洗,确保数据符合法律逻辑与条文准确性。
2.指令微调数据制作:根据NLP工程师要求,将上述各部门法领域的复杂法律问题拆解为“指令-响应”格式数据,用于模型SFT(监督微调),提升模型在法律场景下的指令遵循能力。
3.模型输出评测:对模型在民法、刑法、商法、知识产权法等领域的判决预测、法条检索、合同审查等结果进行人工评估与错误归因,标注出逻辑漏洞、法条引用错误或事实推理偏差。
4.法律知识库构建:协助整理各部门法(含行政法与行政诉讼法、劳动法与劳动合同法、国际法等)的核心法条、司法解释及典型案例,形成结构化知识库,用于RAG(检索增强生成)系统的优化。
5.多轮对话设计:模拟法律咨询场景,设计覆盖民事、刑事、商事等多领域的多轮对话数据,增强模型在复杂法律情境下的上下文理解能力。
任职要求:
1.国内法学院校大三及以上,研究生优先;
2.具备扎实的部门法基础知识,至少熟悉民法、刑法、行政法与行政诉讼法、商法、诉讼法、劳动法、知识产权法或国际法中的1-2个领域;
3.对NLP、大模型或AI技术有浓厚兴趣,了解ChatGPT、文心一言等基本概念;
4.细致耐心,具备较强的逻辑归纳能力和法律检索能力;
5.有参与过数据标注、模型评测或知识库整理经验者加分。

