AI测试工程师(大模型·Agent·评测)
无锡
本科及以上
计算机类·电子信息类
使用简历深度优化功能,快速提升简历质量
职位介绍
岗位职责:
1.参与大语言模型(LLM)、多模态模型的功能测试、性能测试、安全测试与对齐评估;
2.设计并执行 Prompt / 用例,覆盖问答、推理、代码、创作、工具调用等典型场景;
3.参与 AI Agent 系统的端到端流程验证,包括任务规划、工具调用、记忆机制、多轮交互等;
4.设计并执行复杂任务场景,验证智能体在真实环境中的稳定性与可靠性;
5.跟踪并分析智能体失败案例,输出可复现的缺陷报告与改进建议。
6.参与构建和维护评测数据集,对评测结果进行统计分析,输出可视化报告,为模型迭代提供依据。
任职要求:
1.本科及以上在读,计算机、软件工程、人工智能等相关专业;
2.熟悉 Python,掌握常用数据结构与算法,有脚本编写和数据处理经验;
3.了解主流大模型(GPT 系列、Claude、Llama、Qwen 等)及常见应用场景;
4.有机器学习 / NLP / CV 基础,能理解模型输入输出及典型错误模式。
5.有 AI 测试、数据标注、模型评测经历者优先;
6.熟悉 LangChain、AutoGen、MetaGPT 等智能体框架,或实际搭建过 Agent 项目优先;
7.了解常见评测基准(如 MMLU、HumanEval、CEval、CMMLU 等);
8.有 SQL / 数据分析经验,能使用 Excel、Tableau、Power BI 等进行结果可视化。
9.具备较强的问题拆解能力与好奇心,能主动设计边界用例;
10.逻辑清晰,文档能力良好,能写出可复现、可读性强的测试报告;
11.良好的沟通协作意识,能在跨职能团队中推进问题解决。

