职位详情
【岗位职责】
1. 负责企业自研AI系统的测试工作,确保系统在质量、性能、安全等方面达到预期标准;
2. AI系统与模型评估:
1)功能与逻辑验证:设计并执行测试用例,检验AI系统(如大模型、问数等)输出内容的准确性、逻辑连贯性、上下文一致性及对指令的遵循程度。
2)核心指标评测:制定并实施评测方案,评估模型的精准率、召回率、F1值等关键指标,并输出关于可解释性与鲁棒性的测试分析报告。
3)数据集构建:承担测试数据的收集、清洗、分类、标注与审核任务,打造高质量测试数据集,建设自动化评测能力。
3. 质量与风险防控:
1)AI幻觉与偏见识别:发现并记录AI生成内容中的虚假信息(幻觉)、事实错误或歧视性表达,分析其规律,支持模型优化。
2)安全与合规测试:采用红队演练等方式,模拟恶意输入行为,检测系统漏洞、数据泄露隐患以及对抗攻击的防御能力,保障内容合法合规、符合伦理要求。
3)稳定性与压力验证:在高并发、长时间运行等极端条件下测试系统表现,监控响应速度、服务稳定性及面对数据分布变化时的适应能力。
4. 测试策略与自动化:
1)自动化测试开发:运用Python等语言编写和维护自动化测试脚本与框架,覆盖接口、UI、性能等多个层面,提升测试效率与覆盖面。
2)测试体系构建:参与需求评审,推动测试前移,制定端到端测试策略与质量控制规范,建立涵盖数据、模型至应用的全流程质量保障体系。
3)工具链完善:搭建并持续优化AI测试工具链,探索使用AI技术(如AIOps)实现对AI系统测试的新路径。
5. 问题排查:针对模型预测偏差、性能瓶颈等问题进行深入分析,协助研发团队定位根本原因并推动解决。
【岗位要求】
1. 技术能力:
1)编程基础:熟练掌握至少一门编程语言,如 Python、Java、C++,具备较强的编码与脚本开发能力。
2)AI理论知识:了解主流AI框架(如 TensorFlow、PyTorch),熟悉准确率、F1值、AUC、BLEU、ROUGE等评估指标,理解机器学习与深度学习的基本原理和常见算法(如分类、回归、聚类)。
3)测试技能:掌握软件测试流程、方法及相关工具(如Selenium、JMeter),具备数据库操作经验(如MySQL、MongoDB)和数据处理工具使用能力(如Pandas)。
4)领域专长:在自然语言处理(NLP)、计算机视觉(CV)、语音识别等方向中具有一项或多项专业知识积累。
2. 综合素质:具备出色的逻辑推理、问题拆解与独立应对能力;善于沟通协作,能与产品、开发、算法团队高效配合;热爱AI技术,学习意愿强,能主动跟踪行业发展趋势并吸收新技术。
3. 具备AIGC、RAG(检索增强生成)或 Agent 类产品的测试经验,熟悉 OpenCompass、PromptBench 等大模型测评工具,拥有 CI/CD 实践经验者优先考虑。
4. 计算机、软件工程、人工智能、电子信息等相关专业背景,具备2年以上相关工作经验,有AI算法或模型测试实践经历者优先。
1. 负责企业自研AI系统的测试工作,确保系统在质量、性能、安全等方面达到预期标准;
2. AI系统与模型评估:
1)功能与逻辑验证:设计并执行测试用例,检验AI系统(如大模型、问数等)输出内容的准确性、逻辑连贯性、上下文一致性及对指令的遵循程度。
2)核心指标评测:制定并实施评测方案,评估模型的精准率、召回率、F1值等关键指标,并输出关于可解释性与鲁棒性的测试分析报告。
3)数据集构建:承担测试数据的收集、清洗、分类、标注与审核任务,打造高质量测试数据集,建设自动化评测能力。
3. 质量与风险防控:
1)AI幻觉与偏见识别:发现并记录AI生成内容中的虚假信息(幻觉)、事实错误或歧视性表达,分析其规律,支持模型优化。
2)安全与合规测试:采用红队演练等方式,模拟恶意输入行为,检测系统漏洞、数据泄露隐患以及对抗攻击的防御能力,保障内容合法合规、符合伦理要求。
3)稳定性与压力验证:在高并发、长时间运行等极端条件下测试系统表现,监控响应速度、服务稳定性及面对数据分布变化时的适应能力。
4. 测试策略与自动化:
1)自动化测试开发:运用Python等语言编写和维护自动化测试脚本与框架,覆盖接口、UI、性能等多个层面,提升测试效率与覆盖面。
2)测试体系构建:参与需求评审,推动测试前移,制定端到端测试策略与质量控制规范,建立涵盖数据、模型至应用的全流程质量保障体系。
3)工具链完善:搭建并持续优化AI测试工具链,探索使用AI技术(如AIOps)实现对AI系统测试的新路径。
5. 问题排查:针对模型预测偏差、性能瓶颈等问题进行深入分析,协助研发团队定位根本原因并推动解决。
【岗位要求】
1. 技术能力:
1)编程基础:熟练掌握至少一门编程语言,如 Python、Java、C++,具备较强的编码与脚本开发能力。
2)AI理论知识:了解主流AI框架(如 TensorFlow、PyTorch),熟悉准确率、F1值、AUC、BLEU、ROUGE等评估指标,理解机器学习与深度学习的基本原理和常见算法(如分类、回归、聚类)。
3)测试技能:掌握软件测试流程、方法及相关工具(如Selenium、JMeter),具备数据库操作经验(如MySQL、MongoDB)和数据处理工具使用能力(如Pandas)。
4)领域专长:在自然语言处理(NLP)、计算机视觉(CV)、语音识别等方向中具有一项或多项专业知识积累。
2. 综合素质:具备出色的逻辑推理、问题拆解与独立应对能力;善于沟通协作,能与产品、开发、算法团队高效配合;热爱AI技术,学习意愿强,能主动跟踪行业发展趋势并吸收新技术。
3. 具备AIGC、RAG(检索增强生成)或 Agent 类产品的测试经验,熟悉 OpenCompass、PromptBench 等大模型测评工具,拥有 CI/CD 实践经验者优先考虑。
4. 计算机、软件工程、人工智能、电子信息等相关专业背景,具备2年以上相关工作经验,有AI算法或模型测试实践经历者优先。
2026-04-07 15:15
IP属地:广东深圳
职位福利
本科经验不限深度学习多模态算法大模型算法

外企德科数字技术有限公司
10000人以上

工作地址

鱼泡安全保障
如遇到办证收费、刷单、传销、诱导买车等违规行为,请立即向鱼泡直聘投诉举报投诉举报 >

附近适合您的职位
招聘AI训练师助理+双休+可接受应届生(深圳)
8000-12000元/月
数据标注/AI训练师经验不限大专不接受居家办公国内院校优先数据分析能力强数据标注
深圳 龙岗区












