百度360必应搜狗淘宝本站头条
当前位置:网站首页 > 技术文章 > 正文

AI测试:蜕变测试在模型算法测试中的实践

myzbx 2025-01-04 21:54 45 浏览

 一、引言

  这一篇,主要介绍模型算法测试之模型蜕变测试。说到模型蜕变测试,我相信会有很多一部分测试人没有接触过,也有很多一部分测试人没有听说过。什么是模型蜕变测试呢? 这一篇,我们就来揭开它的面纱。

  二、概述

  模型蜕变测试(Metamorphic Testing, MT)是一种特殊的测试方法,最早用于解决传统测试方法难以应对的复杂软件系统,特别是那些没有明确预期输出的系统。

  在模型算法方面,主要利用模型算法内含属性的测试方法,

  蜕变测试的核心思想是利用已知的、可验证的输入输出关系(蜕变关系)来推断未知的输出结果,从而验证程序的正确性,

  换句话说:修改了与属性相关的输入,在给定原始输入和输出的情况下预测新的输出。

  说到蜕变测试,不得不提的一个词“蜕变关系”, 什么是蜕变关系呢?

  蜕变关系(Metamorphic Relations, MR)是一组预期的输入输出间的关系,即:一组与模型算法中多对输入和输出相关的属性,在多次执行目标程序时,输入与输出之间期望遵循的关系,常用来验证模型的稳定性和一致性。

  三、蜕变关系

  我们了解了蜕变测试的流程,接下来就了解蜕变的关系。这也是蜕变测试的难点和核心的关键点。

  这里我就以我的工作(目标检测,计算机视觉)为例,常见的蜕变关系,如下:

  1.旋转不变形

  输入:原始图像、旋转(90度、180度、270度)后的图像

  预期输出关系:旋转前后的分类结果应保持一致。

  2.缩放不变性

  输入:不同尺度缩放后的图像(放大或缩小)

  预期输出关系:缩放前后的分类结果应保持一致。

  3.翻转不变性

  输入:水平翻转或垂直翻转后的图像

  预期输出关系:翻转前后的分类结果应保持一致。

  4.亮度不变性

  输入:变化亮度后的图像(增加或减少亮度)

  预期输出关系:亮度变化前后的分类结果应保持一致。

  5.对比度不变性

  输入:调整对比度后的图像(增加或减少对比度)

  预期输出关系:对比度变化前后的分类结果应保持一致。

  6.噪声鲁棒性

  输入:添加随机噪声后的图像

  预期输出关系:噪声前后的分类结果应保持一致。

  7.颜色空间转换不变性

  输入:转换为不同颜色空间(如灰度、HSV)的图像

  预期输出关系:转换前后的分类结果应保持一致。

  当然,除了目标检测/计算机视觉领域之外, NLP领域常见的蜕变关系如下:

  1.同义词替换不变性

  输入:用同义词替换部分词语后的文本

  预期输出关系:同义词替换前后的分类结果应保持一致。

  2.拼写错误鲁棒性

  输入:文本中包含少量拼写错误

  预期输出关系:拼写错误前后的分类结果应保持一致或相近。

  3.句子重组不变性

  输入:重组句子内词语顺序但不改变句子语义后的文本

  预期输出关系:重组前后的分类结果应保持一致。

  4.文本形式变换不变性

  输入:文本大小写变换或加标点符号后的文本

  预期输出关系:变换前后的分类结果应保持一致。

  5.负载增强不变性

  输入:添加或去除文本中的冗余信息(如插入无实质意义的词语)

  预期输出关系:冗余信息前后的分类结果应保持一致。

  关于蜕变关系,我就说到这里了,关于其他(数据增强和改进生成、抽象层次等)蜕变关系,大家可以在留言区进行补充。

  四、测试流程

  模型蜕变测试可应用于机器学习模型的黑盒测试。蜕变测试流程涉及到:

  1.定义蜕变关系:选择一组输入以及这些输入的变体,确定这些输入变体与原始输入之间的关系,以及改变前后模型输出结果应该满足的关系

  2.构建测试案例:利用某些变换(如添加噪声、改变特征值等)生成多个输入变体,

  3.执行测试案例:将原始输入和变体输入分别输入模型,获得输出结果,并检查这些输出结果是否满足定义的蜕变关系。

  4.分析结果:分析模型输出,判断是否存在不符合蜕变关系的情况,如果有不符合的情况,进一步分析可能的原因,如数据分布、模型训练不足、特征工程问题等。

  同样,为了便于更好的对蜕变测试的理解, 我这里以流程图与实例结合。

  例子:假设年龄与薪资收入关系模型,输入的年龄与模型算法系统的输出相关。

  模型算法输出Y 是薪资收入可行性估计。随着年龄的增长,薪资收入可能性也会增加。

  所以,这里的就建立了蜕变关系,即:X与Y之间的蜕变关系,如下图:

  假设X1 = 28,输出Y1 = 0.4 ,基于这已知模型预测结果,我们设计测试案例:

  1、X2 = 20 , Y2 的值应该小于Y1;

  2、X3 = 45 ,Y3的值应该大于Y1 ;

  3、X4 = 33,Y4 的值应该大于Y1 小于Y3 ;

  4、X5 = 120 ,Y5 的值,理论上应该是异常值;

  通过上述这例子,我们就能更好的理解蜕变测试,也能更好的理解蜕变关系了。

  (当然,这个例子,是相对值,咱也不用特意的转牛角尖,说这例子没有考虑一些特殊情况,特殊情况不在这个例子中。)

  五、总结

  在这篇,我详细的介绍了蜕变关系的概念、蜕变测试流程及实例展示。目的就是为了让我们更容易理解蜕变关系。

  在模型算法测试中,蜕变测试是一种有效验证模型稳定性和鲁棒性的测试方法。

  基于各类常见的蜕变关系保证了在真实场景中,模型能适应数据的变化和噪声,是提升模型质量的有效方法。

  当然,构建与定义蜕变关系构成了测试过程中的最大挑战与核心环节,这一过程不仅需要专业知识做支撑,更依赖于项目实践中不断积累的经验总结与持续优化。

文末了,我邀请你进入我们的软件测试学习交流群,大家可以一起探讨交流软件测试,共同学习软件测试技术、面试等软件测试方方面面,了解测试行业的最新趋势,助你快速进阶Python自动化测试/测试开发,稳住当前职位同时走向高薪之路。

最后:

1)关注+私信回复:“测试”,可以免费领取一份10G软件测试工程师面试宝典文档资料。以及相对应的视频学习教程免费分享!

2)关注+私信回复:"入群" 就可以邀请你进入软件测试群学习交流~~

相关推荐

如何设计一个优秀的电子商务产品详情页

加入人人都是产品经理【起点学院】产品经理实战训练营,BAT产品总监手把手带你学产品电子商务网站的产品详情页面无疑是设计师和开发人员关注的最重要的网页之一。产品详情页面是客户作出“加入购物车”决定的页面...

怎么在JS中使用Ajax进行异步请求?

大家好,今天我来分享一项JavaScript的实战技巧,即如何在JS中使用Ajax进行异步请求,让你的网页速度瞬间提升。Ajax是一种在不刷新整个网页的情况下与服务器进行数据交互的技术,可以实现异步加...

中小企业如何组建,管理团队_中小企业应当如何开展组织结构设计变革

前言写了太多关于产品的东西觉得应该换换口味.从码农到架构师,从前端到平面再到UI、UE,最后走向了产品这条不归路,其实以前一直再给你们讲.产品经理跟项目经理区别没有特别大,两个岗位之间有很...

前端监控 SDK 开发分享_前端监控系统 开源

一、前言随着前端的发展和被重视,慢慢的行业内对于前端监控系统的重视程度也在增加。这里不对为什么需要监控再做解释。那我们先直接说说需求。对于中小型公司来说,可以直接使用三方的监控,比如自己搭建一套免费的...

Ajax 会被 fetch 取代吗?Axios 怎么办?

大家好,很高兴又见面了,我是"高级前端进阶",由我带着大家一起关注前端前沿、深入前端底层技术,大家一起进步,也欢迎大家关注、点赞、收藏、转发!今天给大家带来的主题是ajax、fetch...

前端面试题《AJAX》_前端面试ajax考点汇总

1.什么是ajax?ajax作用是什么?AJAX=异步JavaScript和XML。AJAX是一种用于创建快速动态网页的技术。通过在后台与服务器进行少量数据交换,AJAX可以使网页实...

Ajax 详细介绍_ajax

1、ajax是什么?asynchronousjavascriptandxml:异步的javascript和xml。ajax是用来改善用户体验的一种技术,其本质是利用浏览器内置的一个特殊的...

6款可替代dreamweaver的工具_替代powerdesigner的工具

dreamweaver对一个web前端工作者来说,再熟悉不过了,像我07年接触web前端开发就是用的dreamweaver,一直用到现在,身边的朋友有跟我推荐过各种更好用的可替代dreamweaver...

我敢保证,全网没有再比这更详细的Java知识点总结了,送你啊

接下来你看到的将是全网最详细的Java知识点总结,全文分为三大部分:Java基础、Java框架、Java+云数据小编将为大家仔细讲解每大部分里面的详细知识点,别眨眼,从小白到大佬、零基础到精通,你绝...

福斯《死侍》发布新剧照 "小贱贱"韦德被改造前造型曝光

时光网讯福斯出品的科幻片《死侍》今天发布新剧照,其中一张是较为罕见的死侍在被改造之前的剧照,其余两张剧照都是死侍在执行任务中的状态。据外媒推测,片方此时发布剧照,预计是为了给不久之后影片发布首款正式预...

2021年超详细的java学习路线总结—纯干货分享

本文整理了java开发的学习路线和相关的学习资源,非常适合零基础入门java的同学,希望大家在学习的时候,能够节省时间。纯干货,良心推荐!第一阶段:Java基础重点知识点:数据类型、核心语法、面向对象...

不用海淘,真黑五来到你身边:亚马逊15件热卖爆款推荐!

Fujifilm富士instaxMini8小黄人拍立得相机(黄色/蓝色)扫二维码进入购物页面黑五是入手一个轻巧可爱的拍立得相机的好时机,此款是mini8的小黄人特别版,除了颜色涂装成小黄人...

2025 年 Python 爬虫四大前沿技术:从异步到 AI

作为互联网大厂的后端Python爬虫开发,你是否也曾遇到过这些痛点:面对海量目标URL,单线程爬虫爬取一周还没完成任务;动态渲染的SPA页面,requests库返回的全是空白代码;好不容易...

最贱超级英雄《死侍》来了!_死侍超燃

死侍Deadpool(2016)导演:蒂姆·米勒编剧:略特·里斯/保罗·沃尼克主演:瑞恩·雷诺兹/莫蕾娜·巴卡林/吉娜·卡拉诺/艾德·斯克林/T·J·米勒类型:动作/...

停止javascript的ajax请求,取消axios请求,取消reactfetch请求

一、Ajax原生里可以通过XMLHttpRequest对象上的abort方法来中断ajax。注意abort方法不能阻止向服务器发送请求,只能停止当前ajax请求。停止javascript的ajax请求...