
正在上海举行的第48届世界技能大赛,今年新增了7个赛项,“软件测试”便是其中之一。手机App、线上支付、政务办公等各类软件乃至AI大模型,正越来越深度地融入日常生活,而保障它们稳定安全运行的软件测试,也从幕后走到台前,成为数字世界有序运转的重要基石。
何为软件测试?一句话通俗理解:软件测试就是软件的质检,即通过手工+自动化工具等方式,来检验软件功能是否正常、有无安全漏洞、高并发时会不会卡顿、极端场景下会不会崩,排查数据异常、权限漏洞、后台篡改等高风险隐患。
在不少人的印象中,软件测试员的工作就是不停地“点点点”、找Bug(缺陷、漏洞),判断问题等级、复现故障、形成报告,再交给开发人员修复。实际上,今天的软件测试早已超出这一范畴。
软件测试岗,不止于找Bug。
上海市人工智能行业协会副秘书长党赞,见证了软件测试从PC、Web时代走向移动互联网和大模型时代;测试方式从以人工操作为主,演进为强调顶层设计和全局思维的自动化测试;测试内容也由基础功能检查,拓展至兼容性、容灾、安全、性能等多个领域。
元股证券:ygzq.hk“过去的研发流程往往是开发在前、测试在后,测试岗位的重要性也不及开发。但如今,测试不断前移,越来越早地参与产品设计和研发,测试与开发之间的界限也逐渐模糊,谷歌甚至不再单独招聘传统意义上的测试岗位,而是将质量保障能力融入研发体系。”据党赞的观察,国内互联网大厂的测试岗位不少也已并入研发团队,“测开融合”趋势明显。
配资界官网据介绍,如果参照世赛标准,新时代软件测试人才早已跳出简单“找Bug”的定位,须具备全栈式综合能力——一方面是硬技能,包括业务理解、代码能力、多类型测试实操、缺陷分析等。另一方面为软素质,包括极强的逻辑推理能力、细致的观察力,会考虑极端的异常场景,还需要风险思维和限时交付实力。
AI大模型本质上也是一种软件,也需要测试,测试员需要直面大模型的幻觉、边界失效、长上下文出错等不确定性难题,进一步推高了软件测试的技术含量。
以国内某大厂模型为例。该模型的预览版今年4月底上线之初,尽管在基准评测榜单上表现亮眼,但软件测试团队在海量场景测试中仍发现不少隐患。比如,面对长文档、专业知识、多轮连续对话时,模型容易编造不存在的事实,或出现前后逻辑矛盾。在调用代码工具时,模型偶尔会虚构不存在的函数,在复杂任务里出现无效循环调用。这些问题,并非普通的代码Bug,而是大模型“与生俱来”的不确定性,其每一次回答都不会完全相同。也因此,对结果的评估,要从它是否准确,转向是否合理。
为此,软件测试团队搭建起多层次测试体系,不再只依赖公开基准数据集,而是设计海量对抗性测试用例、真实业务场景用例,组织跨领域专家盲测。一方面,构造大量陷阱式提问、超长上下文、模糊边界场景,专门捕捉模型幻觉;另一方面,对模型输出进行事实核验、逻辑一致性校验,检验工具调用、多轮对话的稳定性,定位模型在不同输入下的失效边界。
正是一大批“测开融合”的专业人员持续地测试、反馈、迭代闭环,才将大模型的幻觉逐渐降至可控范围,为年底推出正式版奠定基础。
软件测试岗,是消除大模型幻觉的关键岗位。
软件定义世界,而测试定义着软件的可信边界。第48届世界技能大赛把“软件测试”请上赛场,不只是增设一个赛项,更是一种时代宣告——测试不再是开发的附庸,而是贯穿创新全过程的底层能力;软件测试工程师渤海证券,不只是找Bug的人,更是数字社会的守门员、智能时代的打分者。
配资平台牌照查询—点击查询提示:本文来自互联网,不代表本网站观点。