news 2026/6/22 20:31:02

功能接口查询结果与原始数据差别大?可能是并发的锅

作者头像

张小明

前端开发工程师

1.2k 24
文章封面图
功能接口查询结果与原始数据差别大?可能是并发的锅

案情描述

收到这么一个需求:存在一个数据库查询功能接口,需要完成1000个条件语句的查询,并将查询结果与原始数据库(如es)的查询结果对比,从而判定该功能接口是否正常,且正确可用。

第一次测试设计:读取文件中的1000个查询条件,顺序执行。但由于查询数据量较大,单线程顺序完成1000次查询耗时较长,效率太低——抛弃;

第二次测试设计:使用并发查询,多线程并发提高工作效率,节省了大大的时间。但将输出的1000个查询结果与原始数据库查询结果对比时,发现某些语句差异较大,为什么?

抽丝剥茧

为何功能接口查询结果与原始数据查询结果差异性大?

经过排查,问题出在查询语句对比时匹配错位——使用简单并发查询,输出并不严格按照读入顺序。换句话说:读入1、2、3、4、5个顺序查询条件,并发查询输出顺序可能时2、1、3、4、5,也可能时4、5、2、1、3。

那么,如何在编写测试脚本时,让并发输出严格按照读入顺序输出呢?

亡羊补牢

从Python3.2开始,标准库为我们提供了concurrent.futures模块,它提供了ThreadPoolExecutor和ProcessPoolExecutor两个类,可以帮助我们更好地完成并发设计。

本文我们不过深地讲述如何使用这些Python类,只简单讲述如何解答我们的核心问题——“如何在并发时让结果严格按照输入顺序输出”。

线程池ThreadPoolExecutor

……

如下所示,为ThreadPoolExecutor的基本使用方法,打印输入的list列表中的数字。

ThreadPoolExecutor()初始化,创建线程池,最多2个线程并发运行,通过submit调用子函数(打印输入数字),最终通过as_completed等待所有任务完成后,通过result收集返回结果。

  1. # -*-coding:utf-8 -*-

  2. from concurrent.futures import ThreadPoolExecutor,as_completed

  3. # 子函数,打印输入数字

  4. def print_num(num):

  5. return num

  6. list = [1,2,3,4,5,6,7,8,9,10,11,12,13,14,15,16,17,18,19,20]

  7. ##############使用ThreadPoolExecutor###################

  8. ###############并发执行,非顺序返回################

  9. # 创建线程池子

  10. # 设置最多2个线程运行,其他等待

  11. executor = ThreadPoolExecutor(max_workers=2)

  12. all_task = [executor.submit(print_num, (num)) for num in list]

  13. result2_list = []

  14. for future in as_completed(all_task):

  15. data = future.result()

  16. result2_list.append(data)

  17. print("并发执行,非顺序返回:"+ str(result2_list))

  18. ##############################################

如下图所示为上述使用ThreadPoolExecutor并发运行的结果,由结果打印可知,输出并非严格按照列表输入值顺序输出。由此可以预见,当我们简单使用并发时,我们的结果可能并不是我们认为的与“顺序”输出。

那么,如何改造呢?请关注map方法。

使用map方法,无需提前使用submit方法,map方法与python标准库中的map含义相同,都是将序列中的每个元素都执行同一个函数。

  1. ###############并发执行,顺序返回################

  2. # 创建线程池子

  3. # 设置最多2个线程运行,其他等待

  4. executor = ThreadPoolExecutor(max_workers=2)

  5. result1_list = []

  6. for result in executor.map(print_num, list):

  7. result1_list.append(result)

  8. print("并发执行,顺序返回:" + str(result1_list))

  9. ##############################################

上面的代码就是对list的每个元素都执行print_num子函数,并分配各线程池。

由此可以看到,执行结果与上面的as_completed方法的结果不同,输出顺序和list列表的顺序相同。

进程池ProcessPoolExecutor

……

使用进程池ProcessPoolExecutor处理并发输入,按序输出问题,同ThreadPoolExecutor一样,使用map方法即可解决。但是值得注意的是,注意,在使用多进程时,必须把 多进程代码写在?if __name__ == '__main__' 下面,否则异常,甚至报错“concurrent.futures.process.BrokenProcessPool: A process in the process pool was terminated abruptly while the future was running or pending.”

  1. #########################使用ProcessPoolExecutor#####################

  2. ###############并发执行,顺序返回################

  3. # 创建进程池子

  4. # 设置最多2个进程运行,其他等待

  5. if __name__ == '__main__':

  6. executor = ProcessPoolExecutor(max_workers=2)

  7. result2_list = []

  8. for result in executor.map(print_num, list):

  9. result2_list.append(result)

  10. print("ProcessPoolExecutor并发执行,顺序返回:" + str(result2_list))

  11. ##############################################

  12. #####################################################################

还存在一点“笨”方法

……

除了上述所说的ThreadPoolExecutor和ProcessPoolExecutor使用map方法让结果顺序输出外,我们还可以使用一些笨方法。

例如,使用并发运行程序(并发方法不仅限于ThreadPoolExecutor和ProcessPoolExecutor,还可以使用threading等等)sort方法对输出结果排序。就上述案例而言,不使用map可以如下改造:​​​​​​​

  1. ###############并发执行,非顺序返回################

  2. # 创建线程池子

  3. # 设置最多2个线程运行,其他等待

  4. executor = ThreadPoolExecutor(max_workers=2)

  5. all_task = [executor.submit(print_num, (num)) for num in list]

  6. result2_list = []

  7. for future in as_completed(all_task):

  8. data = future.result()

  9. result2_list.append(data)

  10. result2_list.sort()

  11. print("ThreadPoolExecutor并发执行,非顺序返回:"+ str(result2_list))

  12. ##############################################

最终,输出结果符合我们的要求。

结案陈词

ThreadPoolExecutor 多线程并行执行任务,可以共享当前进程变量,但缺点也很致命,但其实仍然最多只能占用 CPU 一个核。

如果指定的任务和线程数不恰当(比如一个任务很短,线程数量很多,导致线程频繁调用回收),那么效率还不如单线程。ProcessPoolExecutor可以使用多核进行计算,但缺点就是进程之间共享数据就比较麻烦,消耗更多的内存。

本文的主要目的是帮助大家认识:并发好用,但使用需谨慎。谨防一不小心落入并发的坑,使用map方法可以帮助大家快速地完成测试结果地有序输出。

感谢每一个认真阅读我文章的人,礼尚往来总是要有的,虽然不是什么很值钱的东西,如果你用得到的话可以直接拿走:

这些资料,对于【软件测试】的朋友来说应该是最全面最完整的备战仓库,这个仓库也陪伴上万个测试工程师们走过最艰难的路程,希望也能帮助到你!有需要的小伙伴可以点击下方小卡片领取

版权声明: 本文来自互联网用户投稿,该文观点仅代表作者本人,不代表本站立场。本站仅提供信息存储空间服务,不拥有所有权,不承担相关法律责任。如若内容造成侵权/违法违规/事实不符,请联系邮箱:809451989@qq.com进行投诉反馈,一经查实,立即删除!
网站建设 2026/6/23 8:48:20

2025年亲测7个降a率工具:AIGC率90%怎么降低ai?(附免费降AI1000字数)

市场上的降AI率工具良莠不齐,如何科学判断降AI率效果是很多学生、老师最关心的问题,担心降不来AI率,耽误时间还花不少钱。 本文将从以下五个维度系统,分析2025年主流的8个降AI工具,教大家如何选择适合自己的降AIGC工具…

作者头像 李华
网站建设 2026/6/22 21:51:49

ACL实验报告

一、实验拓扑二、实验需求1、全网互通;2、PC1可以Telnet R1,不能ping R13、PC1不能Telnet R2,但可以ping R24、PC2和PC1相反三、实验思路1、配置IP地址2、配置静态路由,实现全网通3、配置Telnet,并测试4、配置ACL&…

作者头像 李华
网站建设 2026/6/23 3:31:06

别再熬夜赶论文?6款AI工具帮你告别恐惧写作无压力!

还在对着空白文档发呆,从“致谢”开始写?还在为查重率50%焦虑到失眠,反复调换语序?还在因为导师一句“逻辑混乱,重写”而心态崩溃,觉得毕业遥遥无期? 如果你的答案是肯定的,那么你正…

作者头像 李华
网站建设 2026/6/23 9:44:21

一键导入书签,首页替代神器!批量去重、自动备份,维护不再头疼

「NAS、键盘、路由器年轻就要多折腾,我是爱折腾的熊猫—多面手博主!咱主打的就是一个 “技能不压身,干货不掺水”」引言关于导航页熊猫写过不少了,已经写了如此多的情况下寻常的导航页已经入不了熊猫的眼了,但今天要介…

作者头像 李华
网站建设 2026/6/13 4:33:11

土著刷题新功能解锁:跳题作答

🙋有小伙伴反馈:我组织了一场答题活动,使用「土著刷题小🍊序」发起了一场在线考试,我想让考生一题一题地作答,按照组卷的题目顺序作答,不允许跳题,这个能否实现? &#x…

作者头像 李华
网站建设 2026/6/19 6:59:34

Yolo模型TensorRT-C++推理实战指南

Yolo模型TensorRT-C推理实战指南 在智能监控、自动驾驶和工业质检等实时性要求极高的场景中,传统的Python端深度学习推理方案正逐渐暴露出性能瓶颈。尤其是在边缘设备或高并发服务环境下,即便是轻量级的YOLO系列模型,也常常面临延迟超标、吞吐…

作者头像 李华