网易首页 > 网易号 > 正文 申请入驻

Agent+LangChain的自动化测试全链路

0
分享至

作为一名测试工程师,你是否经历过这样的场景:

● 加班加点写好的UI自动化脚本,因为前端一个按钮ID变更就全部失效;

● 为了覆盖一个边界条件,绞尽脑汁设计测试用例,结果上线后依然出现漏测;

● 发现一个偶现缺陷,复现步骤写了半小时,开发却说“我这边复现不了”……



这些痛点,正在被LangChain + 大模型Agent彻底改变。本文将通过三个核心生产级案例,展示智能体如何让测试自动化迈入全新境界,让测试工程师真正告别“脚本维护地狱”和“点点点”的重复劳动。

测试工程师的三大核心痛点

与Agent的破局之道



下面,我们通过三个完整案例,逐一拆解Agent如何攻克这些难题,并深度融入自动化测试的各个环节。

案例一:智能用例生成与CI/CD集成

从需求文档到自动化测试全链路

痛点还原

产品经理发来一份2000字的需求文档,描述了一个“优惠券叠加使用”的功能。你需要:

● 理解所有业务规则(满减券、折扣券、互斥条件、优先级)

● 设计正常场景、异常场景、边界场景(至少50+用例)

● 将用例转化为自动化脚本(Pytest/Playwright)

● 将脚本集成到CI/CD流水线,并维护测试数据

传统方式下,这是一个耗时且容易遗漏的过程。

Agent解决方案:构建“测试设计Agent”

该Agent能够:

● 读取需求文档(PDF/Word/Markdown)

● 提取业务规则,构建决策表和状态转换图

● 自动生成Gherkin场景(Given-When-Then)

● 输出可直接运行的Pytest参数化脚本

● 同时生成测试数据配置文件和Jenkins/GitLab CI流水线片段



实现原理(基于LangChain)

from langchain.agents import create_agentfrom langchain.tools import toolfrom langchain_community.document_loaders import PDFLoaderfrom langchain_core.prompts import ChatPromptTemplate@tooldef extract_business_rules(doc_path: str) -> dict: """从需求文档中提取规则,输出结构化规则集""" loader = PDFLoader(doc_path) pages = loader.load() prompt = ChatPromptTemplate.from_template(""" 从以下需求中提取业务规则,输出JSON格式: - 条件(Condition) - 动作(Action) - 互斥关系(Exclusion) - 优先级(Priority) 需求内容:{content} """) response = llm.invoke(prompt.format(content=pages[0].page_content)) return json.loads(response.content)@tooldef generate_decision_table(rules: dict) -> list: """根据规则生成决策表,覆盖所有条件组合(使用Pairwise或全组合算法)""" # 使用组合测试算法生成最小有效用例集 pass@tooldef generate_pytest_code(scenarios: list, test_data: dict) -> str: """生成pytest参数化测试代码,并附带数据驱动文件""" code_template = """import pytestimport jsonfrom utils.test_helpers import setup_coupon_test@pytest.mark.parametrize("case", json.load(open("test_data/coupon_cases.json")))def test_coupon_stack(case): # 从配置文件加载环境 # 执行操作 # 断言 pass""" return code_template@tooldef generate_ci_pipeline(test_files: list) -> str: """生成GitLab CI或Jenkinsfile,包含测试阶段、并行执行、报告归档""" yaml = """stages: - testtest: stage: test parallel: matrix: - BROWSER: [chrome, firefox] DEVICE: [desktop, mobile] script: - pytest {test_files} --browser=$BROWSER --device=$DEVICE --junitxml=report.xml artifacts: reports: junit: report.xml""" return yamlagent = create_agent( model="gpt-4o", tools=[extract_business_rules, generate_decision_table, generate_pytest_code, generate_ci_pipeline], system_prompt="你是一位资深测试架构师,擅长将需求转化为可执行的自动化测试全链路。")# 输入需求文档路径,一键生成所有产物result = agent.invoke({ "messages": [("user", "分析 docs/coupon_requirement.pdf,生成完整的测试代码、测试数据、CI配置")]})

深度集成:自动化测试的完整闭环

测试数据自动生成:Agent根据规则生成边界值、等价类、异常数据,并输出为JSON/CSV,供数据驱动测试使用。

环境配置管理:Agent可读取docker-compose.yml或K8s配置,生成测试环境的初始化脚本(如准备测试账号、清空缓存、预置优惠券数据)。

并行执行策略:Agent根据用例之间的依赖关系(通过分析共享状态)自动划分可并行的用例组,生成pytest-xdist的配置。

失败重试与自愈:在生成的测试代码中,Agent可注入重试装饰器(如@pytest.mark.flaky(reruns=2)),并对常见网络超时、元素未加载等问题预设等待策略。

CI/CD集成:Agent生成的流水线文件支持多浏览器、多设备矩阵运行,并将测试报告(JUnit、Allure)自动归档,同时触发钉钉/飞书通知。

通过上述设计,原本需要人工编写的测试代码、数据、配置、CI文件,现在全部由Agent自动生成,测试人员只需审核和微调。

案例二:永不失效的UI测试

自适应UI自动化+多模态智能断言

痛点还原

传统UI自动化脚本使用固定定位符(ID、XPath),前端任何微小改动都会导致脚本崩溃。维护成本占自动化总成本的50%以上。

此外,传统断言只能验证文本或属性,无法检测视觉错位、颜色对比度不足、文字截断等UI缺陷。

Agent解决方案:构建“自适应UI自动化Agent”

该Agent具备:

语义定位:根据自然语言描述(如“页面上的登录按钮”)实时识别元素,不依赖固定ID

多模态理解:同时分析截图和DOM树,理解UI的视觉和结构

智能断言:对比基准截图,发现布局异常、文字溢出、颜色错误等视觉缺陷

自适应等待:根据页面动态加载情况自动调整超时,而非硬编码sleep



实现原理

from langchain.agents import create_agentfrom langchain.tools import toolfrom selenium import webdriverfrom selenium.webdriver.support.ui import WebDriverWaitfrom selenium.webdriver.support import expected_conditions as EC@tooldef semantic_find(description: str, timeout: int = 10) -> dict: """根据自然语言描述找到元素,返回坐标和DOM路径,支持动态等待""" driver = webdriver.Chrome() # 轮询页面变化,直到元素出现或超时 for _ in range(timeout): screenshot = driver.get_screenshot_as_base64() dom = driver.page_source response = llm.invoke([ ("system", f"在截图中找到{description},输出元素中心点坐标和XPath"), ("user", [{"image": screenshot}, {"text": dom}]) ]) if response.get("found"): return response time.sleep(1) raise Exception(f"Element '{description}' not found after {timeout}s")@tooldef visual_assert(expected_screenshot_path: str, threshold: float = 0.95) -> str: """对比当前页面与基准截图,返回视觉差异描述,支持像素容忍度""" current = driver.get_screenshot_as_base64() expected = base64.b64encode(open(expected_screenshot_path, "rb").read()).decode() # 使用OpenCV进行结构相似性(SSIM)比较 diff = cv2.compare_ssim(expected, current) if diff < threshold: # 进一步用LLM解释差异区域 explanation = llm.invoke(f"解释以下差异区域:{diff['regions']},用测试报告语言描述") return f"视觉断言失败(相似度{diff:.2f}):{explanation}" return f"视觉一致(相似度{diff:.2f})"@tooldef execute_parallel_on_browsers(instruction: str, browsers: list) -> dict: """在多浏览器(Chrome, Firefox, Safari)上并行执行同一指令,汇总结果""" from concurrent.futures import ThreadPoolExecutor def run_on_browser(browser_name): # 动态创建WebDriver实例 driver = create_driver(browser_name) result = agent.invoke(...) # 递归调用 driver.quit() return result with ThreadPoolExecutor() as executor: results = executor.map(run_on_browser, browsers) return dict(zip(browsers, results))agent = create_agent( model="gpt-4-vision", tools=[semantic_find, visual_assert, execute_parallel_on_browsers], system_prompt="你是自适应UI自动化Agent,根据自然语言指令执行操作并验证视觉表现,支持多浏览器并行。")# 测试脚本示例agent.invoke({ "messages": [ ("user", "在Chrome、Firefox、Safari上同时执行:点击登录按钮,输入用户名test,点击提交,然后验证首页欢迎语,并对比基准截图") ]})

深度集成:UI自动化的工程化实践

1.多模态定位的鲁棒性增强:

● Agent内部维护一个短期记忆,记录最近成功定位的元素特征(截图patch + DOM子树),当页面发生微小变化时,可通过相似度匹配快速定位,无需每次调用LLM。

支持CSS选择器备选:如果语义定位失败,Agent可尝试根据历史经验生成多个可能的XPath,并用试探性点击验证。

2.视觉回归测试的自动化基线管理:

● Agent可与Git LFS集成,自动管理基准截图版本。当UI有意变更时,测试人员只需在Agent对话中输入“更新登录页面的基准截图”,Agent会自动替换旧截图并提交到Git。

支持差异区域标注:Agent将差异区域用红色边框标出,并生成HTML报告,方便人工快速审核。

3.跨浏览器并行执行与结果聚合:

● 利用pytest-xdist或Selenium Grid,Agent动态分配测试任务到不同节点,并将各浏览器的执行日志、截图、性能数据聚合到一个Allure报告中。

● Agent还能自动判断某些缺陷是否为特定浏览器特有(如“仅在Safari上出现布局错位”),并在报告中高亮。

4.失败自愈机制:

● 当元素定位失败时,Agent会尝试重新加载页面、清除缓存、切换网络代理等恢复步骤。

● 若断言失败,Agent会主动捕获控制台错误和网络请求,分析是否为后端接口问题,而非UI本身问题,从而避免误报。

5.性能测试集成:

● 在UI操作过程中,Agent可同时采集LCP、FID、CLS等Web Vitals,并与基准值比较,发现性能退化。例如:“点击结算按钮后,页面响应时间从200ms增加到800ms”。

通过上述设计,UI自动化脚本从“脆弱的固定脚本”进化为“具有感知、适应、自愈能力的智能体”,彻底消除了维护成本。

☑️想涨薪、想走得更远,最稳妥的办法永远是投资自己的技能。

☑️可如果行业的天花板已经压到头顶,与其在原地内卷,不如借AI的东风换个赛道。

☑️软件测试,正是个低门槛、高成长的方向。

即可加入——>【个人号绿泡泡:annasea0928】领转行、入门、提升、需要的各种干货资料

特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。

Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.

相关推荐
热点推荐
穆里尼奥硬刚管理层!全皇马嫌弃的 6000 万水货,他却当宝贝留着

穆里尼奥硬刚管理层!全皇马嫌弃的 6000 万水货,他却当宝贝留着

澜归序
2026-06-21 05:18:50
9月-12月将会上市的7款SUV

9月-12月将会上市的7款SUV

鸭梨说车
2026-08-23 09:35:51
我去医院堕胎,大夫问我缘由,我说对象不爱我了。大夫摘掉口罩,居然是我同居3年的对象,他一脸茫然的看着我

我去医院堕胎,大夫问我缘由,我说对象不爱我了。大夫摘掉口罩,居然是我同居3年的对象,他一脸茫然的看着我

徐侠客有话说
2026-07-16 11:04:15
卫青32岁迎娶43岁的平阳公主,洞房之内公主面露羞涩意欲圆房,卫青却忽然下跪

卫青32岁迎娶43岁的平阳公主,洞房之内公主面露羞涩意欲圆房,卫青却忽然下跪

唠叨说历史
2026-08-14 17:29:22
哈兰德剪掉标志性长发换寸头迎接新赛季,首赛2-1逆转获胜,好友调侃:是不是打赌输了

哈兰德剪掉标志性长发换寸头迎接新赛季,首赛2-1逆转获胜,好友调侃:是不是打赌输了

红星新闻
2026-08-24 13:21:35
上海40岁德国白人外籍幼儿教师:HPV携带者,到处约女生不做防护

上海40岁德国白人外籍幼儿教师:HPV携带者,到处约女生不做防护

踏青云看世界
2026-08-23 07:24:12
北大副校长受贿3195万判8年:任羽中案最可怕的不是贪了多少,而是……

北大副校长受贿3195万判8年:任羽中案最可怕的不是贪了多少,而是……

教师吧
2026-08-24 21:39:23
陈伟霆十年了还没释怀人贩子梗!带长大的侄女出镜,反问“如果是人贩子能养得这么大吗”

陈伟霆十年了还没释怀人贩子梗!带长大的侄女出镜,反问“如果是人贩子能养得这么大吗”

韩小娱
2026-08-22 15:54:28
拆穿剑桥黑人教授造假,美学者被解雇,川普政府下场抨击

拆穿剑桥黑人教授造假,美学者被解雇,川普政府下场抨击

移光幻影
2026-08-24 13:35:13
陪玩陪睡只是开胃!百亿富豪国外偷腥,更下作的还在后面

陪玩陪睡只是开胃!百亿富豪国外偷腥,更下作的还在后面

怪味历史连连看
2026-08-17 15:33:28
《蜘蛛侠:崭新一天》22.2亿美元反超《星球大战》登影史第六

《蜘蛛侠:崭新一天》22.2亿美元反超《星球大战》登影史第六

影视情报室
2026-08-24 00:20:38
比“赌博”还要可怕,6亿人深陷其中,父母血汗钱被年轻人掏空

比“赌博”还要可怕,6亿人深陷其中,父母血汗钱被年轻人掏空

小鹿姐姐情感说
2026-08-23 01:59:44
谁都没能料到,局势竟会出现如此石破天惊的反转!

谁都没能料到,局势竟会出现如此石破天惊的反转!

扶苏聊历史
2026-08-24 14:27:20
扎克伯格2.3亿购爱尔兰19世纪古堡,含11间卧室与4座塔楼

扎克伯格2.3亿购爱尔兰19世纪古堡,含11间卧室与4座塔楼

硅屿手记
2026-08-22 15:17:07
国外兴起全裸度假村?男女同场不穿衣服狂欢,每年能吸引大量游客

国外兴起全裸度假村?男女同场不穿衣服狂欢,每年能吸引大量游客

临云史策
2026-07-10 23:17:05
未来3年,普通人真正的死局根本不是房价下跌。

未来3年,普通人真正的死局根本不是房价下跌。

流苏晚晴
2026-08-24 12:30:08
韩沛颖质问王晓晨“泼了几遍给我说清楚”,随后要求:“给我道歉”

韩沛颖质问王晓晨“泼了几遍给我说清楚”,随后要求:“给我道歉”

韩小娱
2026-08-24 09:17:39
都灵1-2AC米兰!一战验出超级大水货!8000万欧新援碌碌无为

都灵1-2AC米兰!一战验出超级大水货!8000万欧新援碌碌无为

体育世界
2026-08-24 10:24:02
韩红的麻烦越来越大了

韩红的麻烦越来越大了

大张的自留地
2026-07-06 12:55:59
郭德纲结局早已注定!不是输在对错,而是时代需要他“背锅”,人性最丑陋的一面,在这场风波里暴露无遗

郭德纲结局早已注定!不是输在对错,而是时代需要他“背锅”,人性最丑陋的一面,在这场风波里暴露无遗

老郭说v
2026-08-24 01:27:30
2026-08-25 03:27:00
51Testing软件测试网 incentive-icons
51Testing软件测试网
中国软件测试人的精神家园
1632文章数 13284关注度
往期回顾 全部

科技要闻

宇树科技,3天跌了1000亿

头条要闻

"店主扶老人遭索赔1.9万"协议书公开 完整视频披露

头条要闻

"店主扶老人遭索赔1.9万"协议书公开 完整视频披露

体育要闻

42张照片 珍藏世界杯的热辣滚烫

娱乐要闻

韩沛颖开撕《主角》剧组引发全网热议

财经要闻

宇树IPO:追高、被套,多久能回血?

汽车要闻

智能超混 国民家轿 上汽大众ID. ERA 5S上市 限时8.99万元起

态度原创

手机
健康
亲子
公开课
军事航空

手机要闻

Lava在印度推出Virat V1 Pro 5G手机,搭载紫光展锐T8200芯片

孩子有脊柱侧弯,还能正常运动吗?

亲子要闻

自从去了游泳后,阿金被小霖霖整懵了,笑到无语,像绕口令一样

公开课

李玫瑾:为什么性格比能力更重要?

军事要闻

美国与以色列发生“罕见冲突”

无障碍浏览 进入关怀版