登录社区云,与社区用户共同成长
邀请您加入社区
Airtest 是网易出品的跨平台 UI 自动化测试框架,主打图像识别和 Poco 元素定位,适配游戏、Android、iOS、Windows 等多端;Pytest 是 Python 生态最主流的测试框架,支持用例管理、参数化、夹具、报告生成等能力。但众所周知,Airtest IDE虽然赋予了强大的能力,但所需资源很大,也不够灵活,因此,在进阶下,我们脱离Airtest IDE ,使用Pycahr
最终用Pytest+Allure搭了一套CI/CD流水线,能覆盖AI接口的特殊断言需求,并且在每次模型更新或Prompt改动时自动回归。AI接口返回的是概率性结果,同一个请求跑两次,回答可能不一样。传统接口校验"等于什么",AI接口校验"像不像""有没有不该有的""是不是在合理范围内"。这套方案在我们的RAG问答系统和Agent工具调用链路上跑了半年,累计发现37个线上问题,其中11个是传统测试没
pytest-selenium是一个将Selenium浏览器自动化功能集成到pytest测试框架的插件,支持Chrome、Firefox等主流浏览器。它简化了测试流程,自动管理浏览器生命周期,提供失败截图和源码捕获功能。安装简便(pip安装),支持本地和远程(Selenium Grid)测试,可生成HTML报告,并适配CI环境的无头模式。通过内置fixture,开发者能直接调用浏览器实例编写测试,
摘要: pytest-xdist是pytest官方维护的插件,通过并行执行大幅缩短测试时间。其核心原理是将测试分发到多个CPU进程(支持-n auto自动检测核心数),解决串行测试的资源浪费问题。此外支持分布式执行(跨机器)、--looponfail模式(仅重跑失败用例)及测试隔离(避免共享状态干扰)。适用于测试量大或执行时间长的项目,尤其在CI环境中效果显著(如15分钟降至3分钟)。需注意处理共
AI 都能写测试了,我是不是要失业了?不会。但你的工作方式会彻底改变。以前,测试工程师的价值体现在"写测试用例"。AI 不知道应该测什么,但你知道AI 生成的代码需要你来审核和优化AI 只能测试已知路径,你才能发现未知的 bug怎么组织测试代码、怎么管理测试数据、怎么设计 CI/CD 流水线这是 AI 永远替代不了的所以,与其担心被 AI 替代,不如学会驾驭 AI。把写测试的时间从 30 分钟压缩
我们提出“契约即 fixture”契约类型实现方式示例场景状态契约确保每次测试前 DB 为空行为契约自动拦截所有 HTTP 调用演进契约动态注册 +对同一接口,自动为 v1/v2/v3 版本生成参数化测试# 动态加载 API 契约配置```### 2. 在测试中声明契约依赖```python# 契约驱动的断言:无需硬编码字段名# 演进检测:v2 必须兼容 v1 字段assert "email" i
RAG系统关键信息丢失问题与滑动窗口分块解决方案 在构建生产级RAG系统时,常见的关键信息丢失问题往往源于传统固定分块方式对跨块上下文的切断。本文系统分析了滑动窗口分块(Sliding Window Chunking)的最优实现方案: 问题本质:当关键信息被分割在不同分块时,传统固定分块会导致语义不完整,即使使用BGE-M3等先进embedding模型也无能为力。 理论推导:研究表明,在512-t
文章摘要 Pytest是一个基于Python的开源测试框架,专为自动化测试设计。相比直接运行Python代码,Pytest能自动识别测试用例,无需手动编写main函数,并提供批量执行、结果断言、测试报告等功能。它解决了传统测试方法中的诸多痛点:无法自动判断结果正确性、难以批量执行测试、缺乏测试报告、测试数据管理困难以及测试环境复用问题。Pytest通过特定的命名规则(如test_前缀)自动发现用例
本文介绍了一个基于Python、Pytest和Playwright的AI智能问答平台UI自动化测试框架。该框架采用分层架构设计,包含公共工具模块、测试数据目录、页面对象层和测试用例层,实现了登录态复用、参数化测试、POM模式封装等功能。核心流程包括:通过conftest.py管理全局fixture;使用storage_state复用登录态;采用POM模式封装页面操作;结合JSON文件实现数据驱动测
摘要 本文介绍了使用 pytest 测试 AI 应用的核心策略,重点解决 LLM 测试中的三大难题:随机输出、API 成本高和响应慢。通过 Mock LLM API 调用,开发者可以精确控制测试环境,避免真实消费。文章详细讲解了 pytest 的 fixture 机制、参数化测试方法,以及如何模拟 LLM 返回工具调用指令等关键场景。示例代码展示了测试夹具的配置、消息构建验证和工具调用测试等实战技
开源项目AIFlowArchitect推出TrustEngine,专注解决AI生成内容的质量审查问题。该项目并非传统AIAgent框架,而是作为独立审查中间件,为现有AI工具提供质量控制功能。核心创新包括:零状态审计、多模型交叉仲裁、证据链可追溯和不确定性透明。TrustEngine可与CrewAI、LangChain等主流工具无缝集成,通过三行代码即可添加质检系统。项目还提供完整的三脑工作流,将
AI Flow Architect 正式发布 V2.0 版本,完成了从单一框架到完整防幻觉生态的跨越。本次更新落地了 6 大核心方案,推出独立的 TrustEngine 审查模块,支持 CLI、Python SDK、LangChain、CrewAI、OpenAI SDK、GitHub Action 6 种零侵入接入方式,真正实现 "任何语言、任何流程、任何场景" 都能用上 AI 质量保证。
摘要:AIFlowArchitect项目从框架转向信任中间件,推出独立TrustEngine模块,可在不改变现有工作流的情况下为AI生成内容提供审计。核心设计采用多元仲裁机制,通过三个独立AI模型(如GPT-4o、Claude-3.5等)并行审查,输出带置信度评分的TrustReport,并明确标注不确定领域。项目支持多种接入方式(API/IDE插件/GitHub Action),已完成177个单
摘要:AIFlowArchitect v0.1发布,创新性提出"三脑架构"解决AI幻觉问题。该框架通过规划脑生成方案、对手脑多维度挑战(安全/成本/用户体验等)、仲裁脑质量审核的三阶段强制流程,将质量控制前置。相比主流框架更注重可靠性而非灵活性,内置4种零配置Token节省机制,实测可节省60%成本。目前已支持OpenAI、Anthropic等主流模型,具备114个单元测试保障
开源AI工作流引擎AI Flow Architect,针对主流AIAgent框架的"自审盲区"问题提出创新解决方案。该引擎采用"双脑隔离架构",强制使用不同模型分别负责任务规划和结果审核,从根源上避免AI自我验证的幻觉问题。实测显示可减少60%Token消耗,并内置语义缓存、自动压缩等优化机制。支持OpenAI、Anthropic等主流模型及本地Ollama
这篇《零基础 5~8 个月》的精简版,而是专门给**「会测但不确定要补多少」脑子能不能接受没有唯一标准答案**(换脑约线 A、线 B 各块细节需要时再翻零基础篇对应节;本篇只写:跳过什么、硬磕什么、做到什么算过关、怎么排四个月。:测试员周周 | 14 年测试老兵:约 10 分钟:《零基础转AI测试,5到8个月照着走》——需要某一块「学到哪就够」时再去翻。
LiteReport 是一个专为 pytest 设计的轻量级测试报告工具,解决了传统报告工具(如 Allure)依赖 JDK、安装复杂的问题。它提供一键生成单 HTML 文件报告,支持明暗主题切换和中英双语,无需额外依赖,适合中小团队快速查看测试结果。相比 Allure 需要 JDK 和多步配置,LiteReport 只需 pip 安装即可使用,生成的报告可直接双击打开,简化了 CI/CD 集成流
有件事我拖了很久——项目里有个账单工具模块,billing.py,260 行,核心业务逻辑。处理逾期费、折扣计算、发票日期。一天被调几十次。测试覆盖率:0。不是不想写。写好测试要构造几十种边界情况:闰年 2 月的日期、跨年逾期、边界折扣率、同一客户多张发票的合并。想想就手酸。这次我把这摊活丢给了 Claude Code,看它能覆盖到什么程度。
《AI测试踩坑指南:从传统测试到智能体测试的转型经验》 本文分享了一位14年测试老兵从传统测试转向AI测试时遇到的典型问题。作者发现,传统测试中99%通过率的接口测试方法在AI测试中完全失效——上线后用户投诉率高达40%。核心问题在于测试集设计存在严重缺陷: 测试用例缺乏层次性,全部集中在简单主路径场景,忽略了复杂交互 未覆盖边界情况(如超长输入、空输入等) 缺少鲁棒性测试(用户输入不规范、中途改
上一篇文章里,我从两个 Playwright 脚本讲起:第一个脚本,用来验证不同设备环境下,首次游客登录是否会生成不同游客。第二个脚本,用来验证点击 SDK 页面按钮之后,是否真的发出了正确的网络请求,并且请求参数和响应数据是否符合预期。所以我开始把这套 H5 SDK 自动化测试从单脚本,重构成数据驱动框架。这篇文章继续往下讲一个更具体的问题:CSV + YAML 到底怎么描述一条自动化测试?我的
摘要: 文章探讨了AI驱动的测试智能体(TestAgent)如何革新传统自动化测试。通过结合LLM(大语言模型)与Pytest框架,测试脚本具备动态修复能力:当元素定位失效或接口变更时,系统能自动分析错误、调整代码并重试,实现"自愈"。核心架构包括规划器(理解需求)、执行器(运行测试)和反思器(纠错优化)。相比传统脚本的脆弱性,这种方案显著降低维护成本,但需注意控制上下文长度、
数据质量评估的六个关键维度:准确性(正确性)、完整性(必填字段缺失率)、一致性(数据自洽程度)、时效性(数据新鲜度)、代表性(样本分布匹配度)和合规性(数据合法性)。文章通过金融AI案例说明各维度测量方法及权重,指出代表性最难测量(需KL散度计算),合规性具有一票否决权。提供Python代码实现六维度量化评估,强调应关注最低维度分数而非综合评分。修复优先级建议:合规性>准确性>一致性>代表性>完整
测试老兵周周分享了一套高效自动化测试方案:通过Markdown文件+AI自动生成测试脚本,实现API、UI测试全流程自动化。该系统包含技能文档、本地脚本生成器和CI流水线三部分,支持5种测试类型,30秒即可生成可运行脚本。提供11个开箱即用的模板,并集成GitHub Actions实现代码提交后自动测试。方案结合AI辅助生成和本地模板展开两种方式,显著提升测试效率。作者还分享了完整的技能包,包含测
1.pytest是一个非常成熟的全功能的Python测试框架,主要有一下几个特点:简单灵活,容易上手,支持参数化2.能够支持简单的单元测试和复杂的功能测试,还可以用来做selenium、appium等自动化测试,requests+pytest接口自动化测试pytest-selenium(集成selenium)pytest-html(完美html测试报告生成)pytest-rerunfailures
摘要:本文记录了从零搭建自动化测试项目的实践过程。项目包含Flask模拟后端服务、HTML前端页面,使用pytest+requests进行API测试,Playwright实现前端自动化测试,并通过GitHub Actions实现持续集成。文章重点分享了解决跨域问题、测试隔离和pytest输入捕获等核心难点的方案,展示了参数化API测试和Playwright前端测试的代码示例。该项目帮助作者系统掌握
模型结构创新永无止境,关键是要理解每个模块的数学本质——TCN的本质是可控感受野的CNN,BiGRU是带遗忘门的双向记忆,而Attention是动态特征加权器。本代码首先通过时序卷积神经网络TCN提取输入数据特征,然后将时序卷积神经网络TCN提取特征输入双向门控循环单元BiGRU,最后将双向门控循环单元BiGRU输出通过自注意力机制Self_Attention获得回归预测结果。比如预测t+1时刻的
本文介绍了一个基于Playwright + Pytest的企业级Web UI自动化测试框架解决方案。Playwright相比Selenium具有更快的执行速度、内置自动等待机制、原生多浏览器支持等优势。框架采用分层架构设计,包含测试用例层、页面对象模型层(POM)、插件层和Playwright API层。核心特性包括:1) POM模式封装页面元素和业务操作;2) 三层Fixture机制实现依赖注入
上周排查一个生产环境问题,用户上传文件偶尔会超时,日志里没有任何异常堆栈。最初怀疑是Nginx配置问题,折腾半天无果。后来在本地用curl循环测试了上百次,终于复现了一次——服务端日志显示请求进来了,但业务逻辑根本没执行。问题出在依赖注入的一个异步函数里,某个条件分支下忘了写await。这种问题在开发时很难发现,因为大多数测试用例都走了正常流程。这件事让我重新审视了测试策略:光有单元测试不够,集成
写 Selenium 测试写到怀疑人生?选择器一改全挂?试试 Amazon Nova Act——亚马逊云科技推出的 AI 浏览器自动化 SDK,用自然语言描述操作,AI 自动在浏览器里执行。这篇从零开始:安装 Nova Act → 写第一个测试 → 集成 pytest 生成报告 → 实际落地到 OpenClaw Agent 管理场景。
Locust性能测试指南摘要 本文介绍了使用Locust进行性能测试的完整指南,包含以下核心内容: 性能测试基础:涵盖负载测试、压力测试、稳定性测试和容量测试四大类型,并详细说明了响应时间、吞吐量、并发数等关键指标。 Locust框架:介绍其基于协程的高效并发模型、分布式架构和Web UI界面,提供安装命令和核心组件说明。 测试开发:展示如何编写User类、定义测试任务(包括权重分配和顺序执行),
本文介绍了Python测试框架pytest的核心使用方法。主要内容包括: 测试基础:阐述了测试的重要性,介绍了测试金字塔模型(单元测试、集成测试、E2E测试)及其特点。 pytest基础: 安装配置方法 编写简单测试用例示例 常用断言类型(相等、包含、异常等) Fixture的使用(资源管理、作用域控制) 高级特性: 参数化测试(单参数和多参数) 组合测试 Web应用测试示例(Flask) 实践指
不对哦我翻的可研是张北(±500kV柔直)→冀北康保(±500kV柔直)→冀北丰宁(±500kV柔直抽水蓄能配套受端)→北京延庆(±500kV柔直北京主网接入),直流架空线的参数:R0≈0.008Ω/km,L0≈0.9mH/km,C0≈0.012μF/km,长度分别是张北-康保100km,康保-丰宁120km,丰宁-延庆180km——新手别直接用默认的直流线参数,默认的是±800kV或者更长的,参
但一旦调整a/b比例,比如设为1.5,原本圆润的亮环就像被压扁的自行车轮胎,变成了标准椭圆。论文介绍:全介质超表面实现宽带任意阶次完美涡旋光束的产生,完美涡旋光束是涡旋光束的一种,其涡旋图像不随着拓扑荷l的变化而变化,同时可以通过调节参数实现拓扑图像从圆变向椭圆的过程,应用于光学加密和全息等领域。论文介绍:全介质超表面实现宽带任意阶次完美涡旋光束的产生,完美涡旋光束是涡旋光束的一种,其涡旋图像不随
电机振动噪声分析电机多转速工况下的NVH分析,有模型文件,教学视频在电机领域,振动与噪声(NVH)分析可是相当关键的一块内容,尤其是在电机处于多转速工况时。今天咱就好好唠唠这电机多转速工况下的 NVH 分析,顺便提提那些超有用的模型文件和教学视频。
本系统实现了一个基于模型预测控制(Model Predictive Control, MPC)的楼宇温控负荷需求响应优化解决方案。该系统针对建筑楼宇的储能特性,通过智能调度冰蓄冷系统的运行,在保证建筑舒适度的同时,有效降低能源成本并参与电力需求响应项目。
通过Matlab/Simulink搭建的这个三相四桥臂逆变器仿真模型,结合电压外环、电流内环控制策略以及各个关键模块,实现了在不平衡负载下依旧能保持输出电压对称的功能。这里面每一个模块都像是精密仪器里的小零件,各自发挥着不可或缺的作用。大家要是对电力电子仿真感兴趣,不妨自己动手在Matlab/Simulink里搭建这个模型,深入探究其中的奥秘哦!我这里还有些相关笔记,后续也可以分享给大家,一起交流
冻土三场耦合的难点在于物理场的交叉影响:水分迁移影响温度,温度又反过来驱动相变,最后应力场还要吃透前两者的结果。代码配置上,PDE方程的对流项、材料属性的非线性设置、求解器的分阶段策略,都是需要反复调试的点。最后附上模型文件(见文末链接),里面注释了关键参数和边界条件。遇到报错别慌,优先检查单位是否统一(有人把小时和秒混用过吗?别问我怎么知道的…)。
天然气水合物降压开采,基于COMSOL热-流-固多场耦合实现,同时可以表征开采过程中的储层孔隙度、渗透率的演化,考虑水平井筒环空高压充填石英砂层,有水平井和压裂水平井模型。在能源领域,天然气水合物作为一种极具潜力的清洁能源,其开采技术一直是研究热点。今天咱们就聊聊基于 COMSOL 的天然气水合物降压开采模拟,这其中涉及热 - 流 - 固多场耦合,还能表征储层孔隙度、渗透率的演化,并且考虑了水平井