登录社区云,与社区用户共同成长
邀请您加入社区
本文介绍了Appium自动化测试中的高级手势操作和Toast操作实现方法。手势操作部分详细讲解了6种核心交互:1)轻敲(tap)、2)按下与抬起(press/release)、3)等待(wait)、4)长按(long_press)、5)移动(move_to),并通过WiFi设置页面的完整代码示例演示了组合使用方式。Toast操作部分说明需要配置"automationName":
摘要 端到端测试(E2E)常因环境不一致导致失败,表现为本地通过而CI失败、共享环境冲突、外部服务不稳定等问题。本文提出三种解决方案:1)使用Docker Compose编排中间件,通过健康检查确保服务就绪;2)采用Testcontainers实现代码化环境管理,与JUnit深度集成;3)复杂场景下利用Kubernetes部署完整微服务拓扑。核心目标是实现"一键拉起、即测即毁"的可靠测试环境,解决
系统主要面向大学生群体,结合中医体质辨识理论与人工智能技术,为用户提供体质测评、健康记录、AI养生咨询、个性化调养建议以及养生知识学习等服务,同时提供后台管理平台,方便管理员完成用户管理、题库维护、养生文章管理、健康记录管理、数据统计分析等工作,实现大学生中医养生知识普及的信息化管理。系统主要功能包括登录注册、体质测评、AI养生问答、调养档案、健康记录、养生文章浏览、个人中心以及后台数据分析、用户
本文摘要: 针对大语言模型(LLM)在电商场景中的幻觉和安全隐患,提出系统化测试方案。知识测试涵盖事实性(准确率)、推理(正确率)和幻觉检测(虚构问题编造率),实测显示未优化的模型幻觉率高达70%。安全测试聚焦四类攻击:有害内容、隐私泄露、Prompt注入和Jailbreak,关键发现包括:规则过滤对已知攻击拦截率100%,但需结合LLM检测应对变体攻击。交付物包含标准测试集(如30个事实问题、2
为这些领域构建的软件应用程序不能承受崩溃、数据损坏或系统故障,即使是小规模的,因为很多人的生活都会受到影响。这些软件中的错误可能会造成不可逆转的损害,并使公司面临诉讼风险。当需要人工的洞察力和判断力时,手动测试是合适的,而自动化测试更适合于进行细微调整的重复流程。蜂巢模型是一种现代的软件测试方法,其中集成测试是主要关注点,而单元测试(实现细节)和 UI 测试(集成)受到的关注较少。这些资料,对于做
摘要: 这是一个将AI与自动化测试结合的轻量级工具脚本,通过接口文档自动生成测试用例、pytest脚本并执行测试。用户只需提供api_doc.txt文件,运行脚本即可获得测试用例文档、可执行脚本和HTML报告。工具利用GPT生成内容,整合了Prompt工程、RAG和API调用,覆盖测试全流程。还可升级支持多接口、报告总结和工程化代码结构,适合进阶开发者将AI能力产品化。该方案体现了从"使用AI"到
本文提供了详细的ClaudeCode配置教程,帮助开发者无缝接入国产大模型DeepSeek。教程详细介绍了Windows和Linux/Mac系统的配置差异,并提供了环境变量设置、错误排查等实用信息,帮助开发者低成本高效使用国产AI编程助手。
- 良率=好Die/总Die,但选错模型可能差17个百分点- Poisson模型过于悲观,Murphy居中,**Negative Binomial才是业界标配**- 关键不是良率数字,是**跟踪聚类因子α的变化**——它能早几周预警工艺漂移- Chiplet时代,10颗90%良率的Die封在一起,整体良率只有35%
本文用生活化的比喻清晰区分了AI开发中的五个核心概念: Tool(工具):单一功能的"傻小子"(如厨房电器),只管执行不问原因 Toolset(工具集):按岗位分配的工具箱(如装修队不同工种的专用工具),控制权限范围 Skill(技能):操作指南(如菜谱),知道"先做什么后做什么"的方法论 Agent(智能体):自主决策的"大厨",能规划
摘要:本文介绍了一个AI驱动的自动化接口测试工具方案,仅需几十行代码即可实现从接口信息输入到测试报告输出的全流程。核心流程分为三步:1)用GPT生成测试代码字符串;2)保存为.py文件并用pytest执行;3)生成HTML测试报告。方案提供完整可运行的Python脚本示例,支持自定义接口信息,并能通过简单改造实现多接口测试、AI生成报告摘要等功能。该工具虽轻量但实用,适合快速验证接口、临时回归测试
本文是一篇面向初学者的**大模型开发实战入门指南**,旨在帮助开发者快速跨越从零到一的门槛,在一个下午内构建出第一个可运行的智能助手Demo。
文章摘要: 本文探讨智能编码助手如何提升开发效率,从日常编码到复杂业务逻辑实现。通过10个关键维度,分享如何将重复性工作交给AI处理,包括:1)智能补全与样板代码生成,减少机械性编码;2)自然语言转代码实现,降低业务逻辑实现门槛;3)重构建议与代码优化,提升代码质量;4)API文档自动生成与查询,加速开发流程;5)测试用例智能生成,保障代码可靠性。文章通过具体场景和示例代码(如Redis配置类生成
聊天功能是否正常,知识问答是否正确触发,RNA任务是否正确识别,多任务是否正确拆解,多序列是否正确解析,错误输入是否合理处理,回归问题是否再次出现。在我们的项目中,测试重点不只是单纯验证模型是否返回结果,而是验证整个调用链路是否稳定可靠。我们设计了一套完整的chat接口测试用例方案。自然语言输入 → 路由 → 参数解析 → 任务调用 → 结果组织 → 解释返回。
针对IMA架构带来的系统升级变革、DO-178C/GJB等标准对适航提出的更高要求、市场竞争对研发周期和成 本的挑战,凯云构建了“国产自主可控软件平台+国产硬件生态+仿真模型”三位一体的航空行业半实物仿真测试 解决方案。解决方案对标国外技术体系,具备全国产自主可控、高实时高保真的核心优势,全面覆盖航空电子系 统,支持快速原型验证、硬件在环测试、系统集成验证等多种测试场景,满足从单机设备、子系统到整
SimuCard可与工业现场硬件构架平台结合,运用特有的部分动态重配置技术,便捷地将MATLAB、 MWORKS生成的数学模型比特流文件部署到板卡的FPGA核心上,实现硬件在环强实时仿真。此外,借助仿真卡的 高速接口,搭配多种类型、资源丰富的扩展子板,可对模拟、数字、混合信号、光电信号等全类型、多协议信号的仿 真和解析,特别适用于电机驱动器、电机负载、机器人关节驱动等仿真应用场合,也可进行定制化设
总之,在确认覆盖需求的基础上,通过质量模型的特性进行思考补充,熟练使用质量模型过程实际是在对系统比较熟悉的基础上进行扩展补充,当然这个过程可以借助内部测试人员的讨论和评审补充会更加完善。这些资料,对于做【软件测试】的朋友来说应该是最全面最完整的备战仓库,这个仓库也陪伴我走过了最艰难的路程,希望也能帮助到你!凡事要趁早,特别是技术行业,一定要提升技术功底。
支持永磁同步、直流无刷、异步、步进等多类型电机,通过 Clark 变换、Park 变换等精准算法模型,实现电流、转速、位置的解耦控制。无论是高频负载波动的极端工况,还是缺相、传感器失效的故障场景,都能精准复现,避免风险遗漏。支持故障注入测试,验证传感器失效等场景下的容错能力,同时通过能耗优化测试,找到转速稳定性与能耗的最优平衡点,延长无人机续航。如今,凯云电机控制原型验证解决方案的出现,为这些行业
本研究提出了一种融合ST-GCN、自注意力机制和PPO的高速公路应急车道智能决策框架。通过YOLOv8提取交通参数,构建时空图模型捕捉交通流特征,结合PPO实现动态决策。实验显示,该模型在车流量(3.83)、车速(4.21)、密度(0.07)预测RMSE表现优异,拥堵检测准确率达92.1%,应急车道决策精确率70.0%、准确率87.5%。该框架实现了从状态感知到决策优化的闭环管理,为缓解高速公路拥
数据库迁移回滚测试:避免生产事故的关键实践 数据库迁移是高风险操作,但大多数团队仅测试正向执行而忽视回滚测试,导致生产事故频发。本文揭示了未测试回滚脚本的严重后果:数据不一致、版本冲突、性能问题等。文章对比了Flyway和Liquibase在回滚支持上的差异:Flyway社区版需手动管理回滚脚本,而Liquibase原生支持但常被开发者忽略。 核心难点在于回滚测试需要真实数据库环境、数据一致性保障
MXAM:高效建模质量检测与自动修复工具 摘要:本次研讨会介绍MESModelExaminer®(MXAM)工具,它能对Simulink®等模型进行全面静态分析,帮助开发者在时间压力下确保模型质量。MXAM不仅可检查建模规范、分析模型结构,还能自动修复违规问题,过程透明可控。研讨会将演示其功能,包括模型指标评估与重构案例,适合嵌入式软件开发及测试相关人员参与。议程涵盖静态测试原理、工具实操演示及配
针对传统人工排查 CI 测试失败的诸多痛点,介绍借助 Parasoft DTP 的机器学习功能自动分类测试失败根因的方案,并讲解使用技巧与 AI 赋能 QA 的价值。
计算机视觉项目全链路优化指南 本文提供从性能诊断到生产部署的一站式解决方案。首先介绍如何利用Profiler工具链(cProfile、memory_profiler)精准定位CPU/内存瓶颈,通过向量化计算和并发编程(多进程+异步I/O)提升核心算法效率。
SCA(软件成分分析)工具的核心价值在于实现软件供应链的可视化与可追溯,其功能涵盖资产盘点、漏洞检测、许可证合规等多维度。企业部署SCA主要受合规驱动(如金融、汽车、关基行业需满足国内强制法规)或风险驱动(如开源漏洞防范)。国内重点行业法规(如金融JR/T0290、汽车GB44495、关基GB/T43698)正加速SBOM标准化进程,而欧盟CRA则推动了全球趋势。SCA的五层功能从基础资产清单到高
测试人员和开发人员不需要把手机买回来,也不需要自己维护设备,只要在线选择目标机型,就能远程操作真实手机,完成APP安装、启动、功能验证、日志采集、截图录屏和问题复现。它提供3000+款真实手机、99%市场主流机型覆盖、7×24小时在线服务、远程真机操作、ADB命令行、截图/日志/视频输出、AI探索测试和设备托管能力。所有套餐均包含主流机型覆盖、画面清晰、操作灵敏、声音采集、异形屏幕适配、真机在线租
基于Transformer架构,预训练+微调两阶段规模差异:百亿~万亿级参数 vs 百万~千万级能力差异:多任务(写作/编程/推理)vs 单一任务(分类/翻译)关键区别:零样本/少样本学习能力,输入空间无限大测试影响:输出是概率性的,断言方式完全不同Prompt是用户给模型的输入指令,决定了模型的输出方向同样的模型,不同的Prompt可能给出完全不同的答案测试Prompt就是验证:模型是否按预期理
QA Use 不是一个简单的脚本工具,而是一整套 AI 驱动的企业级测试解决方案。传统QA工作QA-Use赋能后写代码维护测试脚本描述需求,AI执行页面变更后批量修脚本AI自动适应,自愈修复手工回归测试,耗时耗力定时自动执行,无人值守Bug发现依赖人工探索AI主动探索,发现边界问题技术人员专属工作全民参与质量保障QA-Use代表了质量保障的范式转移从脚本驱动到意图驱动从人工维护到AI自愈从事后发现
本文摘要(148字): 研究揭示智能体在代码生成与调试中的能力差异:测试显示,智能体生成电商计算代码(如销售额统计)正确率达100%,但调试同比环比代码时多次失败,需3轮才修复筛选逻辑错误。文章提出代码能力评估四维度(正确性、效率、风格、调试),并设计梯度测试集验证。关键发现:生成任务平均耗时143-176秒,调试简单bug仅64.5秒;复杂bug调试正确率显著低于代码生成。配套提供40个测试用例
本篇文章整理了软件测试零基础核心知识点,涵盖软件基础概念、软件生命周期、主流测试类型、测试阶段分类、黑白灰盒测试、软件质量模型、常用测试用例设计方法(等价类、边界值、判定表、场景法、错误推测法)、软件缺陷理论与禅道管理流程。同时结合Web 登录功能实战,编写了 33 条可直接落地的标准化测试用例,覆盖正向、逆向、兼容性、安全、性能、会话等全场景,适合零基础入门、期末复习、面试备考、项目实操学习
这里的text.txt就是你刚刚新建的txt文档,然后result.txt就是用allpairs工具生成的正交表后建立的新文档,这个不需要你提前建立。比如姓名,电子邮箱和密码等都需要考虑填写和不填写的情况,一共就需要编写2的5次方,也就是需要编写32个测试用例。第三步,将excel表中的内容复制到新建的txt文档中,除此之外,不需要进行任何的操作,然后保存txt文档。第四步,打开cmd命令窗口,找
本文系统介绍了Android调试工具ADB的使用方法和应用场景。主要内容包括:ADB环境安装配置、常用命令(设备管理、应用安装卸载、日志抓取、性能监控等)、Monkey稳定性测试方法,以及敏捷开发模型和APP发布策略。重点讲解了ADB在APP测试中的实际应用,如获取包名、启动时间分析、内存/CPU监控等性能测试技巧,并对比了瀑布模型与敏捷开发的差异。文章为移动应用测试人员提供了全面的ADB工具使用
【2026年AI测试工程师核心能力地图】随着AI技术快速发展,企业对AI测试工程师的要求已发生本质变化。本文提出6项核心能力体系:1. 基础门槛(前3项必会): Python编程:需掌握API调用、数据处理等实用技能 大模型理解:重点认知能力边界而非训练原理 Prompt工程:掌握7大核心技巧如角色设定、任务拆解等 关键差异点: Agent框架能力(核心):需精通LangGraph等框架搭建测试智
文章摘要:本文探讨了智能体在多轮对话测试中的表现衰减现象及其评估方法。研究发现,智能体的记忆能力随对话轮数增加呈阶梯式衰减:3轮内准确率100%,5轮降至80%,8轮45%,12轮仅20%。文章提出五维评估框架:信息记忆(半衰期模型)、指代消解(阶跃式退化)、话题切换、冲突处理和语义漂移,并开发了支持模糊匹配的MemoryRecallScore评分算法(0-1分制)。测试数据显示,在固定窗口策略下
本文介绍了linux命令在文件中使用常用命令,项目部署环境的步骤,以及docker容器进行企业项目管理和部署的过程,使得项目能够在开发、测试、运维等任意环境运行,最后介绍了两个项目部署小项目供学习。
本文介绍了如何系统化构建AI Agent的测试用例体系,提出了三层拆解法(能力域→能力项→能力点)和六维能力模型(任务规划、工具使用、多轮对话等)。以电商数据分析Agent为例,展示了190条测试用例的科学分配方法:任务规划(40条)、工具使用(30条)等核心能力占主导,安全测试单独设置145条攻击用例。文章包含真实用例模板和评分逻辑演示,并指导如何新增情绪识别用例。最后提供了完整的数据集验证信息
开放架构BMS半实物HIL仿真系统基于研华高性能工业电脑和凯云SimuRTS软件,将真实BMS硬件接入高保真虚拟电池环境,构建“电芯-模组-电池包-整车”闭环测试链,提供桌面HIL和通用HIL,成为新能源汽车动力系统研发的安全基石与效率引擎。系统采用模块化、标准化设计,具备16+多核高性能实时机。支持多厂商设备无缝集成,提供仿真实时机、接口硬件、BMS模型、故障注入与测试工具等、显著缩短BMS研发
写入能力:KaiwuDB 原生时序引擎优势突出,吞吐碾压 PG 时序化方案,高并发写入更稳更强。查询表现:整体领先,复杂查询拉开百倍差距,并发越高优势越明显。稳定性:数据量越大、并发越高,TimescaleDB 衰减越严重;KaiwuDB 波动极小,更适合长期高负载运行。架构差异:原生时序 vs PG 插件化,在高吞吐、高并发、复杂查询场景的差距被彻底放大。
对正在赶时间节点的作者来说,真正有价值的不是多给几个期刊名称,而是帮助作者更快知道:这篇文章更适合投哪里、投稿后能不能更快给到预审结果、下一步该如何推进投稿进程。市面上很多期刊匹配工具,等来等去只给了个大致的期刊列表,后续是否合适、是否有预审通道、能不能快速反馈,仍需要进一步判断。10秒即可从SCI、SSCI、EI、Scopus、ESCI、中文核心、CSCD 等合作期刊资源中精准匹配到目标期刊,通
文章摘要:本文提出了一种三层评分机制,用于评估Agent输出的质量。第一层是规则评分,基于明确条件判断,覆盖100%用例但只能评估结构化指标;第二层是LLM评分,用于评估模糊质量指标,通过3次评分取中位数减少波动;第三层是人工抽检,处理分歧大的用例。三种方式组合使用:规则打底、LLM补充、人工兜底,确保评分稳定可靠。文章还提供了具体实现代码,包括规则评分细则、LLM评分Prompt模板和人工抽检流
【昇腾CANN】GE图引擎架构原理:让模型跑得快的隐形引擎
智能体可测性设计:从黑盒到透明化 智能体常因缺乏日志和状态追踪导致失败难以排查。本文提出四个维度的可测性改造方案: 日志标准化 结构化JSON日志,包含trace_id、阶段标记、执行状态等关键字段,实现机器可读与问题追溯。 状态暴露 通过get_state接口实时获取智能体进度(如已完成/失败子任务、当前阶段),支持断点调试。 确定性控制 固定temperature(≤0.3)、种子和模型版本,
对 Hical、Drogon、Cinatra 三个 C++ Web 框架进行高并发压测对比,揭示协程模型在万级连接下的性能瓶颈。
语音客服体验优化方案摘要 当前语音客服系统存在四大痛点:IVR分流率低、人工坐席超负荷、方言识别差、体验测评单一。解决方案聚焦三大业务场景: 智能语音客服:提升复杂意图解析能力,避免多轮对话失效; IVR导航:简化菜单层级,支持混合交互,减少用户认知负担; 人工客服:优化AI与人工交接,避免信息重复提交。 通过三维指标量化改进效果: 效率:IVR直达率、自助闭环率; 质量:多轮容错率、关键信息提取
在AI席卷行业的今天,有一个真相必须认清:淘汰技术人的从来不是AI,而是“只会写代码、不会定义问题、拒绝进化”的固化工作方式。
很多工作了三四年的测试工程师,技术其实不差,Python会写,自动化框架搭过,性能测试也做过,但是简历投出去没人理。原因只有一个,简历没有跟上行业的变化方向。
测试环境不隔离,评测结果不可比。隔离分三个层次:进程隔离、数据隔离、网络隔离。Mock 是网络隔离的核心。与默认表一致时,search(经营/报告双场景)web_fetch、LLM 调用等最易引入外部不确定性的环节应优先 Mock,覆盖成功、失败、超时三种场景。状态重置是数据隔离的核心。每次测试前重置 8 项内容,memory 里不能残留上一次查询的客户数据,避免用例之间状态互相污染。下一篇讲可测