Not translated yet — showing the Chinese originals.
常见问题
关于 OpenQA、Agent PR 独立验收、证据充分性、合并与发布结论,以及测试、安全和运行时验证能力的常见问题。
关于 OpenQA
查看完整说明 →智测 OpenQA 是什么?
智测 OpenQA(openqa.cn)是 AI 时代的软件验证基础设施,也是面向 AI Coding Agent 的开放软件验证层。它独立理解变更、执行验证并交付证据、剩余风险与明确决策,把 Agent 的“已经完成”变成可检查、可复现、可审计的工程事实。智测 OpenQA 与 SUSE 维护的开源操作系统测试框架 openQA 没有关系。
什么是 AI Verification?
AI Verification 是对 AI 生成的软件变更进行独立验证:从需求意图与代码影响出发,选择真正有效的测试和工程检查,确认缺陷版本会失败、修复版本能通过,并明确记录直接证据、覆盖缺口与剩余风险。它验证的不是 Agent 是否给出了答案,而是该答案是否足以支持合并和发布。
OpenQA Skills、Benchmark 与 Evidence Format 分别解决什么问题?
OpenQA Skills 提供可在 Coding Agent 与 CI 中直接运行的验证能力;OpenQA Benchmark 用可复现任务衡量 Agent 是否能理解需求、定位影响、设计有效测试并识别剩余风险;OpenQA Evidence Format 以 Intent、Change、Verification、Evidence、Risk、Decision 六段结构统一不同 Agent、测试框架和 CI 的验收输出。
OpenQA Verifier 是什么,能做什么?
OpenQA Verifier 是运行在开发者电脑或 CI 中的独立软件变更验证器。它读取变更目标、Git Diff、仓库规则和已有工程信号,分析影响与证据缺口,调用测试、代码分析、安全扫描和真实环境执行,并形成说明依据、剩余风险和下一步动作的 Change Acceptance Record。
智测 OpenQA 现在可以使用吗?
OpenQA Verifier 处于内测阶段,计划 2026 Q4 公测;用例管理平台与接口平台已在内测团队使用,其余验证能力按 roadmap 陆续开放。可以在 /beta 页面申请用一个 Agent PR 参与内测,技能库(/skills)与文章(/articles)对所有人开放。
OpenQA 只验证 Web 应用吗?
不是。OpenQA 的验证对象是软件变更,可涵盖应用代码、API、移动端、配置、依赖、数据库迁移和基础设施代码。目前执行适配覆盖 Web、iOS、Android、小程序、REST、GraphQL、gRPC、Playwright、pytest、JUnit,浏览器、接口和真机只是可按风险调用的验证环境,不是产品边界。
什么是证据化软件变更验收?
证据化软件变更验收,是围绕一次具体变更连接目标、代码影响、测试与安全结果、真实执行证据和策略要求,再判断这些证据是否足以支持合并或发布。它不把“CI 变绿”或 Agent 的完成声明直接等同于正确,而是显式记录验证了什么、没有验证什么以及谁承担剩余决策。
OpenQA 如何决定合并、复核或阻断?
OpenQA 先根据变更意图、影响范围和风险制定验证计划,再获取底层工具的直接证据,并用版本化企业策略判断证据充分性。满足合并条件时给出通过;存在已知但可接受的剩余风险时要求复核;明确失败或违反策略时阻断;关键信息缺失时标记证据不足,而不是伪造确定答案。
智测 OpenQA 是开源的吗?收费吗?
OpenQA Verifier 与自研验证平台是闭源产品,内测期间免费;正式定价将在公测时公布。技能库中的社区技能与 MCP 服务器遵循各自的开源许可证,本站只做收录与评测,不改变其许可。
智测 OpenQA 如何保证数据与代码安全?
Verifier 可在本机或私有环境运行,按最小权限读取代码与工程资产;对外部系统的读写保留记录,高风险写回需要人工确认。每个技能声明 shell、网络和凭据权限。验收策略可设置为生成 Agent 不可修改,代码、策略或证据变化后旧结论自动失效,避免生成者通过弱化规则为自己放行。
什么是智能测试?智测 OpenQA 包含哪些核心能力?
智能测试(AI 测试)是指将 AI 深度融入软件质量全生命周期的工程体系。智测 OpenQA 覆盖九大核心能力:1) 智测桌面 Agent(本地自主规划与执行);2) 智测 Skill Hub(MCP 测试工具库);3) 智能用例生成(基于需求与代码 Diff);4) 智能 UI 自动化测试(多模态自愈与证据保留);5) 智能接口测试(OpenAPI 契约生成与漂移检测);6) 智能代码知识图谱(调用链影响面分析);7) 智能代码覆盖率(多层增量覆盖追踪);8) 智能 Mock(动态服务仿真);9) 智能数据构造(参数与业务状态机合成)。
智能代码知识图谱是如何帮助测试精准分析影响面的?
智能代码知识图谱静态解析代码的语法树(AST)、类与方法调用链、RPC/REST 接口依赖、数据表流转与已有用例关联。在研发提交 Git Diff 时,图谱在毫秒级内自动推导出直接影响与间接波及的入口、接口和业务场景,彻底解决“改了一行代码,不知道要测哪些业务”的行业痛点。
智能代码覆盖率与传统覆盖率有什么区别?
传统覆盖率是构建结束后的静态全量行统计;智能代码覆盖率聚焦增量改动,打通单元测试、接口测试和 UI 自动化三层探针,动态合并计算本次变更代码的真实有效覆盖率,并能把未覆盖的风险代码块直接推送给 Agent 自动补写用例。
智能 Mock 与智能数据构造如何解决测试依赖与造数据痛点?
智能 Mock 根据契约与真实抓包动态返回符合 Schema 的结构与状态响应,支持故障注入与复杂业务流仿真;智能数据构造依据字段约束与业务状态机,自动合成海量符合合规要求的测试数据(如特定规则卡号、级联表单、关联业务订单),无需人工繁琐造数。
智测 OpenQA 的智能 UI 自动化测试是如何实现“脚本自愈”与消除抖动的?
智能 UI 自动化测试是智测 OpenQA 的核心杀手级能力之一。它通过三层自愈体系彻底终结传统 UI 脚本的“高维护、高脆弱”梦魇:1) **多模态语义定位**:结合 ARIA Role 无障碍语义树、文本语义、几何相对关系与视觉图像识别建立多维弹性锚点,不再依赖易脆的绝对 XPath/CSS;2) **毫秒级自愈机制(Self-Healing)**:前端改版或 DOM 结构变更时,Agent 自动推导目标元素并自愈完成操作,同步输出 Diff 修复建议;3) **智能动态等待与现场取证**:基于网络请求空闲与 DOM 渲染状态动态等待,失败时自动打包全景录屏、HAR 抓包包体、DOM 快照与控制台报错,精准归因是真 Bug 还是环境延迟。
智测 OpenQA 与 Playwright、Selenium、Appium 有什么区别?
Playwright、Selenium、Appium 是底层自动化驱动,负责执行浏览器或设备操作;OpenQA 是面向软件变更的独立验证与验收层。OpenQA Verifier 根据变更风险决定是否调用这些驱动,把执行结果与其他测试、安全和代码信号归一为变更级证据,再判断是否达到合并或发布条件。
与普通的“大模型写测试用例”相比,智测 OpenQA 的核心优势是什么?
普通大模型仅依靠几句 Prompt 提示词做无上下文的文字生成,容易产生幻觉、无法去重且无法与工程资产联动。智测 OpenQA 基于代码知识图谱、OpenAPI 契约、历史缺陷与实际测试覆盖率,生成带有准确前置条件与边界断言的结构化用例,并支持增量修改与可追溯性评审,能无缝双向写回企业现有用例库。
智测 OpenQA 如何与现有的 CI/CD 流水线及用例平台集成?
智测 OpenQA 提供标准 CLI 工具、Webhook 与 MCP 插件,可在 GitHub Actions、GitLab CI、Jenkins 等流水线中作为代码合并门禁前置运行,计算变更影响并按需触发回归。测试结果、诊断日志与证据可自动回传至 Jira、TAPD、飞书项目或自研用例管理系统。
怎么联系 智测 OpenQA 团队?
邮件 hello@openqa.cn,或通过 /contact 页面的微信群与 GitHub Issues。技能库的收录与勘误请使用 /submit 表单。
软件变更验证与验收平台
查看完整说明 →OpenQA 和 CI/CD、测试平台或安全扫描器有什么区别?
CI/CD 负责执行流程,测试和安全工具负责产生各自领域的信号。OpenQA 面向一次具体软件变更,判断应该调用哪些工具、已有结果是否足以证明变更达到合并或发布条件,并将依据与剩余风险写入统一验收记录。
为什么 Coding Agent 不能自己验证自己的改动?
生成与验证共享同一上下文和假设时,容易产生同源错误,也可能通过弱化测试或修改配置获得绿色结果。OpenQA 将验收策略、证据来源和决策记录与生成角色分离,并在代码、策略或证据变化后使旧结论失效。
Change Acceptance Record 包含什么?
记录包含变更目标、代码与依赖版本、验证计划、实际执行的检查、直接证据、未覆盖风险、策略版本、合并与发布结论以及人工决定。它既可以是产品页面,也可以通过 API 写回 Pull Request 和审计系统。
OpenQA 会自动批准所有软件变更吗?
不会。第一阶段重点是证明变更是否准备好合并,并明确证据不足之处。只有满足企业明确策略的低风险变更才适合自动准入;高风险、冲突或证据不足的情况会要求人工复核或直接阻断。
OpenQA 只适用于 Web 应用吗?
不是。验证对象是软件变更,可涵盖应用代码、API、移动端、配置、依赖、数据库迁移和基础设施代码。浏览器、接口和真机只是可按风险调用的执行环境,不是产品边界。
智能测试用例生成
查看完整说明 →AI 如何生成测试用例?
系统先读取需求、接口定义、代码实现与已有测试资产,构建输入输出等价类、边界条件、状态转换机与权限矩阵,再生成包含前置条件、测试数据、操作步骤、预期断言与依据来源的结构化用例,最终经规则校验与人工确认入库。
相比市面上的纯 Prompt 对话生成,智测 OpenQA 的优势在哪里?
纯 Prompt 对话往往缺乏工程上下文、用例格式不统一、无法去重且容易产生幻觉;智测 OpenQA 能够结合代码知识图谱、OpenAPI 契约、历史用例库与测试覆盖率,做语义去重、可执行性校验,并直接双向同步团队现有用例管理平台。
只上传需求文档就能生成高质量用例吗?
可以生成基础功能用例,但加入接口定义、代码差异、历史缺陷记录、线上真实流量和已有用例后,AI 才能精准识别边界边界、跨模块调用风险与未覆盖分支。
怎样避免生成重复或不可执行的测试用例?
生成前先对已有用例库进行向量检索与语义比对;生成时要求强类型字段规范与可执行步骤检查;生成后计算增量差异并展示覆盖目标,最终通过人工一键评审入库。
生成的用例能直接变成自动化脚本吗?
稳定、前置条件清晰且断言明确的用例可一键转换为 API(REST/gRPC)或 Playwright UI 自动化脚本;复杂主观交互或高风险业务仍保留人工复核。
智能 UI 自动化测试
查看完整说明 →什么是智能 UI 自动化测试?它与传统录制回放工具有什么本质区别?
传统录制回放工具(如 Selenium IDE、旧式录制器)机械记录绝对 XPath、CSS 路径或像素坐标,前端页面稍微调整样式、类名或结构就会大面积失效;智能 UI 自动化基于大模型与多模态视觉,理解按钮、输入框、下拉框等控件背后的业务语义(如“搜索按钮”、“收货地址输入框”),结合 ARIA 无障碍树与视觉特征进行多重弹性定位,即使页面发生改版也能自愈定位并执行操作。
什么是 UI 自动化自愈(Self-Healing)?它是如何工作的?
UI 自动化自愈是指当测试脚本在执行过程中遇到页面改版、元素属性(ID/Class/DOM层级)发生变更导致原始定位器找不到时,AI Agent 结合该元素历史特征(文本语义、相对邻近元素、ARIA Role、视觉截图)在毫秒级内自动推导出新的定位方式并完成操作,同时生成自愈 Diff 修改建议供测试工程师确认合并,无需人工紧急停机修脚本。
智能 UI 自动化支持哪些浏览器、移动设备与小程序生态?
全面支持主流 Web 浏览器(Chromium / Google Chrome、Apple WebKit / Safari、Mozilla Firefox、Microsoft Edge)、移动端操作系统(iOS 与 Android 真实手机/平板)以及主流小程序容器(微信小程序、支付宝小程序、Hybrid 混合应用)。底层无缝兼容 Playwright、Appium 与 MCP 协议。
如何彻底解决 UI 自动化测试中的“不稳定抖动(Flaky Tests)”难题?
智测 OpenQA 通过四层防护彻底消除抖动:1) 杜绝固定 sleep,采用网络请求完成、DOM 渲染稳定、动画结束等多重智能动态等待;2) 配合智能 Mock 与数据构造,保证每次运行的数据和依赖隔离;3) 多模态定位备选兜底;4) 自动重试机制与现场全景取证(HAR包+视频录制),精准区分产品缺陷与网络延迟。
智测 OpenQA 能否用自然语言直接写 UI 自动化用例?
可以。测试人员或产品经理只需输入自然语言描述(例如“打开官网首页,点击右上角登录,输入测试账号密码,断言顶部出现用户头像和欢迎语”),Agent 会自动解析意图并将其编译为规范的结构化步骤与 Playwright/Appium 代码,并能在执行过程中根据真实页面响应进行交互微调。
UI 自动化在企业测试金字塔中应当如何合理定位?
根据现代质量工程最佳实践,80% 的字段校验、数据转换和单接口逻辑应下沉到单元测试与智能接口测试层;智能 UI 自动化聚焦在 Top 20% 最核心、高价值的端到端真实用户主旅程(E2E User Journeys)与跨页面核心闭环业务。这样既能保证核心体验不受破坏,又能把整体回归耗时控制在极低水平。
变更影响分析与精准回归
查看完整说明 →什么是智能代码知识图谱?它如何帮助测试?
智能代码知识图谱是通过静态代码解析与动态链路追踪,将代码中的仓库、模块、类、方法、REST/RPC 接口、数据库表以及对应的测试用例构建为一张多维关联网络。在代码发生变更时,图谱能在几毫秒内推导出所有直接与间接影响链路,从而让测试人员和 Agent 拥有全局视角,精准定位该测什么。
什么是智能代码覆盖率?和传统代码覆盖率有什么不同?
传统覆盖率往往只是流水线结束后的静态全量行覆盖百分比,无法指导具体改动该怎么测。智能代码覆盖率支持:1) 针对 PR/Commit 的增量代码行与分支覆盖统计;2) 合并单元测试、接口测试与 UI 端到端测试的三层混合覆盖率;3) 精确指示哪些变更代码未被覆盖,并能把未覆盖路径直接推送给 Agent 自动补写用例。
变更影响分析和精准测试是一回事吗?
精准测试传统上侧重基于代码行/分支覆盖率做用例与代码的逆向映射;变更影响分析体系更加立体,综合了代码 AST 语法树、函数调用图谱、OpenAPI 契约依赖、线上微服务网关流量日志以及历史失败率,不仅能精准挑选该跑什么,还能洞察未覆盖盲区并指导 AI 补写用例。
精准回归会不会漏测?
通过保守型调用链扩展算法与多重防护机制降低风险:1) 向上向下递归遍历间接依赖;2) 涉及核心公共库、底层中间件或数据库 Schema 变更时自动升级全量回归策略;3) 始终保留基线 P0 核心冒烟用例兜底。
需要接入哪些数据才能做变更影响分析?
基础阶段仅需 Git 代码仓库与提交 Diff、接口定义及测试用例;进阶阶段接入 JaCoCo / Istanbul / Coverage.py 等覆盖率探针与 APM 链路追踪日志后,分析精准度可达 95% 以上。
如何与 GitHub Actions、GitLab CI 或 Jenkins 结合?
在 PR / MR 创建或代码推送事件触发时,智测 OpenQA 变更分析作为前置 CI Step 运行,几秒内计算出用例清单并分发执行,测试结果与证据通过 Bot 评论或 Check Run 直接回写到代码评审界面。
智能接口测试与契约自动化
查看完整说明 →什么是智能 Mock?它与普通写死数据的 Mock 有什么不同?
普通 Mock 只能返回写死的固定 JSON 静态片段,无法处理动态参数关联、状态流转和复杂分支;智能 Mock 能够根据 OpenAPI 契约和历史真实流量样本,动态根据请求入参计算并返回匹配的 Schema 结构,支持状态机仿真、动态延迟模拟和故障注入,真正实现高保真服务隔离。
什么是智能数据构造?如何解决测试中的数据准备难题?
智能数据构造是利用 AI 与规则引擎,依据数据库表结构、接口字段约束(正则/长度/格式)、外键依赖与业务状态机,自动化合成海量真实且合规的测试数据。它能自动生成符合身份证号、手机号、银行卡规则的数据,并支持上下文连续业务流(如生成可用的优惠券码并用于下单结算)。
智能接口测试和传统接口工具(如 Postman / JMeter)有什么区别?
传统工具重在手动填参、手动写断言脚本或纯压力测试;智能接口测试通过 AI 自动理解 OpenAPI 规范和流量,全自动推导多接口依赖链路、穷举边界参数、生成强类型断言,并结合智能 Mock 与契约漂移监控实现无人值守回归。
只有 OpenAPI / Swagger 文档能不能生成完整接口测试?
可以生成覆盖参数类型、边界与 HTTP 状态码的基础用例;结合历史真实流量样本与数据依赖建模后,能进一步生成多接口业务串联场景(如下单-支付-发货链路)。
接口自动化如何处理复杂的鉴权令牌与下游依赖?
鉴权通过环境级变量注入与动态 Token 刷新拦截器处理;外部第三方服务或不稳定内部依赖通过智能动态 Mock Server 隔离,确保接口执行结果完全可控。
接口测试能否替代大部分 UI 自动化测试?
根据测试金字塔原则,80% 以上的业务逻辑、数据流与边界校验应当由接口自动化承载;UI 测试仅需聚焦核心端到端用户主旅程,从而大幅提升整体回归效率与稳定性。
大模型应用评测
查看完整说明 →大模型应用评测包含哪些关键评测维度?
通常覆盖四大体系:1) RAG 检索与生成指标(检索精确率、召回率、Faithfulness 忠实度、Answer Relevance 相关性);2) 业务准确性(Ground Truth 命中率、语义相似度);3) Agent 工具调用评测(工具选型正确率、参数填充准确率、规划路径步数);4) 安全红队评测(越狱、提示词注入、毒性与隐私泄露)。
LLM-as-judge 自动评测真的可信吗?
在设计了结构化评分维度、Few-Shot 示例并配合基准判定模型时,LLM-as-judge 与人工专家评分的一致性可达 85%~92%。最佳工程实践是将规则断言(正则/JSON Schema)、LLM 打分与专家抽检三者结合。
RAG 检索增强生成系统最核心测什么?
重点分层测试:检索层关注 Top-K 召回率与排序质量,生成层关注模型是否严格基于召回上下文回答(杜绝幻觉),端到端关注用户问题解决率与响应延迟。
大模型评测和传统软件测试如何协同?
传统测试保障接口协议、鉴权、限流、数据库存储等确定性系统链路;大模型评测保障概率性文本生成的质量下限。两者均集成在 CI/CD 中作为双重质量保障。
移动端云真机测试
查看完整说明 →移动端云真机测试与模拟器测试有什么本质区别?
模拟器无法完全模拟 ARM 指令集特性、定制厂商 ROM 系统弹窗、推送通知行为、GPS 定位、蓝牙传感器以及真实硬件性能开销。线上 70% 以上的崩溃与卡顿兼容性问题必须在真实手机上才能复现与验证。
AI Agent 是如何实现在真机上自动化操作的?
Agent 通过标准化的 MCP(Model Context Protocol)或 Appium 驱动连接云端设备,结合 Accessibility 无障碍层次树与 OCR 视觉模型理解界面控件,自动完成点击、滑动、输入、权限授权与手势操作。
支持微信小程序、支付宝小程序以及 Hybrid App 混合应用吗?
完全支持。通过接入移动端底层渲染与 WebView 调试通道,Agent 能够穿透小程序与混合容器进行 DOM/语义层级的操作与断言。
云真机测试的企业安全与数据隐私如何保障?
采用租户级隔离网络与沙箱环境;执行结束后执行设备全量数据擦除与应用卸载;所有测试凭据通过安全环境变量加密注入,绝不落地在脚本明文中。
没找到你的问题?
写邮件或加入微信群,我们会把常见的问题补到这一页。