#AI测试
共 12 篇相关文章

为什么AI编程智能体不该自己测试代码?
新研究显示,阻止AI编程智能体(如Devin、Cursor、Factory)自己写测试反而能提升成功率、提速6%、降本9%。原因在于建造者不能同时当检查者。本文解析为何需要独立的测试智能体来验证真实应用。

如何用逻辑思维测试AI聊天机器人的真实性
一位Reddit用户提出用情绪化争论测试AI聊天机器人的真实性。本文解析这类逻辑思维测试的原理、破绽点、局限性,并给出更有效的AI逻辑能力测试方法。

AI大模型测试从入门到实战:评估三层体系全解析
AI大模型测试完整入门指南:解析从传统断言到AI评估的范式转移,详解大模型、知识库、智能体三层评估体系,以及Promptfoo工具选型与版本固定实战要点。

AI大模型测试实战:从断言到评估的思维转变
AI大模型测试实战指南:解析从传统断言到AI评估的思维转变,涵盖LLM、知识库、Agent三层评估对象与版本固定原则,并介绍promptfoo评估工具选型,帮助测试人员系统入门AI应用测试。

AI大模型测试三阶段:从断言到评估的思维转变
AI大模型测试正从传统断言转向评估。本文梳理AI测试体系三阶段演进、评估与测试的本质区别、双版本固定方法论,以及大模型、知识库、智能体三层递进的评估路线与工具选型,为测试从业者提供AI评测框架搭建参考。

Codex+Skills+Playwright:从需求文档到自动化测试用例的AI落地实践
基于Codex(Cloud Code)+Skills+Playwright实现从需求文档自动生成测试用例的实战方案。涵盖文档解析、需求拆分、多模态测试点提取、评审到用例导出与自动化执行的完整五步工作流。

从零打造测试用例生成智能体:测试智能体与智能化测试平台实战解析
深度解析霍格沃兹测试开发学社的智能化测试实战:如何用DeepSeek Harness打造Web自动化智能体、诊断优化智能体执行速度,并通过工作流、RAG与知识图谱构建高覆盖度的测试用例生成智能体与测试平台。

AI大模型测试三阶段详解:从断言到评估的测试新范式
AI大模型测试正从传统断言转向评估范式。本文详解用AI测试、和AI测试、对AI测试三种体系,剖析大模型、知识库、智能体三层评估对象,以及版本固定、工具选型等AI测试岗位入门核心知识。

Claude Code + Skills 一键生成测试用例实战全解析
本文详解如何用 Claude Code + Skills 一键从需求文档生成落地级别测试用例。通过拆分需求、提取测试点、生成用例三阶段流水线,配合 AI 自动评审,把测试用例编写从数天压缩到十分钟内,效率提升数倍。

Claude Code + Skills 一键生成Web测试用例实战解析
本文解析如何用 Claude Code 结合 Skills 技能机制,实现从需求文档到 Web 测试用例的三阶段自动化生成流程,涵盖需求拆分、测试点提取与用例生成,并理性评估其效率提升与实际价值。

9个实战项目打造Skill Agent:测试工程师的AI进阶路线图
本文梳理了从手写 Prompt 到构建全链路 Skill Agent 的九个测试实战项目路线图,涵盖用例生成、性能测试、Web 与移动端自动化,帮助测试工程师告别玩具 Demo,用 AI 提升工作效率。
教程攻略8个AI测试Skill搭建指南:让AI变身专属QA助手
详解8个测试人必备的AI Skill搭建方法,涵盖需求转用例、接口脚本生成、Bug报告、日志分析等场景,帮助QA团队用工程化方式驾驭AI,实现测试效率翻倍提升。