ARTICLE · 1107343
AI测试基础实战手记专栏目录索引
AI测试基础实战手记专栏目录索引
目录索引
A 入门认知篇(10 篇)
做了10年电商测试,我眼里的"AI测试"到底新 测试 AI 功能 ≠ 测试传统功能:3 个本质差异 大模型应用怎么测?一张从 Prompt 到 RAG 用 AI 写测试用例:模板与避坑 自动化测试"自愈":从脚本到智能用例 电商 AI 实战①:搜索/推荐系统的测试坑 电商 AI 实战②:智能客服与风控的测试重点 TOC vs TOB:AI 功能测试的侧重点 怎么定义 AI 产品"好用"?评测体系搭建 测试人的 AI 能力地图与 30 天入门路径
B 评测实操篇(7 篇)
评测集从0到1:我搭退款意图集的全过程 评分卡别写"好不好",改成扣分项才准 用大模型当裁判,这三个坑我全踩过 如何把AI评测集和评分串成闭环 评测样本中边界负样本别靠灵感,5 招批量造 模型评测靠人盯必漏,智能化进阶闭环
C Agent 评测篇(7 篇)
Agent 评测不是 LLM 评测,90 分也翻车 Agent 评测集别照抄,5 类来源可选 Agent 评测容易踩的3个坑 agent工具调用 评测3 个错法 Agent 评测5 档稳定性度量横向比较 Agent 安全评测4 类攻击面 Agent 双轨评测3步搭起来,避免上线就失控