🎉 一次报名 · 不限次数听课 · 终身服务,持续滚动开课,每期内容更新 80%+ 立即咨询 →
第 6 期 · 全新升级 · 火热报名中 ......

大模型应用
测试开发实战

从「用 AI 做测试」到「测 AI 本身」
企业级智能体测试全景实战,零基础可入学,结课能落地。

11
课程模块
6+
测试智能体
10+
主流AI工具
8
实战项目
75% 学员来自老学员口碑推荐
用效果说话,靠口碑相传
intelligent-testing · 双引擎
用 AI 做测试
6 大智能体 · 意图驱动
测 AI 本身
评测体系 · 质量门禁
企业级落地
私有化 · CI/CD · 内网
老学员都知道的隐藏福利

一次报名 · 不限次数听课 · 终身服务

不限次数听课,服务永久有效
本期没吃透?下一期免费继续听,直到学会为止
持续滚动开课,每期内容更新 80%+
紧跟大模型最前沿,你学到的永远是下一期的最新版本
你是否有这些困扰

企业在智能体时代的测试之痛

每一类企业真实痛点,都对应着课程的具体解法

AI 应用没人会测

智能体输出不确定、RAG 召回质量黑盒、模型升级不敢发版,质量全凭运气。

对应解法 · AI 产品测试与评测体系

测试提效遇天花板

用例靠手写、自动化脚本维护成本爆炸、回归周期越来越长。

对应解法 · 意图驱动 + 6 大测试智能体

知识资产在流失

需求一句话、文档过时、经验在人脑里,AI 生成结果总是"四不像"。

对应解法 · 企业知识飞轮

平台化进退两难

自研平台重、维护难;直接买工具又不贴业务、难落地。

对应解法 · 轻量 CLI + 渐进平台化

数据合规卡脖子

金融/政企内网隔离、外网禁访问,SaaS 类 AI 工具根本进不了场。

对应解法 · 全栈私有化部署

全部命中?

那这门课就是为你设计的。把每一个痛点,变成你的竞争力。

本期重磅升级

紧跟前沿,又能真正落地

我们持续追踪大模型测试最前沿的技术,只把"既先进又能在企业跑起来"的装进课程 · 查看升级详情 →

GraphRAG

多模态RAG 图谱知识工程

基于企业级 AnythingChatRAG,用知识图谱 + 向量双层检索重构测试知识库。实体关系抽取、四种分块策略、Rerank 重排、RAGAS 评测一站式打通——让 AI 真正读懂你的业务文档。

AnythingChatRAG知识图谱双层检索Rerank
Agentic Workflow

自主测试工作流

超越单次问答,构建"感知→决策→执行→反思"的 Agentic 闭环。LoopEngineering 让测试智能体 7×24 小时自主巡检、发现缺陷、自动修复、回归验证——真正的无人值守测试。

LoopEngineeringReActPlan-Execute自主反思
LLM Ops

全链路可观测与追踪

用 Langfuse 做智能体全链路追踪,每一次模型调用、每一次工具执行都可回溯、可度量。结合评测门禁,让 AI 质量从"看不见摸不着"变成"可观测、可回归、可问责"。

Langfuse链路追踪Token 分析成本归因
Trajectory Eval

智能体轨迹评测

2026 年智能体评测的主流范式。不只验证最终答案,更用 Golden Trajectory(黄金轨迹)比对 Agent 的每一步决策与工具调用——发现"答案对但过程错"的隐性缺陷。

Golden Trajectory轨迹比对过程评测dsh Replay
Benchmark

真实环境基准测试

引入 AgentBench / Terminal-Bench 等真实环境基准,在命令行、数据库、网页等真实场景中考核 Agent 的任务完成能力——告别"玩具评测",直击生产可用性。

AgentBenchTerminal-BenchSWE-bench
Self-Evolving

自我进化智能体

从"静态工具"到"会进化的系统"。结合 Skill 自我改进机制与 ContinualSkillBench 持续能力评测,让测试智能体越用越强——这是智能体的下一站。

自我进化Skill 沉淀持续评测
3-10x
测试效率提升
10x
用例生成提速
30分钟
私有化部署上线
100%
内网可落地
核心竞争力

别人教一条腿,我们教你两条腿走路

「双轨能力模型」—— AI 时代测试工程师最稀缺的能力组合

用 AI 做测试

让 AI 成为你的测试团队,效率提升 3-10 倍

  • 意图驱动测试(Intent + Risk + Acceptance)
  • 6 大测试智能体:用例/接口/UI/移动/安全/性能
  • 双脚本智能工厂:一次操作,同时生成接口+UI 双用例
  • 多智能体编排:一个 Leader 带一支 Agent 团队
  • 脚本自愈 + 定时回归 + 报告自动推送

测 AI 本身

给 AI 产品把质量关——人才市场最稀缺的能力

  • Agent 效果评测:轨迹/工具调用/任务完成率
  • 大模型评测:文本/多模态/安全 全维度
  • RAG 评测:RAGAS 四大指标实战
  • AI 产品测试:幻觉/注入/鲁棒性/一致性
  • 质量门禁:上线前自动评测,不达标不发版

核心理念 · "用 Agent 测试 Agent"

这是测试工程师的下一个核心竞争力,也是我们区别于同类课程的地方

课程体系

11 大模块 · 全程实战

四级进阶体系:基础 → 核心 → 进阶 → 专家,无论你处于哪个阶段都有你的位置

MODULE 01全新模块
AI 开发工具实战
Claude Code / Cursor / DeepSeek Harness / Codex 等全栈实战与选型方法论
查看详情 →
MODULE 02小白友好
LLM 核心技术原理
大模型原理 / Prompt 与上下文工程 / Function Calling / RAG / Agent / MCP,测试视角解读
查看详情 →
MODULE 03进阶
智能体基座与二开实战
HermesAgent × DeepSeek Harness 双基座 · Agent 循环源码导读 · Plugin / Skill / MCP / Profile 四大扩展
查看详情 →
MODULE 04方法论核心
意图驱动测试
从用例驱动到意图驱动的范式升级 · Intent + Risk + Acceptance 三元组
查看详情 →
MODULE 05实战主战场
测试智能体矩阵
6 大测试 Agent · 双脚本引擎 · 多智能体编排 · 用例/API/Web/Android/安全/性能
查看详情 →
MODULE 06进阶
Skills 体系深度实战
Skill 设计 → 开发 → 测试 → 发布全生命周期 · 企业私有 Skill Hub
查看详情 →
MODULE 07核心增量
Agent 测试与评测
用 Agent 测试 Agent · 轨迹回放评测 · 文本/多模态/RAG/模型评测 · 质量门禁建设
查看详情 →
MODULE 08深度
RAG 与知识库工程
企业知识飞轮 · 分块策略 · 召回调优 · 知识库自动化维护
查看详情 →
MODULE 09质量守门
AI 产品测试
功能/鲁棒性/安全/一致性 · 幻觉检测 · Prompt 注入防护
查看详情 →
MODULE 10专家
工程化与部署
内网私有化部署 · CI/CD · 成本优化 · ELK 监控 · 持续回归
查看详情 →
MODULE 11专家
前沿趋势与面试辅导
LoopEngineering · SDD · 面试题精讲 · 职业规划 · 开源背书
查看详情 →
MODULE 00录播
前置基础(录播)
Python 入门 + 往期直播同步回放 + 全套资料,随到随学,零基础无忧
查看详情 →
技术栈

我们用到的武器库

不只教工具按钮,更教你驾驭一整套企业级智能体测试技术栈——从提示词工程、上下文工程,到 Harness 与 Loop 工程,四个 Engineering 全覆盖

名词太多?一条主线串起来

Prompt → Function Calling → MCP → Skill → Agent:能力逐层递进,每个环节都有对应的模块与实战项目

LAYER 01
Prompt 提示词
把意图说清楚
LAYER 02
Function Calling / Tools
让模型会"动手"
LAYER 03
MCP 协议
工具接入标准化
LAYER 04
Skill 技能
能力资产化、可复用可调试
LAYER 05
Agent 智能体
循环编排以上所有能力

智能体框架

LangChainHermesAgentDeepSeek HarnessDeepAgentsAgent LoopTool RegistryMCPSkillsContext EngineeringMulti-Agent

测试执行

Playwright-MCPOpenAPIAppiumMidscene.jsLocust / K6ZAP / Nucleipytest

评测与质量

RAGASDeepEvallm-eval-harnessLLM-as-JudgeGolden Dataset质量门禁

知识与数据

AnythingChatRAGGraphRAG向量检索混合检索RerankHyDEEmbedding知识图谱

工程与部署

DockerCI/CDOllamaPrometheusGrafanaELK

AI 开发工具

Claude CodeCursorTrae CNKimi CodeQoderCodex
学员作品

学完能做出什么?看学员真刀真枪的作品

全部来自往期学员结课后落地的真实系统 —— 从智能测试平台到知识图谱,从 AI 智能体到比赛获奖作品

智能测试平台开物·智测工坊 智能分析中心
开物·智测工坊 · 智能分析中心
11 位 AI 分析专家多智能体编排:架构评估、代码审计、污点追踪、PR 评审、测试建议一站式产出报告
Multi-Agent代码分析质量报告
智能测试平台智能测试平台5.0 工作台
智能测试平台 5.0 · 工作台
测试全流程管理 + AI 用例生成器 + 缺陷分析助手,多项目并行,MCP 工具集成
测试管理AI 助手MCP
智能测试平台质量数据看板
质量数据看板
跨项目质量度量:用例/质量分/通过率三维监控,模块级下钻,风险自动预警
质量度量数据可视化风险预警
智能测试平台全链分析 代码知识图谱
全链分析 · 代码知识图谱
4959 节点 / 8378 边代码依赖图谱可视化,智能问答定位调用链
代码图谱全链分析智能问答
智能测试平台零售系统API测试 V7.1
零售系统 API 测试 V7.1
OpenAPI 自动生成 + 业务流程编排 + 失败根因分析,193 接口 + 5 流程全量巡检
API 自动化根因分析流程编排
智能测试平台测试管理平台 仪表板
测试管理平台 · 仪表板
KPI 监控 + 执行趋势 + 实时活动流,AI 已生成 156 个用例、节省 80% 时间
测试管理实时监控AI 生成
智能测试平台智能测试用例生成系统
智能测试用例生成系统
打通 Tapd 需求 → AI 生成用例 → 导出报告全链路,需求到用例零手写
用例生成Tapd 集成需求驱动
知识库与图谱企业级知识库 知识图谱
企业级知识库 · 知识图谱
GraphRAG 实体关系抽取:需求文档自动构建图谱,节点搜索 + 深度控制探索
GraphRAG知识图谱智能查询
知识库与图谱AnythingChatRAG 知识图谱
AnythingChatRAG · 多模态知识图谱
多模态 RAG + 千级节点图谱:文档/图谱/检索三位一体的知识工程
多模态 RAG图谱可视化语义检索
AI 智能体应用UI自动化分析平台
UI 自动化分析平台
截图进、脚本出:AI-TARS 识别 + 多智能体协作 + Midscene.js 脚本生成
UI 自动化Midscene.jsSSE 实时推送
AI 智能体应用edu-ACTS 数据建模
edu-ACTS · 智能数据建模
数据库结构自动发现 + ER 图可视化建模,支撑智能问答与数据分析
数据建模ER 可视化BI 平台
学员成果与口碑QA智能测试平台 比赛冠军
《QA智能测试平台》· 比赛冠军
学员作品斩获比赛 #1 冠军、MacBook Pro 大奖:私有化部署 + 多智能体工作流
比赛获奖私有化部署Multi-Agent
学员成果与口碑学员口碑 500人群
学员口碑 · 500 人满群验证
"学完田老师的课,公司 95% 以上的人对 AI 的掌握程度都不如你"
真实口碑500 人满群
学员成果与口碑学员落地 Django+Celery+AutoGen
学员落地 · 需求到用例 AI 赋能
Django + Celery + AutoGen 多智能体:在自家平台落地需求→用例自动化
课程落地AutoGen企业实战
学员成果与口碑学员自研平台
学员自研平台 · 受课程启发
"受到老师的启发,做了个平台":独立搭建含图谱可视化的 AI 测试平台
独立开发图谱可视化
学员成果与口碑学员集成 代码智能分析平台
学员集成 · 代码智能分析平台
把课程的代码分析平台集成进自家系统,11 位 AI 分析专家实战落地
课程复用代码分析群内热议

以上均为往期学员结课后的真实作品与群内反馈 · 下一期,期待你的作品上墙

适合人群

无论你处于哪个阶段,都有你的位置

零基础小白

无 Python / 无自动化经验

  • Python 入门 + 往期直播回放补齐基础
  • 从 AI 工具用起,快速上手
  • 每个实战都有免代码线
  • 结课能独立完成项目
有基础测试工程师

想提效 / 转型 / 进阶

  • 测试智能体开发实战
  • 意图驱动 + 评测体系
  • 插件 / Skill 工程能力
  • 可落地的企业方案
资深工程师 / TL

负责选型与团队落地

  • 多框架架构决策
  • 私有化部署与成本模型
  • AI 质量门禁体系
  • 职业跃迁路径规划
INSTRUCTOR

田威峰 · 主讲

北京慧测 & 但问智能创始人,18 年软件行业经验,智能体应用框架设计资深专家。累计服务学员逾千人,曾为施耐德电气、邮储银行、中信证券、中国石化、中国电信等知名机构提供智能体框架设计与技术支持。

18
年行业经验
1000+
累计学员
16+
企业级项目交付
FAQ

报名前,你可能想问

零基础能跟上吗?

可以。前置基础包含 Python 入门课 + 往期课程同步直播视频回放 + 全套课程资料,随到随学;每个实战都有免代码线 + 代码线分层设计,按自己的基础各取所需。

工作太忙,跟不上进度怎么办?

一次报名,不限次数听课:本期没吃透,下一期免费继续听,直到学会为止。课程持续滚动开课,服务长期有效。

学的东西在公司能用起来吗?

全部项目按「先 CLI 独立跑通、再集成平台」的路径落地,支持私有化部署——金融、政企的外网隔离环境也能用。不少往期学员已把课程产出集成进自家平台。

和其他 AI 测试课有什么区别?

双轨能力模型:不只教「用 AI 做测试」,还教「测 AI 本身」(Agent/模型/RAG 评测体系)——后者正是当前人才市场最稀缺的增量能力。

结课能带走什么?

8 大实战项目作品、一份贯穿项目的完整质量报告、可复用的 Skills 资产库——全部可演示、可写进简历,面试时直接展示。

什么时候开课?费用多少?

第 6 期正在报名中。开课时间、上课形式与费用等具体安排,加微信 huice666 / danwen668 咨询——也可以先聊聊你的基础,帮你判断适不适合。

名额有限

这一期,别再只做旁观者

传统测试岗正在被 AI 压缩,而「会测 AI」和「会用 AI 测」的人,正在成为企业紧缺的增量角色。
11 大模块 · 1 个贯穿项目 · 全套可落地的企业级方案

零基础可入学 · 全程实战 · 结课带走完整作品集

作品大图