公开课大模型与 Agent 评测实战
大模型与 Agent 评测实战
共 19 讲
第 17 讲 · 10:56
Langfuse 的 Trace 和 Evals
本讲实验:简介写了从 Observation、Trace、Session 讲到 Evals、Datasets 和 Metrics。
在 B 站打开这一集前端屎不了B 站合集视频由 B 站播放。
这门课
一门课讲清 AI 测评和传统测试差在哪,指标、流程、风险和缺陷怎么定级,再用 EvalScope 对接 Langfuse 把一批用例跑起来。视频来自学掌门的公开合集,站点只收测评主线。
- 适合谁
- 做 AI 测试、模型验收或 Agent 上线评审的测试和研发。
- 学完能做什么
- 能说出评什么、用什么指标、缺陷怎么定级,并按课把 EvalScope 和 Langfuse 接上跑完一批用例。
想让团队一起学?团队培训按范围安排。 预约评估