> For the complete documentation index, see [llms.txt](https://doc.duaer.com/llms.txt). Markdown versions of documentation pages are available by appending `.md` to page URLs; this page is available as [Markdown](https://doc.duaer.com/zh/advanced-ai/evaluations/metric-based-evaluations.md).

# 在 Duaer 里用指标衡量质量

在 Duaer 里，按测试集跑 AI 数字组织，把算好的分数记进评估结果，用来对照不同版本。
## 测试集和评估节点

用 Evaluation Trigger（或文档所说的测试数据来源）一次取一行测试数据。数字组织跑完后，Evaluation 节点收集分数。分数出现在评估页，不一定写回表格。

## 计算指标 <a href="#2-calculate-metrics" id="2-calculate-metrics"></a>

1. 在 Evaluation 节点之前，用 Code、对比节点或 Set Metrics 算出正确率、相关性等字段。
2. 把这些字段映射进 Evaluation 节点。
3. 打开评估页，点运行测试，对照汇总分数。

节点上“查看指标示例”链到这一节。映射的名字要和前面算出来的字段一致，否则评估页是空的或错的。生产运行里若不想算指标，可先用“是否在评估”分支包住指标逻辑。
## Questions

### Duaer 的基于指标的评估做什么？

按测试集跑数字组织，把你算好的分数记进评估结果。分数在评估页看。指标要在 Evaluation 节点之前算好，再映射进去。

### Duaer 评估里的指标从哪里来？

从你在数字组织里算出来的字段来，也可以用 Evaluation 节点的 Set Metrics。Duaer 不会替你发明和业务无关的分数。

