> For the complete documentation index, see [llms.txt](https://doc.duaer.com/zh/llms.txt). Markdown versions of documentation pages are available by appending `.md` to page URLs; this page is available as [Markdown](https://doc.duaer.com/zh/advanced-ai/evaluations/light-evaluations.md).

# 在 Duaer 里做轻量评估

在 Duaer 里，开发阶段用少量已知样例跑数字组织，并排查看输出，先不必上正式指标。
## 轻量评估做什么

搭数字组织时，先用几条样例感受表现并迭代。这一阶段并排看输出通常就够，正式打分的收益还不抵成本。

轻量评估会按测试集一行一行跑数字组织，并把实际输出写回数据集，方便和期望输出对照。

## 怎么做

1. 建数据集：在项目数据表或 Google 表格里放少量样例。列要有输入、可选的期望输出，以及留给实际输出的空列。用 Google 表格时先配好 Sheets 凭证。
2. 接上评估触发器：放 Evaluation Trigger，让它一次吐出一行。点「全部评估」会对每一行依次跑整条数字组织。接线时若只想跑一行，把「最多处理行数」设为 1，或只执行该触发器节点。
3. 把触发器接到后面：至少把输入列接到后面节点。若还有生产触发器，先把两路整理成同一 JSON 形状再合并，见 [组合多个触发器](/zh/advanced-ai/evaluations/tips-and-common-issues.md#combining-multiple-triggers)。
4. 写回输出：在已经算出结果的位置后加 Evaluation 节点的 Set outputs，把字段映射到数据集的实际输出列。
5. 运行评估：从评估触发器一侧执行数字组织。每一行都会跑一遍。在数据表或表格里看输出；需要细节时打开执行列表。

样例变多之后，改用 [基于指标的评估](/zh/advanced-ai/evaluations/metric-based-evaluations.md) 看汇总分数。概念说明见 [评估概览](/zh/advanced-ai/evaluations/overview.md)。
## Questions

### Duaer 的轻量评估做什么？

用少量测试行逐条跑数字组织，把实际输出写回数据表或表格，方便并排查看。这时通常还不需要正式分数。

### 测试集可以放在哪里？

用项目里的数据表，或接好凭证的 Google 表格。列里要有输入、可选的期望输出，以及留给实际输出的空列。

