eval experiment 命令组(别名 exp)用于查看由 eval run 提交的实验:列出实验、查看某个实验的状态与汇总分数、拉取逐条结果。
所有子命令共享
-p, --project <name>(项目名称,默认 default)与 --json(输出原始 JSON)。Documentation Index
Fetch the complete documentation index at: /llms.txt
Use this file to discover all available pages before exploring further.
eval experiment 命令组(别名 exp)用于查看由 eval run 提交的实验:列出实验、查看某个实验的状态与汇总分数、拉取逐条结果。
-p, --project <name>(项目名称,默认 default)与 --json(输出原始 JSON)。agentkit eval experiment list
| 标志/参数 | 说明 | 默认值 |
|---|---|---|
<id> | 实验 ID(必填) | 无 |
agentkit eval experiment get 75901xxxxxxxxxxxxx
ID 75901xxxxxxxxxxxxx
Name qa-set-2026-07-03-12-16-21
Status Success
Dataset qa-set (75900xxxxxxxxxxxxx)
Target 75901xxxxxxxxxxxxx
Weighted score enabled
Overall score 1.00
Evaluators:
相关性 @0.0.1 avg 1.00
1.00: 2 (100%)
| 标志/参数 | 说明 | 默认值 |
|---|---|---|
<id> | 实验 ID(必填) | 无 |
--limit <n> | 每页条数(上限 20) | 20 |
--page <n> | 页码 | 1 |
agentkit eval experiment results 75901xxxxxxxxxxxxx --json
| 状态 | 含义 |
|---|---|
Success | 所有用例执行完成 |
Failed | 有用例执行失败(如目标未响应) |
Draining / Processing | 仍在执行中 |
--target 指向的运行时处于运行状态。