eval experiment 命令组(别名 exp)用于查看由 eval run 提交的实验:列出实验、查看某个实验的状态与汇总分数、拉取逐条结果。
Documentation Index
Fetch the complete documentation index at: /llms.txt
Use this file to discover all available pages before exploring further.
eval experiment 命令组(别名 exp)用于查看由 eval run 提交的实验:列出实验、查看某个实验的状态与汇总分数、拉取逐条结果。
| 标志/参数 | 说明 | 默认值 |
|---|---|---|
-p, --project <name> | 项目名称 | default |
--json | 输出原始 JSON | false |
agentkit eval experiment list
| 标志/参数 | 说明 | 默认值 |
|---|---|---|
<id> | 实验 ID(必填) | 无 |
-p, --project <name> | 项目名称 | default |
--json | 输出原始 JSON | false |
agentkit eval experiment get 75901xxxxxxxxxxxxx
ID 75901xxxxxxxxxxxxx
Name qa-set-2026-07-03-12-16-21
Status Success
Dataset qa-set (75900xxxxxxxxxxxxx)
Target 75901xxxxxxxxxxxxx
Weighted score enabled
Overall score 1.00
Evaluators:
相关性 @0.0.1 avg 1.00
1.00: 2 (100%)
| 标志/参数 | 说明 | 默认值 |
|---|---|---|
<id> | 实验 ID(必填) | 无 |
-p, --project <name> | 项目名称 | default |
--limit <n> | 每页条数(上限 20) | 20 |
--page <n> | 页码 | 1 |
--json | 输出原始 JSON | false |
agentkit eval experiment results 75901xxxxxxxxxxxxx --json
| 状态 | 含义 |
|---|---|
Success | 所有用例执行完成 |
Failed | 有用例执行失败(如目标未响应) |
Draining / Processing | 仍在执行中 |
--target 指向的运行时处于运行状态。