> ## Documentation Index
> Fetch the complete documentation index at: https://docs.veadk.xyz/llms.txt
> Use this file to discover all available pages before exploring further.

# 查看实验与结果

`eval experiment` 命令组（别名 `exp`）用于查看由 [`eval run`](/productions/agentkit-cli/archives/0.50.7/zh/commands/eval/run) 提交的实验：列出实验、查看某个实验的状态与汇总分数、拉取逐条结果。

<Note>
  所有子命令共享 `-p, --project <name>`（项目名称，默认 `default`）与 `--json`（输出原始 JSON）。
</Note>

## experiment list

列出项目下的实验：ID、名称、状态、开始时间、汇总分数。

```bash lines theme={null}
agentkit eval experiment list
```

## experiment get

查看某个实验的详情：状态、数据集、目标、加权总分，以及每个评估器的平均分与分数分布。

| 标志/参数 | 说明 | 默认值 |
| - | - | - |
| `<id>` | 实验 ID（必填） | 无 |

```bash lines theme={null}
agentkit eval experiment get 75901xxxxxxxxxxxxx
```

```text lines theme={null}
ID              75901xxxxxxxxxxxxx
Name            qa-set-2026-07-03-12-16-21
Status          Success
Dataset         qa-set (75900xxxxxxxxxxxxx)
Target          75901xxxxxxxxxxxxx
Weighted score  enabled
Overall score   1.00

Evaluators:
  相关性 @0.0.1  avg 1.00
    1.00: 2 (100%)
```

## experiment results

拉取逐条结果：每条数据集用例、目标输出、以及各评估器的分数与理由。

| 标志/参数 | 说明 | 默认值 |
| - | - | - |
| `<id>` | 实验 ID（必填） | 无 |
| `--limit <n>` | 每页条数（上限 20） | `20` |
| `--page <n>` | 页码 | `1` |

```bash lines theme={null}
agentkit eval experiment results 75901xxxxxxxxxxxxx --json
```

## 实验状态

| 状态 | 含义 |
| - | - |
| `Success` | 所有用例执行完成 |
| `Failed` | 有用例执行失败（如目标未响应） |
| `Draining` / `Processing` | 仍在执行中 |

<Tip>
  用例失败但没有实验级错误信息时，通常是目标运行时未正常响应（未部署、未就绪或鉴权失败），而非评测配置问题；请先确认 `--target` 指向的运行时处于运行状态。
</Tip>
