Skip to main content
一次运行结束后,你可能在终端看结果,也可能在浏览器里翻对话,或者让 CI 脚本读 JSON。三种方式看到的是同一份结果,只是排版不同。这一页说明结果保存在哪里、怎样被读出来,以及三个查看入口各管什么。

结果保存在一个文件里

每个项目的运行结果都保存在 .niceeval/record.sqlite,这就是 Record。niceeval exp 开始时创建 Run,并记下这次计划要跑的所有 Attempt。每个 Attempt 跑完就单独发布,马上可以读到,不必等整个 Run 结束。已发布的 Attempt 和已结束的 Run 都不会再被修改。 运行完整结束后,这个文件本身就可以复制或归档。要读别人交给你的副本时,给 query 或 show 加 --record <file>;NiceEval 会先完整校验这个文件,再只读打开。

读取规则由 NiceEval 固定

读取结果时,选哪些 Run、读到哪个时刻为止、哪些结果缺失、有哪些问题、用什么证据、怎样比较,都由 NiceEval 内置的固定查询决定。查询返回的是普通数据,不会把数据库连接、文件路径或读取对象交给调用者。 内置查询覆盖 Run、Attempt、trace、diff、sources、artifacts 和 Run 之间的比较。你不能用临时 SQL、JSON path 或公式自定义读取方式。

三个查看入口

  • niceeval show 在终端里先看总览,再逐层查看某个 Attempt 的对话、耗时和改动。你和 Coding Agent 都用它排查问题。
  • niceeval query 输出结构化 JSON,给脚本和 CI 读取,Agent 需要精确字段时也用它。
  • niceeval view 给人在浏览器用,打开只监听本机地址、受访问保护的 Insight 界面。
三个入口读到的是同一份查询结果。它们只负责各自的排版:JSON、终端文字或浏览器页面。它们不会各自挑选结果,也不会重新计算通过率或分数,所以同一个 Run 在三处看到的结论一致。 完整命令见 CLI。结果文件怎样复制和校验,见 Record。