/** * Report 最终化 —— task execution 结果 → 完整 Report。 * * `executeTasks` 出来的是裸结果(results / totalCostUSD),`aggregateReport` 把 * 它们包成 Report 骨架。`finalizeEvaluationReport` 在这之上挂三层后置分析: * - `report.analysis` 主体: diagnostics + sampleQuality(传入 samples 用于 * capability / difficulty / construct / provenance 覆盖率聚合) * - 可选 coverage: 仅当结果里含 tool trace 数据时计算 * - 可选 gapReports: 文本信号(markers / hedging)始终适用,与 tool trace 无关; * 带上 testSetHash 水印(spec §7.1 强制要求) * * 仅被 orchestrator 调用;独立拆出主要为让 orchestrator 的 try-finally 主干 * 看起来纯粹是「执行→收尾」时序。 */ import type { Artifact, Report, Sample, VariantResult } from '../../types/index.js'; type EvaluationResults = Record>; export declare function finalizeEvaluationReport({ report, results, artifacts, variantNames, samplesPath, samplesSourceFiles, samples, }: { report: Report; results: EvaluationResults; artifacts: Artifact[]; variantNames: string[]; samplesPath: string; /** 目录模式下,bundle 内所有源文件;单文件模式下 [samplesPath]。computeTestSetHash 用。 */ samplesSourceFiles?: string[]; samples: Sample[]; }): Report; export {};