整理输出单例可量化

通用长日志准入

工具执行完后筛掉确定不需要的进度文本,原文保留可回读。

构建或命令输出很长时,插件先保护任务所需事实,再让 Jev 逐段判断普通进度、重复提示是否可以不进入主模型上下文。命令本身不会重跑。

接入方式

这项判断如何进入任务

原生接入点
  • tools/post-execute
触发
顶层工具执行后、结果交给 Agent 前的 tools/post-execute;通用日志默认从 6,000 字符开始考虑。
送给 Jev
当前任务、最近助手意图、工具调用意图、候选日志原文和行号,以及必保留原文和保护理由。只把可识别的进度、重复警告等作为候选。
如何采用
typed omit/keep/unknown 逐段决定;达到配置概率和净节省门槛、完整原文先存入 spill 后,才替换模型可见 content,并附恢复位置。失败或不确定时保留原文。

实现依据:候选、判断与应用 ↗可省略行规则 ↗

真实主模型 + 真实 Jev

100 个 TypeScript 模块,500 行构建进度

真实主模型通过原生 bash 构建、运行并哈希一个小型可执行项目;命令输出 500 行编号进度和最终产物信息。

执行与核查对比原始工具文本与写入 Session、实际交给 Agent 的文本,并独立核对最终产物哈希。

实际观察

8,510 字符缩至 2,072,净省 6,438 字符(75.7%);省略标记和恢复位置可见,主模型报告的产物哈希与实际产物一致。证据:工具输出准入:真实 profile 报告 ↗

这是一个合成项目的一次真实 profile 结果,不是平均 token、费用或端到端时间节省。

真实运行 · 完整原文控制

要求完整清单时不问 Jev

另一次任务明确要求完整文件清单,命令输出覆盖 201 个文件。

执行与核查检查是否调用 Jev;通过 DSH 原生 spill 定位并读回完整输出。

实际观察

Jev 零调用;原生 spill 保留完整输出的回读位置,主模型在同一 Session 续接中读回并核对文件数与哈希。证据:工具输出准入:真实 profile 报告 ↗

这验证保留完整输出的控制路径;不是同一条结果同时触发 Jev 省略与原生 spill 的实验。

这些结果的边界

  • 只更改符合条件的模型可见文本,不改变结构化工具值或命令结果。
  • 单次 75.7% 不可推广成长期平均效果。