语义切片与三级缓存
Semantix 的核心不是“把整段聊天永久塞回 prompt”,而是把可复用经验拆成带来源、作用域和生命周期的切片,再在不同层级复用。
语义切片
切片是可独立检索的最小经验单元。仓库实现包含切片类型、作用域、元数据、文件存储、追加日志、压缩和维护。类型化切片让淘汰策略能够区分短期结果与长期上下文。
L1:供应商前缀缓存
L1 发生在模型供应商或兼容网关层:当前缀字节稳定时,供应商可能复用 prompt 计算。Semantix 可以通过稳定化和观测帮助提高命中,但最终计费与有效期由上游决定。
L2:语义切片注入
L2 根据当前任务检索历史切片,把合格内容注入上下文。它复用的是经验文本,模型仍会继续推理和执行工具。
这层适合复用:仓库约定、已验证命令、用户偏好和任务流程。它不适合直接复用可能已经过期的最终结果。
L3:已验证结果复用
L3 尝试跳过部分重复执行,因此风险最高。仓库将候选交给依赖指纹、规则门和可选 judge;无法证明安全时回退正常执行。
“检索到了相似内容”只够支持 L2 候选,不足以单独批准 L3。
三层关系
| 层级 | 复用对象 | 仍然执行模型/工具 | 主要风险 |
|---|---|---|---|
| L1 | 稳定 prompt 前缀 | 是 | 上游缓存规则与字节漂移 |
| L2 | 历史语义切片 | 是 | 注入噪声或过时背景 |
| L3 | 已验证执行结果 | 可能跳过 | 项目状态变化导致错误复用 |
对应仓库来源
kernel/slice/kernel/inject/kernel/cache/、kernel/fingerprint/、kernel/judge/、kernel/promote/docs/reports/cache-taxonomy.md