项目档案

问题、假设、系统,以及失败过的部分。

LAB-003 · 探索 · 14.0°C 开发中

Conservative Coding Agent

一个强调最小必要修改和变更安全验证的 Coding Agent。

问题

现有 Coding Agent 能完成修改,但难以控制修改范围,也很难证明没有引入额外问题。改对一个函数的同时顺手"优化"另外三个,是常态而非事故。

假设

如果 Agent 在修改前理解局部语义边界,并在修改后进行增量验证,可以显著降低非预期变更。

系统
├── Context Layer ├── Planning Harness ├── AST Analysis ├── Minimal Diff └── Incremental Validation
下一阶段

上下文层的语义边界检测:从"文件级"收缩到"符号级"。

失败尝试

  • 一次性注入完整仓库结构:没有提升理解能力,反而加剧了上下文污染。见 LTN-023 的浓度问题。
  • 让 Agent 自我报告修改范围:报告与实际 diff 的一致率不到 60%。口头承诺不构成验证。

相关文章

  • LTN-024 Skill 的评价与优化
  • LTN-022 为什么我放弃原来的 Sandbox 架构
LAB-001 · 稳定 · 4.2°C 运行中

LowTemp Notes

这个网站本身:一个把知识成熟度可视化为温度的个人实验室。

问题

个人博客通常只有"已发布"一种状态,文章发表后假装永远静止,读者无法区分成熟结论和随手想法。

假设

给每篇内容标注状态与温度,并公开演化历史,可以让读者校准信任,也让作者敢于发布未完成的思想。

系统
├── Astro Static Site ├── Content Collections ├── Status-Temperature Mapping └── Generative Crystal Mark
下一阶段

温度史的可视化:单篇文章的降温曲线。

失败尝试

  • 第一个版本想做全文搜索:静态站加索引的复杂度远超收益。五项导航以内的网站,不需要搜索。