把长文章画成图——每篇一张,图为主,文为辅。
同一个「随机数 1–100」prompt,四个模型交出四种截然不同却各自稳定的答案分布。把 LLM「答不准随机数」这个缺陷当成取证信号——一个 token 就能指纹化、归类谱系、审计 API 端点。
→AGENTS.md 不再只指导 coding——现在还能指导审查。把团队隐性知识编码为可引用、可 scope 的 review 指令。
→熄灯工厂(没人读代码)为什么行不通——再多的循环也抬不动天花板:好设计没有快速 oracle,RL 奖励不到它。从 RL 奖励的一维性、时间尺度错配,到四阶段前置规划的解药。
→每篇讲解页头部链向原始来源 URL,可追溯原文。