近来所记
Structured LLM Design:按生命周期组织 Agent Runtime
从一个“不污染主会话的临时总结”出发,讨论如何按生命周期和所有权重新组织 LLM Agent:Context、Invocation、Task、Process 与 Effect,并由此推导 calling convention、KV cache、structured concurrency 与 CSP-style communication。
当表情成为界面:关于一个情绪生成空间的设想
一个实验性交互网站的设想:让面部表情、身体动作和观看状态成为输入,把人的存在实时转化为影像、三维形态、声音与氛围,并借此讨论机器如何感知、误读和回应人。
Model Ergonomics:Harness 如何影响 Agent 能力
同一个模型换一个 harness,表现可能完全不同。本文从模型易用性出发,讨论模型与工具、上下文、反馈和执行环境之间的匹配关系,并结合 Grok 在 Codex harness 上的运行实践,分析通用设计与专用适配的边界。
让 Gate 看见过程:LLM Agent 开发中的观察、契约与诊断
LLM agent 的开发循环不缺 PASS 或 FAIL,缺的是能指导下一轮修改的过程证据。本文讨论如何在关键验证门禁中记录结构化的过程观察,同时继续依据明确契约判定成败。