分类:技术

9 篇

Model Ergonomics:Harness 如何影响 Agent 能力

同一个模型换一个 harness,表现可能完全不同。本文从 Model ergonomics 出发,讨论模型与工具、上下文、反馈和执行环境之间的匹配关系,并以 Grok 运行在 Codex harness 上的实践分析 generalized harness 与 specialized harness 的边界。

2026年9月1日技术
Harness EngineeringAI AgentsModel ErgonomicsCodex

让 Gate 看见过程:LLM Agent 开发中的观察、契约与诊断

LLM agent 的开发循环不缺 PASS 或 FAIL,缺的是能指导下一轮修改的过程证据。本文讨论如何在关键 gate 中加入结构化 observation,同时让明确契约继续决定成败。

2026年8月28日技术
Harness EngineeringAI AgentsSoftware TestingObservability

Bitter Lesson 之后:Agent 的手工设计会消失吗?

当智能体开始从执行轨迹中学习,意图分类、任务阶段、规划器和状态机可能逐渐被模型吸收,但接口、安全边界、评估与运行环境不会因此消失。

2026年7月14日技术
AI AgentsThe Bitter LessonHarness EngineeringReinforcement Learning
系列大语言模型智能体的运行时架构1/2架构篇

从工具调用到事件驱动:大语言模型智能体的运行时架构

大语言模型智能体不应只被理解为一次次工具调用的串联;当任务变长、环境变复杂,运行时需要转向事件驱动的架构来承载状态、并发、观察和恢复。

2026年6月21日技术
AI AgentsRuntimeEvent-Driven Architecture
系列大语言模型智能体的运行时架构2/2控制流篇

谁在调用谁:用通信过程和协程理解大语言模型智能体

与其把大语言模型智能体理解为模型调用工具,不如把它看作多个通信过程和协程共同推进的系统;这种视角能更清楚地解释事件来源、控制权转移、暂停与恢复。

2026年6月21日技术
AI AgentsCoroutinesCommunication

代码库的文化与智能编程代理的使用范式

智能编程代理不会自动让代码库变好,它会进入、学习并放大既有代码文化;工程师需要管理代码库中哪些模式会成为未来生成的范例。

2026年6月18日技术
Programming AgentsSoftware Engineering

Harness Engineering:模型之外的工程

AI agent 的可靠性不只取决于模型能力,也取决于工具、权限、验证、观察和人工确认构成的运行环境。

2026年6月18日技术
Harness EngineeringAISoftware Engineering

自定义 MCP 工具加速软件开发

从一次 Cursor Meetup 分享整理而来,讨论如何把团队反复发生的工程动作封装成可控、可复用、适合 AI 调用的 MCP 工具,并以 Excel 文件验证案例说明反馈循环的价值。

2025年8月9日技术
MCPAI AgentsDeveloper ToolsCursor

那些关于函数式编程和函数式编程语言的神话(译)

理解并重述

2015年10月22日技术
Functional ProgrammingHaskell