跳到内容
Zhang Hua Feng/張華楓's Notes
首页文章书签分类标签关于
中文English

标签:Harness Engineering

4 篇

Model Ergonomics:Harness 如何影响 Agent 能力

同一个模型换一个 harness,表现可能完全不同。本文从模型易用性出发,讨论模型与工具、上下文、反馈和执行环境之间的匹配关系,并结合 Grok 在 Codex harness 上的运行实践,分析通用设计与专用适配的边界。

2026年9月1日技术
Harness EngineeringAI AgentsModel ErgonomicsCodex

让 Gate 看见过程:LLM Agent 开发中的观察、契约与诊断

LLM agent 的开发循环不缺 PASS 或 FAIL,缺的是能指导下一轮修改的过程证据。本文讨论如何在关键验证门禁中记录结构化的过程观察,同时继续依据明确契约判定成败。

2026年8月28日技术
Harness EngineeringAI AgentsSoftware TestingObservability

Bitter Lesson 之后:Agent 的手工设计会消失吗?

当智能体开始从执行轨迹中学习,意图分类、任务阶段、规划器和状态机可能逐渐被模型吸收,但接口、安全边界、评估与运行环境不会因此消失。

2026年7月14日技术
AI AgentsThe Bitter LessonHarness EngineeringReinforcement Learning

Harness Engineering:模型之外的工程

AI agent 的可靠性不只取决于模型能力,也取决于工具、权限、验证、观察和人工确认构成的运行环境。

2026年6月18日技术
Harness EngineeringAISoftware Engineering
记录是生活的微小仪式感
RSS© 2026 Zhang Hua Feng/張華楓's Notes