独立研究智能体系统
Harness the Agents 考察把模型变成智能体的系统——循环、工具、记忆、沙箱、控制平面——以及它们真实行为的证据。我们读源码,锁定版本,公开执行轨迹。
出版体系
先讲机制,再谈组织影响。每个栏目都遵守同一条规则:结论必须可核查。
锁定版本的智能体系统拆解——从智能体循环、工具、记忆、权限到执行边界,以注明版本的源码为准。
面向企业的智能体控制架构——身份、策略、审批、预算、可观测性与问责,补上单一 Harness 无法提供的那一层。
可复现的对照实验——相同任务、锁定版本,公开提示词、环境、执行轨迹与局限。
以证据为基础的智能体系统故障分析——发生了什么、背后的机制、影响范围与缓解措施。
每周情报简报:本周有什么发布,以及对运行这些系统的人意味着什么。
精选
DeepSeek 的开源智能体 harness 上线第一周 GitHub 星数就突破了 168,000。我装了它,读了仓库,还亲手跑了一遍。以下是我验证下来站得住的东西。
每个结论都注明所考察的版本、提交与日期。
厂商的说法只是主张,不是证据。代码与执行轨迹优先。
不确定性、失败的测试与复现缺口,同样照实发表。
Agent Field Notes
一份关于 Agent Harness、运行时、安全与治理的简明周报——筛选重要的发布、论文与提交,为需要真正运行这些系统的人而写。