跳到主要内容

独立研究智能体系统

模型负责推理。Harness 负责行动。

Harness the Agents 考察把模型变成智能体的系统——循环、工具、记忆、沙箱、控制平面——以及它们真实行为的证据。我们读源码,锁定版本,公开执行轨迹。

精选

Inside

DeepSeek Harness 不是 Claude Code 杀手,它是更有趣的东西

DeepSeek 的开源智能体 harness 上线第一周 GitHub 星数就突破了 168,000。我装了它,读了仓库,还亲手跑了一遍。以下是我验证下来站得住的东西。

证据规则

锁定版本

每个结论都注明所考察的版本、提交与日期。

以源码为据

厂商的说法只是主张,不是证据。代码与执行轨迹优先。

局限公开

不确定性、失败的测试与复现缺口,同样照实发表。