Unabhängige Forschung zu Agentensystemen
Unabhängige Forschung zu verantwortungsvollen Agentensystemen.
Harness the Agents ist eine unabhängige, evidenzgeleitete Publikation und Forschungswerkstatt. Wir untersuchen, wie KI-Modelle zu Agentensystemen werden und wie diese Systeme verantwortungsvoll betrieben werden – über Harnesses, Laufzeitumgebungen, Steuerungsebenen, Governance, Berechtigungen, Speicher, Ausführung, Beobachtbarkeit und Wiederherstellung hinweg.

Ausgewählte Forschung
Alle Forschungsarbeiten ansehenInside
DeepSeek Harness ist kein Claude-Code-Killer. Es ist etwas Interessanteres.
DeepSeeks quelloffenes Agenten-Harness knackte in seiner ersten Woche 168,000 GitHub-Sterne. Ich habe es installiert, das Repo gelesen und selbst laufen lassen. Hier ist, was Bestand hat.
Above
Amodei's Embedded Evaluators: Access Is the Whole Game
Amodei pledges embedded evaluators with employee-like access and publication rights. What the pledge promises, what it leaves open, and what is on paper today.
Inside
An Agent That Works for Weeks Needs More Than Memory
Salesforce's long-horizon runtime lets an Agentforce agent pursue a goal for weeks. Memory, durable execution and dynamic steering are documented. The authority questions are not.
Beratung
Brauchen Sie diese Gründlichkeit für Ihre eigenen Systeme?
Wir bewerten, konzipieren und steuern Agentensysteme mit derselben Gründlichkeit, die wir veröffentlichen: versionsverankerte Assessments, Harness-Auswahl und Control-Plane-Architektur.
Redaktionelle Ressorts
Inside the Harness
Versionsfixierte Teardowns von Agentensystemen: Schleife, Werkzeuge, Speicher, Berechtigungen und Ausführungsgrenzen, untersucht im Quellcode einer benannten Version.
Above the Harness
Unternehmensweite Steuerungsarchitektur für Agentensysteme: Identität, Richtlinien, Genehmigungen, Budgets, Beobachtbarkeit und Rechenschaftspflicht, die kein einzelnes Harness bereitstellt.
Harness Test
Reproduzierbare kontrollierte Experimente: dieselbe Aufgabe, fixierte Versionen sowie veröffentlichte Prompts, Umgebungen, Traces und Einschränkungen.
Unharnessed
Beleggestützte Analyse von Fehlern in Agentensystemen: was versagte, der dahinterliegende Mechanismus, der Schadensradius und die Gegenmaßnahme.
Agent Field Notes
Ein wöchentliches Intelligence-Briefing: was veröffentlicht wurde und was es für die Menschen bedeutet, die diese Systeme betreiben.
Reproduzierbare Experimente
Alle Experimente sind durchgehend dokumentiert, damit Ergebnisse überprüft und weiterentwickelt werden können.
Methodik
Design & Protokoll
Versionen
Code & Abhängigkeiten
Modelle
Anbieter & Konfigurationen
Metriken
Was wir messen
Traces
Ausführungsprotokolle
Ergebnisse
Analyse & Statistik
Grenzen
Risiken & Vorbehalte
Rohdaten
Downloads
Agent Field Notes
Ein regelmäßiges Briefing, das unsere neuesten Artikel zusammenfasst und auf die kanonische Forschung zurückverweist.
Wir respektieren Ihren Posteingang. Abmeldung jederzeit möglich.
