Investigación independiente sobre sistemas de agentes
Investigación independiente sobre sistemas de agentes responsables.
Harness the Agents es una publicación y un laboratorio de investigación independientes, guiados por la evidencia. Estudiamos cómo los modelos de IA se convierten en sistemas de agentes y cómo esos sistemas se operan de forma responsable: harnesses, entornos de ejecución, planos de control, gobernanza, permisos, memoria, ejecución, observabilidad y recuperación.

Investigación destacada
Ver toda la investigaciónInside
DeepSeek Harness no es un asesino de Claude Code. Es algo más interesante.
El harness de agentes de código abierto de DeepSeek superó las 168,000 estrellas de GitHub en su primera semana. Lo instalé, leí el repositorio y lo ejecuté yo mismo. Esto es lo que resiste el análisis.
Above
Amodei's Embedded Evaluators: Access Is the Whole Game
Amodei pledges embedded evaluators with employee-like access and publication rights. What the pledge promises, what it leaves open, and what is on paper today.
Inside
An Agent That Works for Weeks Needs More Than Memory
Salesforce's long-horizon runtime lets an Agentforce agent pursue a goal for weeks. Memory, durable execution and dynamic steering are documented. The authority questions are not.
Asesoría
¿Necesita este rigor en sus propios sistemas?
Evaluamos, diseñamos y gobernamos sistemas de agentes con el mismo rigor que publicamos: evaluaciones con versión fijada, selección de harnesses y arquitectura de plano de control.
Secciones editoriales
Inside the Harness
Análisis de sistemas de agentes con versiones fijadas: el bucle, las herramientas, la memoria, los permisos y los límites de ejecución, examinados en el código fuente de una versión identificada.
Above the Harness
Arquitectura empresarial de control para sistemas de agentes: identidad, políticas, aprobaciones, presupuestos, observabilidad y rendición de cuentas que ningún harness ofrece por sí solo.
Harness Test
Experimentos controlados y reproducibles: la misma tarea, versiones fijadas y prompts, entornos, trazas y limitaciones publicados.
Unharnessed
Análisis basado en pruebas de fallos en sistemas de agentes: qué se rompió, el mecanismo subyacente, el alcance del impacto y la mitigación.
Agent Field Notes
Un boletín semanal de inteligencia: qué se ha lanzado y qué significa para quienes operan estos sistemas.
Experimentos reproducibles
Todos los experimentos se documentan de principio a fin para que los resultados puedan verificarse y servir de base.
Metodología
Diseño y protocolo
Versiones
Código y dependencias
Modelos
Proveedores y configuraciones
Métricas
Lo que medimos
Trazas
Registros de ejecución
Resultados
Análisis y estadísticas
Limitaciones
Riesgos y salvedades
Datos brutos
Descargas
Agent Field Notes
Un boletín periódico que resume nuestros últimos artículos y enlaza a la investigación canónica.
Respetamos tu bandeja de entrada. Puedes darte de baja en cualquier momento.
