Pesquisa independente sobre sistemas de agentes
Pesquisa independente sobre sistemas de agentes responsáveis.
Harness the Agents é uma publicação e um laboratório de pesquisa independentes, orientados por evidências. Estudamos como os modelos de IA se tornam sistemas de agentes e como esses sistemas são operados com responsabilidade — em harnesses, ambientes de execução, planos de controle, governança, permissões, memória, execução, observabilidade e recuperação.

Pesquisa em destaque
Ver toda a pesquisaInside
DeepSeek Harness não é um matador do Claude Code. É algo mais interessante.
O harness de agentes open-source da DeepSeek passou de 168,000 estrelas no GitHub na primeira semana. Eu o instalei, li o repositório e o executei. Aqui está o que se sustenta.
Above
Amodei's Embedded Evaluators: Access Is the Whole Game
Amodei pledges embedded evaluators with employee-like access and publication rights. What the pledge promises, what it leaves open, and what is on paper today.
Inside
An Agent That Works for Weeks Needs More Than Memory
Salesforce's long-horizon runtime lets an Agentforce agent pursue a goal for weeks. Memory, durable execution and dynamic steering are documented. The authority questions are not.
Consultoria
Precisa deste rigor nos seus próprios sistemas?
Avaliamos, concebemos e governamos sistemas de agentes com o mesmo rigor que publicamos: avaliações fixadas por versão, seleção de harnesses e arquitetura de plano de controlo.
Seções editoriais
Inside the Harness
Análises de sistemas de agentes com versões fixadas: o loop, as ferramentas, a memória, as permissões e os limites de execução, examinados no código-fonte de uma versão identificada.
Above the Harness
Arquitetura empresarial de controle para sistemas de agentes: identidade, políticas, aprovações, orçamentos, observabilidade e responsabilização que nenhum harness oferece sozinho.
Harness Test
Experimentos controlados e reproduzíveis: a mesma tarefa, versões fixadas e prompts, ambientes, traces e limitações publicados.
Unharnessed
Análise orientada por evidências de falhas em sistemas de agentes: o que quebrou, o mecanismo subjacente, o raio de impacto e a mitigação.
Agent Field Notes
Um briefing semanal de inteligência: o que foi lançado e o que isso significa para quem opera esses sistemas.
Experimentos reproduzíveis
Todos os experimentos são documentados de ponta a ponta, para que os resultados possam ser verificados e desenvolvidos.
Metodologia
Desenho e protocolo
Versões
Código e dependências
Modelos
Provedores e configurações
Métricas
O que medimos
Traces
Registros de execução
Resultados
Análise e estatísticas
Limitações
Ameaças e ressalvas
Dados brutos
Downloads
Agent Field Notes
Um boletim periódico que resume nossos artigos mais recentes e remete à pesquisa canônica.
Respeitamos sua caixa de entrada. Cancele a assinatura a qualquer momento.
