Riset independen tentang sistem agen
Riset independen tentang sistem agen yang bertanggung jawab.
Harness the Agents adalah publikasi dan laboratorium riset independen yang berbasis bukti. Kami mempelajari bagaimana model AI menjadi sistem agen dan bagaimana sistem tersebut dioperasikan secara bertanggung jawab — mencakup harness, runtime, bidang kontrol, tata kelola, izin, memori, eksekusi, observabilitas, dan pemulihan.

Riset pilihan
Lihat semua risetInside
DeepSeek Harness Bukan Pembunuh Claude Code. Ia Sesuatu yang Lebih Menarik.
Harness agen open-source DeepSeek menembus 168,000 bintang GitHub dalam minggu pertamanya. Saya menginstalnya, membaca repositorinya, dan menjalankannya sendiri. Inilah yang terbukti bertahan.
Above
Amodei's Embedded Evaluators: Access Is the Whole Game
Amodei pledges embedded evaluators with employee-like access and publication rights. What the pledge promises, what it leaves open, and what is on paper today.
Inside
An Agent That Works for Weeks Needs More Than Memory
Salesforce's long-horizon runtime lets an Agentforce agent pursue a goal for weeks. Memory, durable execution and dynamic steering are documented. The authority questions are not.
Advisory
Butuh ketelitian yang sama untuk sistem Anda sendiri?
Kami mengevaluasi, merancang, dan mengelola sistem agen dengan ketelitian yang sama seperti yang kami terbitkan: penilaian yang terkunci pada versi, pemilihan harness, dan arsitektur control plane.
Rubrik editorial
Inside the Harness
Bedah sistem agen dengan versi yang dikunci: loop, alat, memori, izin, dan batas eksekusi, diperiksa dalam kode sumber pada versi yang disebutkan.
Above the Harness
Arsitektur kontrol perusahaan untuk sistem agen: identitas, kebijakan, persetujuan, anggaran, observabilitas, dan akuntabilitas yang tidak dapat disediakan oleh satu harness saja.
Harness Test
Eksperimen terkontrol yang dapat direproduksi: tugas yang sama, versi yang dikunci, serta prompt, lingkungan, jejak, dan batasan yang diterbitkan.
Unharnessed
Analisis berbasis bukti tentang kegagalan sistem agen: apa yang rusak, mekanisme di baliknya, cakupan dampak, dan mitigasinya.
Agent Field Notes
Ringkasan intelijen mingguan: apa yang telah dirilis dan apa artinya bagi orang-orang yang menjalankan sistem ini.
Eksperimen yang dapat direproduksi
Semua eksperimen didokumentasikan dari awal hingga akhir sehingga hasilnya dapat diverifikasi dan dikembangkan lebih lanjut.
Metodologi
Desain & protokol
Versi
Kode & dependensi
Model
Penyedia & konfigurasi
Metrik
Yang kami ukur
Jejak
Log eksekusi
Hasil
Analisis & statistik
Batasan
Ancaman & catatan
Data mentah
Unduhan
Agent Field Notes
Buletin berkala yang merangkum artikel terbaru kami dan menautkan kembali ke riset kanonis.
Kami menghargai kotak masuk Anda. Berhenti berlangganan kapan saja.
