मुख्य सामग्री पर जाएँ

एजेंट प्रणालियों पर स्वतंत्र शोध

मॉडल तर्क करते हैं।हार्नेस कार्रवाई करते हैं।

Harness the Agents उन प्रणालियों की जाँच करता है जो मॉडलों को एजेंट में बदलती हैं: लूप, टूल, मेमोरी, सैंडबॉक्स, कंट्रोल प्लेन और उनके वास्तविक व्यवहार के प्रमाण। हम स्रोत कोड पढ़ते हैं, संस्करण पिन करते हैं और ट्रेस प्रकाशित करते हैं।

प्रकाशन

पाँच संपादकीय खंड, एक प्रमाण मानक।

पहले तंत्र, फिर संगठनात्मक प्रभाव। हर खंड एक ही नियम पर काम करता है: ऐसे दावे जिन्हें आप जाँच सकते हैं।

  1. 01

    Inside the Harness

    एजेंट प्रणालियों के संस्करण-पिन विश्लेषण: लूप, टूल, मेमोरी, अनुमतियाँ और निष्पादन सीमाएँ, जिन्हें नामित संस्करण के स्रोत कोड में जाँचा जाता है।

  2. 02

    Above the Harness

    एजेंट प्रणालियों के लिए एंटरप्राइज़ नियंत्रण आर्किटेक्चर: पहचान, नीतियाँ, अनुमोदन, बजट, ऑब्ज़र्वेबिलिटी और जवाबदेही, जिन्हें कोई एक हार्नेस उपलब्ध नहीं कराता।

  3. 03

    Harness Test

    पुनरुत्पाद्य नियंत्रित प्रयोग: वही कार्य, पिन किए गए संस्करण तथा प्रकाशित prompts, परिवेश, ट्रेस और सीमाएँ।

  4. 04

    Unharnessed

    एजेंट प्रणाली की विफलताओं का प्रमाण-आधारित विश्लेषण: क्या टूटा, उसके पीछे का तंत्र, प्रभाव का दायरा और जोखिम कम करने के उपाय।

  5. 05

    Agent Field Notes

    साप्ताहिक इंटेलिजेंस ब्रीफ़िंग: क्या जारी हुआ और इन प्रणालियों को चलाने वाले लोगों के लिए उसका क्या अर्थ है।

चुनिंदा

Inside

DeepSeek Harness कोई Claude Code किलर नहीं है। यह उससे कहीं ज़्यादा दिलचस्प चीज़ है।

DeepSeek का ओपन-सोर्स एजेंट हार्नेस पहले ही हफ़्ते में 168,000 GitHub स्टार पार कर गया। मैंने इसे इंस्टॉल किया, रेपो पढ़ी और खुद चलाया। यहाँ बताया है कि क्या सच में टिकता है।

प्रमाण के नियम

संस्करण-पिन किया हुआ

हर दावे में जाँचा गया संस्करण, commit और तारीख बताई जाती है।

स्रोत-आधारित

विक्रेताओं के बयान दावे हैं, प्रमाण नहीं। कोड और ट्रेस पहले आते हैं।

सीमाएँ दर्ज

अनिश्चितता, विफल परीक्षण और पुनरुत्पादन की कमियाँ भी प्रकाशित की जाती हैं।