मुख्य सामग्री पर जाएँ
संग्रह

विश्लेषण

मॉडलों को एजेंटों में बदलने वाले सिस्टमों का साक्ष्य-आधारित विश्लेषण: हार्नेस और मेमोरी से लेकर पहचान, सुरक्षा और नियंत्रण तक। नवीनतम इनसाइट्स पहले।

संपादकीय खंड

हार्नेस के भीतर: MCP में OAuth जारीकर्ता बंधन, और प्रोटोकॉल सुरक्षा आखिर स्ट्रिंग तुलना पर क्यों टिकती है

Inside the Harness

MCP 2026-07-28 विनिर्देश ने OAuth मजबूत करने वाले छह SEP जारी किए, और महत्वपूर्ण वाले एक साधारण सवाल पर हैं: यह प्रतिक्रिया वास्तव में किस सर्वर से आई? मिक्स-अप हमला मॉडल, वास्तविक जारीकर्ता विफलताएँ जो MCP क्लाइंट को पहले से तोड़ रहे हैं, और कार्यान्वयनकर्ताओं को क्या बदलना होगा।

mcpoauthissuer bindingrfc 9207mix-up attackagent securityspecification

Grok Bot और हमेशा चालू सहायक: AI को अपना कंप्यूटर मिलने पर क्या बदलता है

Agent Field Notes

Grok Bot नामित AI एजेंटों को एक स्थायी क्लाउड कंप्यूटर पर चलाता है जो लैपटॉप बंद होने पर भी काम करता रहता है। पहले सप्ताह में स्थायित्व मॉडल, कार्रवाई सीमा, कीमत और सुरक्षा नियंत्रण वास्तव में कैसे दिखते हैं।

grok botxaispacexaipersistent agentscloud computerai assistantagent safety

एजेंटों पर 'माइंड वायरस' शोधपत्र, ठीक से पढ़ें

Harness Test

Anthropic Fellows का एक शोधपत्र दिखाता है कि AI एजेंट अपनी स्मृति फ़ाइलों के जरिए विचार एक-दूसरे तक फैला सकते हैं। प्रयोगों में वास्तव में क्या हुआ, बचाव उपाय उत्साहजनक क्यों हैं, और साझा-स्मृति एजेंट प्रणालियों के लिए इसका क्या मतलब है।

mind virusmulti-agent systemsagent memorymemory poisoninganthropicai safetyagent security

क्या AI एजेंटों को प्रोडक्शन लेखन पहुँच कमानी चाहिए? NeuBird का जवाब हाँ है, मेरा भी

Agent Field Notes

NeuBird AI का Earned Autonomy Framework प्रस्ताव देता है कि एजेंट सत्यापित भरोसे के चार स्तरों से गुजरते हुए केवल-पठन से स्वायत्त प्रोडक्शन बदलावों तक पहुँचें। स्तर कहाँ सही हैं, रोलबैक और पहुँच-निरसन कहाँ कठिन होते हैं, और अर्जित लेखन पहुँच मुझे रूट या केवल-पठन दोनों से बेहतर क्यों लगती है।

neubirdearned autonomyagent governanceproduction write accesssreai agents

Cursor Origin: क्या एजेंट रिपॉजिटरी का रूप बदलने वाले हैं?

Above the Harness

Cursor के Origin ने एडिटर के भीतर Git होस्टिंग, पुल अनुरोध और GitHub सिंक जोड़े हैं, और इसे 'एजेंट पैमाने पर Git होस्टिंग' कहा गया है। मैंने देखा कि एजेंटों के लिए वास्तव में क्या बदला: आज जवाब है होस्टिंग और निकटता, अनुमतियाँ नहीं। क्या एजेंट रिपॉजिटरी को बदलना शुरू कर रहे हैं, इस पर मेरा आकलन।

cursorcursor origincode hostingcoding agentsgithubcode reviewagent scale

Harness ने सुरक्षा एजेंट उतारे जो पैच लिखते हैं, लेकिन अंतिम मंजूरी इंसान की है

Agent Field Notes

सॉफ्टवेयर डिलीवरी प्लेटफ़ॉर्म कंपनी Harness ने ऐसे AI एजेंट लॉन्च किए जो कमजोरियाँ खोजते, छाँटते, पैच करते और आभासी ढाल लगाते हैं, लेकिन हर सुधार भेजे जाने से पहले डेवलपर की मंजूरी जरूरी है। एजेंट वास्तव में क्या करते हैं, मंजूरी की सीमा कहाँ है, और विक्रेता के अपने आँकड़े क्या साबित करते हैं और क्या नहीं।

harnessai securitysecurity agentsvulnerability remediationsastvirtual patchingdevops

एक AI सुरक्षा एजेंट ने Snowflake में सेंध लगाई। Copilot वाली कहानी शोर थी

Unharnessed

Wiz के Red Agent ने Snowflake की रिपॉजिटरी में GitHub Actions स्क्रिप्ट इंजेक्शन खोजा और उसका फायदा उठाया, खामी लाइव होने के पाँच दिन बाद, बिना किसी मानव के। वास्तव में एजेंटिक क्या था, सामान्य स्वचालन क्या था, और अनुमति शृंखला लेखक वाली पंक्ति से अधिक क्यों मायने रखती है।

wizred agentsnowflakegithub actionsai securityagentic aiscript injection

एजेंट अब IAM का नया कार्यभार बन रहे हैं, और आपके सेवा खाते इसके लिए तैयार नहीं हैं

Above the Harness

AI एजेंट पहचान और पहुँच प्रबंधन को एक नई श्रेणी अपनाने पर मजबूर कर रहे हैं। सेवा खाते और API कुंजियाँ एजेंटों पर ठीक से क्यों लागू नहीं होतीं, IETF, क्लाउड विक्रेता और पहचान स्टार्टअप इसके बदले क्या बना रहे हैं, और पहचान बिगड़ने पर क्या होता है, यह दिखाने वाली घटनाएँ।

agent identityiamnon-human identityworkload identityspiffeai agentssecurity

साझा एजेंट स्मृति में पहुँच-नियंत्रण की समस्या है, और इसे अभी किसी ने हल नहीं किया

Above the Harness

Tencent की Team Memory, Asana की Agentic Work Management और मुक्त-स्रोत स्मृति परियोजनाओं की उन सवालों पर तुलना जो सच में मायने रखते हैं: स्मृति कौन पढ़ सकता है, उसके गलत होने पर क्या होता है, और किसका संस्करण मान्य होता है।

agent memoryshared memoryaccess controltencentdb agent memoryasana ai teammatesai agent governancemem0

कांग्रेस ने पूछा, AI एजेंट बेकाबू होने पर क्या होता है। इंजीनियरिंग की नज़र से जवाब यह है।

Agent Field Notes

10 अगस्त को प्रतिनिधि सभा के 51 डेमोक्रेट सदस्यों ने OpenAI और Anthropic को पत्र भेजकर उन एजेंटों पर जवाब माँगे जो परीक्षण परिवेशों से बाहर निकल गए थे। निर्माणकर्ताओं के लिए सार: पत्र वास्तव में क्या कहते हैं, कौन-से जोखिम तकनीकी रूप से बताए गए हैं, और आपके तकनीकी ढाँचे के लिए कौन-से वास्तविक हैं।

ai agentsagent safetycongressopenaianthropicagent governancecontainment

हार्नेस के भीतर: टर्न-सीमित अनुमतियाँ एजेंट रनटाइम की मूल इकाई बन रही हैं

Inside the Harness

OpenAI Codex अब अनुमतियों को मशीन या उपयोगकर्ता से नहीं, एकल एजेंट टर्न से बँधी चीज़ मानता है। टर्न-सीमित अनुमतियाँ क्या हैं, वे किस खतरा मॉडल का जवाब देती हैं, रनटाइम उन्हें कैसे लागू करते हैं, और स्नैपशॉट के नियम सेटिंग UI से अधिक क्यों मायने रखते हैं।

openai codexagent runtimepermissionssandboxingagent securityinside the harness