मुख्य सामग्री पर जाएं

DeepSeek Harness क्या है? वह एजेंट रनटाइम जहाँ हर चीज़ एक प्लगइन है

DeepSeek Harness समझाया गया: इसका Cordis-आधारित प्लगइन आर्किटेक्चर कैसे काम करता है, Standard, PTC, Minimal, और Creator मोड्स किसके लिए हैं, और यह Claude Code, Codex, तथा OpenCode से कैसे तुलना करता है।
अद्यतन 8 सित॰ 2026  · 13 मि॰ पढ़ना

AI के साथ खोजें

ChatGPTClaudePerplexity

DeepSeek Harness को सिर्फ प्रश्न का उत्तर देने के लिए नहीं, बल्कि पूरा कार्य चलाने के लिए बनाया गया है। यह एक ओपन-सोर्स एजेंट रनटाइम है जो किसी मॉडल को आपके रेपो, टर्मिनल, टूल्स, और सत्र इतिहास से जोड़ता है। इसे किसी बग को ठीक करने के लिए कहें, तो यह फाइलें देख सकता है, कोड संपादित कर सकता है, परीक्षण चला सकता है, और किसी कमांड के फेल होने पर प्रतिक्रिया दे सकता है। अकेला एक मॉडल कॉल यह सब स्वयं नहीं कर सकता।

इस वर्कफ़्लो के नीचे का हिस्सा और भी असामान्य है। DeepSeek Harness मॉडल अडैप्टर, टूल्स, सेशंस, सैंडबॉक्स, और यहां तक कि एजेंट लूप को भी Cordis द्वारा समन्वित प्लगइन्स के रूप में एक्सपोज़ करता है। मॉडल एजेंट का एक भाग है, स्वयं उत्पाद नहीं।

यह अंतिम रूप का सॉफ़्टवेयर नहीं है। Harness अभी भी डेवलपर प्रीव्यू में है; इसके API रिलीज़ों के बीच टूट सकते हैं, और इसकी अपनी सेफ़्टी नोटिस बताती है कि इसका सुरक्षा ऑडिट नहीं हुआ है। मैं आर्किटेक्चर के साथ-साथ इन सीमाओं और Claude Code, Codex, तथा OpenCode से इसके अंतर पर चर्चा करूंगा।

संक्षेप में

  • क्या है: DeepSeek Harness एक ओपन-सोर्स एजेंट रनटाइम है, मॉडल नहीं। यह मॉडल को टूल्स, सेशंस, सैंडबॉक्सिंग, और एजेंट लूप देता है।
  • मुख्य डिज़ाइन: Cordis मॉडल अडैप्टर, टूल्स, सेशन स्टोर, सैंडबॉक्स, और एजेंट लूप को बदलने योग्य प्लगइन्स के रूप में एक्सपोज़ करता है।
  • सेशंस: एक अपेंड-ओनली इवेंट लॉग रीज़्यूम, फोर्क, सर्च, रिप्ले, और Trajectory दृश्य को सपोर्ट करता है।
  • मोड्स: Standard, PTC, Minimal, और Creator यह बदलते हैं कि एजेंट कौन-से टूल्स उपयोग कर सकता है और वह उन तक कैसे पहुंचता है।
  • मुख्य अंतर: DeepSeek Harness डेवलपर्स को लोअर-रनटाइम कम्पोनेंट्स बदलने देता है जिन्हें Claude Code, Codex, और OpenCode स्थिर रखते हैं।
  • मुख्य सीमा: यह अभी डेवलपर प्रीव्यू है, सुरक्षा ऑडिट नहीं हुआ है, और इसके API रिलीज़ों के बीच बदल सकते हैं।

DeepSeek Harness क्या है?

DeepSeek Harness, संक्षेप में dsh, DeepSeek AI का MIT लाइसेंस के अंतर्गत एक ओपन-सोर्स एजेंट हार्नेस है। यह एक भाषा मॉडल और बाहरी दुनिया के बीच बैठता है, और टूल्स, सेशंस, सैंडबॉक्सिंग, और वह लूप प्रदान करता है जो कार्य को आगे बढ़ाता रहता है।

DeepSeek की अपनी परिभाषा है "Agent = Model + Harness." मॉडल तर्क-वितर्क और जेनरेशन संभालता है। हार्नेस वह सब कुछ है जो उस तर्क को वास्तविक फाइल सिस्टम पर असर डालने और बिना हर कदम पर कार्य दोबारा समझाए आगे बढ़ने देता है।

यह Cordis पर चलता है, जो DeepSeek Harness से पुराना एक प्लगइन फ्रेमवर्क है। Cordis सेटिंग्स को इन भागों को स्वतंत्र रूप से बदलने देता है। मैं बाद में इस चुनाव की लागत पर लौटूंगा।

इस फ्रेमिंग के साथ, यहां दो आम गलतफहमियां हैं।

DeepSeek Harness कोई AI मॉडल नहीं है

जैसा कि पहले कहा गया, मॉडल और रनटाइम अलग परतें हैं। यह विभाजन आपको टूल्स या सेशन सेटअप बदले बिना प्रदाताओं को बदलने देता है। वही रनटाइम DeepSeek, Anthropic, OpenAI, या OpenAI-संगत एंडपॉइंट का उपयोग कर सकता है।

DeepSeek Harness सिर्फ एक कोडिंग असिस्टेंट से अधिक है

Standard मोड कोडिंग-असिस्टेंट जैसा प्रभाव देता है, पर यह सिर्फ एक सेटअप है। जैसा कि मैं आगे कवर करूंगा, Minimal और Creator मोड यह बदलते हैं कि एजेंट क्या उपयोग कर सकता है। नया सेटअप बनाना अभी भी इंजीनियरिंग कार्य लेता है; डेवलपर्स के पास भागों तक पहुंच है।

Cordis DeepSeek Harness प्लगइन्स को कैसे संगठित करता है

जैसा कि पहले बताया गया, Cordis DeepSeek Harness के नीचे का प्लगइन फ्रेमवर्क है। यह हर भाग को किसी एक प्रदाता के कोड से बांधे बिना ज़रूरी सेवा मांगने देता है।

Cordis Koishi चैटबॉट इकोसिस्टम से आया है और Shigma नामक डेवलपर ने इसे बनाया; DeepSeek इसे वेंडर करता और बढ़ाता है। इसके लेखक अपने पेपर A Programming Paradigm for Spatiotemporal Composability में इस डिज़ाइन का वर्णन करते हैं।

ये बुनियादी बातें परियोजना के मुख्य नारे और Cordis की दो शर्तों तक ले जाती हैं। नाम अकादमिक लग सकते हैं, पर व्यवहार काफी सरल है।

"Everything is a plugin"

DeepSeek के आर्किटेक्चर दस्तावेज़ के अनुसार, आप dsh को अन्य प्लगइन्स के साथ एक प्लगइन माउंट करके बढ़ाते हैं। मॉडल अडैप्टर्स, टूल्स, सेशंस, सैंडबॉक्सेज़, स्टोरेज, शेड्यूलिंग, एजेंट लूप, और UI — ये सब प्लगइन्स हैं।

शाब्दिक रूप से लें, तो यह नारा कुछ ज़्यादा दूर तक जाता है। प्लगइन्स के नीचे अभी भी Cordis बैठता है। यह उन्हें लोड और हटाता है, उनकी ज़रूरतें जांचता है, और वे एक-दूसरे से बात करने के लिए जिन इवेंट्स का उपयोग करते हैं उन्हें चलाता है। Cordis आवश्यक है, कोई एक और वैकल्पिक हिस्सा नहीं।

स्पैशल कॉम्पोज़ेबिलिटी प्लगइन निर्भरताएँ प्रबंधित करती है

एक प्लगइन उन सेवाओं की घोषणा करता है जिनकी उसे ज़रूरत है, बिना किसी हाथ से लिखे बूट सीक्वेंस के। जब वे सेवाएँ मौजूद होती हैं तो यह सक्रिय होता है और किसी आवश्यक सेवा के गायब होने पर निष्क्रिय हो जाता है। इसकी निर्भरताएँ तय करती हैं कि यह कब चल सकता है।

DeepSeek इसे spatial composability कहता है। निर्भरताएँ Cordis को बताती हैं कि कोई घटक कहाँ फिट बैठता है, ताकि डेवलपर्स को स्टार्टअप क्रम हाथ से तय न करना पड़े।

टेम्पोरल कॉम्पोज़ेबिलिटी प्लगइन प्रभावों को वापस समेटती है

Cordis इवेंट लिस्नर्स, प्रॉम्प्ट सेक्शंस, और टूल स्कीमाज जैसी रजिस्ट्रेशन्स को भी ट्रैक करता है। किसी प्लगइन को हटाने से वे प्रभाव भी हट जाते हैं, बजाय इसके कि अनाथ लिस्नर्स छूट जाएँ। यह किसी बाहरी क्रिया, जैसे शेल कमांड, को पूर्ववत नहीं करता; रिवर्सिबिलिटी केवल उन प्रभावों पर लागू होती है जिन्हें Cordis ट्रैक करता है।

DeepSeek Harness आर्किटेक्चर: रनटाइम कैसे साथ जुड़ता है

चलता हुआ इंस्टेंस सेटिंग्स से बनी एक प्लगइन ट्री है जो एक निश्चित क्रम में लोड होती हैं। वे सेटिंग्स तय करती हैं कि कौन-से भाग सक्रिय हैं।

DeepSeek Harness आर्किटेक्चर आरेख, जिसमें उपयोगकर्ता या एप्लिकेशन एक संयोजित रनटाइम से जुड़ते दिखते हैं, और मॉडल, एजेंट लूप, टूल्स, सेशंस, स्टोरेज, तथा सैंडबॉक्स Cordis के माध्यम से लिंक हैं

Cordis हर बदलने योग्य रनटाइम प्लगइन को जोड़ता है। चित्र: लेखक।

Cordis सेवाएँ प्लगइन्स को एक-दूसरे को खोजने देती हैं

Cordis सेवाओं की एक साझा निर्देशिका देता है। प्लगइन्स ctx.tools, ctx.llm, और ctx.sessions जैसी स्थिर कुंजियों का उपयोग करते हैं, किसी एक प्रदाता का कोड इम्पोर्ट करने के बजाय। ctx.llm को कॉल करने वाले टूल को यह जानने की ज़रूरत नहीं कि उसके पीछे कौन-सा मॉडल अडैप्टर बैठा है।

एजेंट प्रीसेट्स और रनटाइम प्रोफाइल अलग परतों को नियंत्रित करते हैं

अगर सब कुछ बदलने योग्य है, तो फिर भी किसी चीज़ को तय करना होता है कि किसी रन के लिए क्या माउंट होगा, और DeepSeek Harness इसका उत्तर दो परतों पर देता है जिन्हें मिलाना आसान है।

संक्षेप में: प्रोफ़ाइल तय करती है कि प्रोग्राम कैसे शुरू होगा, जबकि प्रीसेट तय करता है कि एजेंट क्या कर सकता है। यदि आप केवल वेब ऐप का उपयोग करते हैं, तो आप अगली दो उपधाराओं को छोड़ सकते हैं।

रनटाइम प्रोफाइल्स

एक रनटाइम प्रोफ़ाइल (web, headless, sdk, sdk-minimal, और acp टेम्पलेट्स के रूप में आते हैं) यह तय करती है कि एप्लिकेशन कैसे लॉन्च होगा और बूट पर कौन-से Cordis प्लगइन बंडल स्टैक होंगे। अधिकांश पाठक इस परत को केवल dsh web या इसी तरह का कमांड चलाकर छुएंगे।

एजेंट प्रीसेट्स

एक एजेंट प्रीसेट (Standard, PTC, Minimal, या Creator) तय करता है कि सक्रिय सत्र क्या उपयोग कर सकता है। एक पैच फ़ाइल हार्नेस के सोर्स को छुए बिना प्रीसेट बदल सकती है।

एजेंट लूप टर्न्स, स्टेप्स, और टूल कॉल्स का समन्वय करता है

DeepSeek एक स्टेप को एक टर्न से अलग मानता है। एक स्टेप एक मॉडल रिक्वेस्ट और उसके टूल कॉल्स होता है। एक टर्न शून्य या अधिक स्टेप्स होता है: यह अपने पहले इनपुट के क्लेम होने से पहले खुलता है और तब बंद होता है जब कुछ भी बकाया नहीं रहता। अधिकांश टर्न्स में एजेंट के जवाब देने से पहले कई स्टेप्स चलते हैं, लेकिन अस्वीकृत इनपुट बिना कोई स्टेप खर्च किए टर्न बंद कर देता है।

एजेंट लूप फ्लो आरेख जो दिखाता है कि उपयोगकर्ता का एक टर्न एक या अधिक मॉडल स्टेप्स समाहित कर सकता है, प्रत्येक के बाद सुरक्षित टूल निष्पादन

एक टर्न में कई स्टेप्स हो सकते हैं। चित्र: लेखक।

सेशंस एक अपेंड-ओनली इवेंट लॉग का उपयोग करते हैं

यह वह हिस्सा है जिसे मैं सबसे महत्वपूर्ण मानता हूँ। एक सत्र टाइप्ड इवेंट्स का अपेंड-ओनली लॉग है, चैट संदेशों की ऐरे नहीं। हार्नेस मॉडल का इतिहास उसी लॉग से बनाता है, और सेशन दस्तावेज़ मांगता है कि मॉडल को भेजी गई कोई भी चीज़ उसी से रिकवर की जा सके।

रीज़्यूम, फोर्क, सर्च, रिप्ले, और Trajectory दृश्य सभी उसी इवेंट स्ट्रीम पर बने हैं।

इतिहास को दोबारा निकालना कोई निर्देशात्मक री-रन नहीं है। मॉडल आउटपुट और बाहरी अवस्था भिन्न हो सकती है, लेकिन लॉग फिर भी यह रिकॉर्ड देता है कि क्या हुआ था।

सत्र इवेंट टाइमलाइन, जिसमें उपयोगकर्ता संदेश, सहायक आउटपुट, टूल कॉल्स, और टूल परिणाम एक अपेंड-ओनली लॉग में जमा होते हुए दिखते हैं

सत्र इतिहास एक अपेंड-ओनली लॉग है। चित्र: लेखक।

DeepSeek Harness टूल्स और सैंडबॉक्सेज़ को कैसे नियंत्रित करता है

कोई मॉडल नाम से टूल का अनुरोध कर सकता है, लेकिन उसे सीधे चलाने का अधिकार नहीं मिलता। अनुरोध और फाइल सिस्टम बदलाव के बीच दो अलग नियंत्रण खड़े रहते हैं।

टूल निष्पादन पाइपलाइन

कॉल नीति जाँच, निष्पादन, और परिणाम हैंडलिंग से होकर गुजरती है। टूल मॉडल चुनता है; रनटाइम तय करता है कि वह कैसे और क्या चलेगा।

गार्डेड टूल निष्पादन पाइपलाइन आरेख जिसमें दिखता है कि मॉडल का टूल अनुरोध प्री-एग्ज़ीक्यूशन पॉलिसी, निष्पादन, और पोस्ट-प्रोसेसिंग से गुजरकर परिणाम के रूप में मॉडल को लौटता है

रनटाइम तय करता है कि टूल्स कैसे चलें। चित्र: लेखक।

सैंडबॉक्सिंग बनाम अनुमोदन

  • अनुमोदन यह पूछता है कि क्या उपयोगकर्ता को किसी क्रिया की पुष्टि करनी चाहिए। 
  • सैंडबॉक्सिंग यह तय करता है कि यह कहाँ और कैसे निष्पादित होगा। 

DeepSeek इन्हें अलग रखता है, हालांकि अनुमति प्रीसेट दोनों नियंत्रणों को बंडल करते हैं, जैसे कोई कंटेनर रनटाइम प्रक्रिया अनुमतियों को निष्पादन सीमाओं से अलग रखता है।

यह अभी चिह्नित करना उचित है, क्योंकि मैं सीमाओं वाले भाग में लौटूंगा: किसी मॉडल को सिस्टम प्रॉम्प्ट में "सिर्फ फाइलें पढ़ो" कहना एक सुझाव है जिसे वह मान सकता है, न कि OS-स्तरीय सैंडबॉक्स प्रतिबंध जैसा कोई लागू सीमांकन।

DeepSeek Harness मोड्स: Standard, PTC, Minimal, और Creator

DeepSeek Harness चार अलग-अलग मोड देता है। इन चारों में से कोई भी दूसरे से ऊँचा नहीं है। ये चार उत्तर हैं इस प्रश्न के: "इस सत्र के लिए रनटाइम का कितना हिस्सा उजागर होना चाहिए," और सही विकल्प काम पर निर्भर करता है। जैसा कि आर्किटेक्चर अनुभाग ने दिखाया, हर मोड एजेंट को उपलब्ध टूल्स के सेट को बदलता है।

चारों DeepSeek Harness मोड्स का तुलनात्मक चार्ट, जिसमें Standard, PTC, Minimal, और Creator मोड के टूल सरफेस और उद्देश्य साथ-साथ दिखाए गए हैं

चार मोड एक ही रनटाइम बेस साझा करते हैं। चित्र: लेखक।

Standard मोड

सामान्य-उद्देश्य बेसलाइन: 

  • फाइल संपादन
  • शेल एक्सेस
  • फाइल और वेब सर्च
  • स्किल्स
  • प्लानिंग
  • गोल्स
  • सबएजेंट्स
  • वर्कफ़्लोज़

सामान्य रेपो कार्य के लिए, मैं यहीं से शुरू करूंगा।

PTC मोड

PTC मोड लगभग Standard के पूरे टूलसेट को रखता है, लेकिन मॉडल वहाँ तक कैसे पहुँचता है यह बदलता है। (संस्करण 0.1.2 से, वेब PTC मोड अब डिफ़ॉल्ट रूप से सामान्य-उद्देश्य workflow टूल को एक्सपोज़ नहीं करता।) 

कई मॉडल स्टेप्स में व्यक्तिगत टूल्स का अनुरोध करने के बजाय, मॉडल एक जेनरेटेड SDK के खिलाफ एक प्रोग्राम लिखता है। वह प्रोग्राम run_code के माध्यम से कई टूल्स को कॉल कर सकता है। हर कॉल फिर भी वही पॉलिसी जाँचों से गुजरती है, इसलिए PTC यह बदलता है कि मॉडल योजना कैसे बताता है, न कि वह क्या करने की अनुमति है।

प्रोडक्ट पेज अभी भी "Code mode" लेबल का उपयोग करता है, लेकिन नए आधिकारिक रिलीज़ ने इसे PTC मोड नाम दिया है, जबकि पुराने वार्तालाप रिकॉर्ड पठनीय रखे हैं। मैं पूरे लेख में PTC मोड ही उपयोग करूंगा; FAQ इन आद्याक्षरों का क्या अर्थ हो सकता है, इस पर लौटता है।

Minimal मोड

Minimal मोड वातावरण को दो टूल्स तक समेट देता है: एक स्थायी शेल और स्ट्रिंग-रिप्लेस फाइल एडिटर। DeepSeek इसे मॉडल बेंचमार्क्स के लिए उपयोग करता है, क्योंकि परीक्षण परिणाम आंशिक रूप से मॉडल के हार्नेस पर निर्भर करते हैं, केवल उसके वेट्स पर नहीं।

Creator मोड

Creator मोड डेवलपर्स को रनटाइम का निरीक्षण करने और मेमोरी में Cordis प्लगइन्स का परीक्षण करने देता है। यह प्रीसेट्स बनाने के लिए है, और मैं इसे किसी गहरे अर्थ में स्व-सुधारक नहीं कहूंगा।

DeepSeek Harness अन्य एजेंट फ्रेमवर्क्स से कैसे अलग है?

DeepSeek Harness कई एजेंट फ्रेमवर्क्स से इस तरह अलग है कि यह रनटाइम के निचले हिस्सों को बदलने योग्य बनाता है। मैं इसे लगभग आर्किटेक्चर अनुभाग में ही रख देता, पर यह भेद नज़रअंदाज़ करना आसान है। Cordis उन बदलावों को एक ही प्लगइन सिस्टम से संभालता है।

आप यह बदल सकते हैं कि एजेंट कैसे संचालित होता है, सिर्फ यह नहीं कि वह कौन-से टूल्स कॉल कर सकता है। इवेंट लॉग एक ऐसा रन भी देता है जिसे डेवलपर्स जांच सकें, न कि सिर्फ चैट ट्रांस्क्रिप्ट की तरह पढ़ें। Minimal और Creator मोड फिर उन्हें रनटाइम को विपरीत दिशाओं से टेस्ट करने देते हैं।

DeepSeek Harness बनाम Claude Code, Codex, और OpenCode

फ़ीचर चेकलिस्ट मुद्दे से भटका देगी। हर प्रतियोगी एक्सटेंशंस सपोर्ट करता है; उपयोगी प्रश्न है कि डेवलपर्स कौन-से हिस्से बदल सकते हैं। यह भेद छोटा लगता है, पर है नहीं। हमारा समर्पित Harness बनाम Claude Code तुलना दोनों में एक ही मॉडल उपयोग करती है और सेटअप, लॉग्स, और लागत कवर करती है।

DeepSeek Harness बनाम Claude Code

Claude Code प्रोजेक्ट निर्देश, स्किल्स, हुक्स, MCP, सबएजेंट्स, और एक Agent SDK सपोर्ट करता है, और अपना बिल्ट-इन लूप स्थिर रखता है। DeepSeek Harness डेवलपर्स को सेटिंग्स के माध्यम से लूप, मॉडल अडैप्टर, और स्टोरेज लेयर बदलने देता है।

DeepSeek Harness बनाम Codex

Codex की तुलना अधिक सावधानी से चाहिए क्योंकि इसका CLI और App Server भी ओपन सोर्स है। यह एक एजेंट हार्नेस देता है जिसे डेवलपर्स डॉक्यूमेंटेड एंट्री पॉइंट्स के माध्यम से बढ़ाते हैं। DeepSeek Harness खुद रनटाइम को बदलने के इर्द-गिर्द बना है। ये नियंत्रण के अलग स्तर देते हैं।

DeepSeek Harness बनाम OpenCode

OpenCode पहले से ओपन सोर्स है, कई मॉडल प्रदाताओं के साथ काम करता है, और क्लाइंट-सर्वर आर्किटेक्चर उपयोग करता है। आप इसके टूल्स, अनुमतियाँ, सेशिंस, और प्रदाताओं को कॉन्फ़िगर कर सकते हैं। इसके प्लगइन्स एक स्थिर सर्वर कोर को बढ़ाते हैं, जबकि DeepSeek लूप और सेशन स्टोर को भी बदलने योग्य बनाता है।

DeepSeek Harness कब उपयोग करें

रनटाइम भागों को बदलना अपने आप में उपयोगी नहीं है। अतिरिक्त नियंत्रण तभी मायने रखता है जब वह किसी मौजूदा समस्या का हल करे।

  • जब रनटाइम स्वयं परियोजना का हिस्सा हो। यदि आप केवल किसी एजेंट के ऊपर नहीं, बल्कि मॉडल अडैप्टर्स, एजेंट लूप, स्टोरेज, या सेशन व्यवहार में बदलाव कर रहे हैं, तो यह ज़्यादा सीधा फिट है।
  • जब आप नियंत्रित वातावरण में मॉडलों की तुलना कर रहे हों। एक ही रनटाइम का उपयोग करने से मॉडल बदलते समय परीक्षण का अधिक हिस्सा स्थिर रहता है, हालांकि मॉडल्स टूल उपयोग और तर्क शैली में अलग हो सकते हैं।
  • जब जटिल रन को डिबग करना मायने रखता हो। सेशन इवेंट लॉग और Trajectory दृश्य यह पुनर्निर्मित करना आसान बनाते हैं कि मॉडल ने क्या देखा और कौन-से टूल चले।
  • जब आप एजेंट के आंतरिक हिस्सों का परीक्षण कर रहे हों। Creator मोड और Cordis उन डेवलपर्स के लिए हैं जो यह अध्ययन कर रहे हैं कि एजेंट्स कैसे जोड़े जाते हैं, न कि केवल उन्हें एप्लिकेशन कोड चाहिए।

यह साधारण मॉडल कॉल्स के लिए या उन टीमों के लिए अनावश्यक हो सकता है जो बिना आंतरिक हिस्सों को छुए एक रेडीमेड कोडिंग एजेंट चाहती हैं। ज़्यादा भाग बदलना तभी सार्थक है जब वह नियंत्रण किसी वास्तविक समस्या का समाधान करे।

DeepSeek Harness की सीमाएँ: डेवलपर प्रीव्यू स्थिति और सुरक्षा जोखिम

ऊपर का कोई भी आर्किटेक्चर तब तक बहुत मायने नहीं रखता जब तक आज की कमियाँ साफ़-साफ़ न बताई जाएँ।

यह अभी भी डेवलपर प्रीव्यू है

DeepSeek के रिपॉज़िटरी में साफ़ लिखा है कि ब्रेकिंग चेंजेस आएँगे। यह पहले ही हो चुका है: Code से PTC नाम बदलने के साथ सेशन API में बदलाव और एक वैकल्पिक SQLite स्टोरेज विकल्प हटाया गया। अपने संस्करण पिन करें। उस कदम को छोड़कर सेटअप के स्थिर रहने की आशा करना कोई योजना नहीं है।

ज़्यादा नियंत्रण का अर्थ ज़्यादा जटिलता भी है

रनटाइम का अधिक हिस्सा बदलने योग्य बनाना डेवलपर्स के लिए सीखने को भी बढ़ाता है: प्लगइन निर्भरताएँ, सेटिंग्स, प्रदाता भेद, और संस्करण अनुकूलता। यह सुविधा और नियंत्रण के बीच की सामान्य अदला-बदली है।

क्या DeepSeek Harness स्थानीय है?

DeepSeek Harness डिफ़ॉल्ट रूप से सत्र सामग्री, टूल रिकॉर्ड्स, और सेटिंग्स को स्थानीय रूप से संग्रहित करता है, इसके डेटा प्रोसेसिंग वक्तव्य के अनुसार। आप इसकी अनाम रिपोर्ट्स, जो सेटिंग्स और प्रोजेक्ट सूचियों के बारे में हैं, बंद कर सकते हैं। 

लेकिन कोई बाहरी मॉडल प्रदाता, वेब टूल, MCP सर्वर, या प्लगइन अपनी नीति के अंतर्गत अभी भी आपके मशीन से बाहर डेटा भेज सकता है। "लोकल-फर्स्ट" उन सभी सेवाओं को कवर नहीं करता जिनसे आप कनेक्ट होते हैं।

एजेंट्स चलाने में सुरक्षा जोखिम होते हैं

ऐसा रनटाइम जो फाइलें संपादित कर सकता है, कमांड्स चला सकता है, और थर्ड-पार्टी प्लगइन्स लोड कर सकता है, वास्तविक नुकसान पहुँचा सकता है। DeepSeek की सेफ़्टी नोटिस कहती है कि परियोजना का सुरक्षा ऑडिट नहीं हुआ है। सैंडबॉक्सिंग, अनुमोदन, और अनुमति नियंत्रण जोखिम कम करते हैं, लेकिन अलगाव की गारंटी नहीं देते।

अपने मशीन पर सॉफ़्टवेयर चलाने से वह जोखिम खत्म नहीं होता। अविश्वसनीय कार्य के लिए सीमित अनुमतियाँ और डिस्पोज़ेबल वातावरण उपयोग करें, और उस सामग्री से सावधान रहें जिसमें छिपे हुए निर्देश हो सकते हैं।

क्यों एजेंट का व्यवहार सिर्फ मॉडल पर निर्भर नहीं करता

एजेंट का व्यवहार मॉडल के साथ-साथ रनटाइम पर भी निर्भर करता है। यह "Agent = Model + Harness" पर वापस आता है, और वही विभाजन DeepSeek से परे LLM एजेंट्स पर भी लागू होता है।

मॉडल क्या जेनरेट कर सकता है, यह उसके वेट्स पर निर्भर है। एजेंट क्या करता है, यह इस पर भी निर्भर है कि मॉडल तक कौन-सा कॉन्टेक्स्ट पहुँचता है, उसे कौन-सी क्रियाएँ करने दी गई हैं, और निष्पादन कितना सख्ती से सीमित है। इनमें से कोई भी चीज़ वेट्स के भीतर नहीं रहती।

DeepSeek Harness उस आस-पास की परत को नामित भागों में बाँटकर दिखाता है जिन्हें डेवलपर्स बदल सकते हैं। Minimal मोड दिखाता है कि यह DeepSeek से परे क्यों मायने रखता है: कोई बेंचमार्क स्कोर आंशिक रूप से उस हार्नेस को दर्शाता है जिसका परीक्षण के लिए उपयोग हुआ, केवल मॉडल को नहीं। हार्नेस मॉडल को स्मार्ट नहीं बनाता। यह वह सेटिंग बदलता है जिसमें मॉडल काम करता है।

निष्कर्ष

आरंभ की पंक्ति ही याद रखने योग्य है: मॉडल तर्क करता है, पर रनटाइम तय करता है कि वह तर्क क्या छू और क्या कर सकता है। DeepSeek Harness उस रनटाइम को संपादन योग्य बनाता है — मॉडल अडैप्टर और टूल्स से लेकर सेशन स्टोर और एजेंट लूप तक।

वही नियंत्रण लागत भी लाता है। रनटाइम के अधिक हिस्से बदलना उसके सेटअप, संस्करण बदलाव, और सुरक्षा सीमाओं को अधिक अपने ऊपर लेना है। शेल एक्सेस वाले डेवलपर प्रीव्यू को इंस्टॉल कर भूल जाना उचित नहीं।

मेरा दृष्टिकोण सरल है: DeepSeek Harness तब उपयोग करें जब रनटाइम स्वयं कार्य का हिस्सा हो। यदि आपको केवल रेपो में संपादन चाहिए, तो एक तैयार कोडिंग एजेंट आपसे कम माँगता है।

हमारा DeepSeek Harness ट्यूटोरियल सेटअप कवर करता है। Claude Code विकल्प गाइड और अधिक कोडिंग एजेंट्स की तुलना करता है, जबकि Introduction to AI Agents वे मूल बातें कवर करता है जिन्हें यह लेख मान कर चलता है।

DeepSeek Harness FAQs

क्या DeepSeek Harness, DeepSeek मॉडल के बराबर है?

नहीं, मॉडल और रनटाइम अलग हैं। Harness में मॉडल वेट्स शामिल नहीं हैं और न ही यह स्वयं इन्फरेंस चलाता है; यह DeepSeek, Anthropic, OpenAI, या किसी स्थानीय मॉडल को अनुरोध भेजता है।

क्या DeepSeek Harness का उपयोग निःशुल्क है?

सॉफ़्टवेयर स्वयं MIT-लाइसेंस्ड और निःशुल्क है। जो निःशुल्क नहीं है, वह है जो भी मॉडल प्रदाता आप कनेक्ट करते हैं, क्योंकि इन्फरेंस का बिल अलग से उस मॉडल को चलाने वाला प्रदाता करता है, साथ ही सैंडबॉक्सेज़ या ऊपर जोड़ी गई बाहरी सेवाओं से आने वाली किसी भी इन्फ्रास्ट्रक्चर लागत के अलावा।

PTC मोड वास्तव में किसका संक्षेप है?

DeepSeek के अपने रिलीज़ नोट्स "PTC mode" का उपयोग करते हैं, बिना कोई निश्चित विस्तार बताए, हालांकि इसका व्यवहार "programmatic tool calling" से मेल खाता है। जब तक DeepSeek स्वयं स्पष्ट न कहे, मैं इसे पक्का संक्षेपाक्षर नहीं, बल्कि एक कार्यशील परिभाषा मानूँगा।

क्या मैं DeepSeek Harness पर किसी महत्वपूर्ण रेपो के साथ भरोसा कर सकता/सकती हूँ?

कुछ सीमाएँ फिर भी लागू रहती हैं। जिस रेपो की आपको परवाह है, उसके लिए किसी कॉपी या अलग ब्रांच पर काम करें, प्रोडक्शन क्रेडेंशियल्स वातावरण से बाहर रखें, और कोई भी प्लगइन लोड करने से पहले उसकी समीक्षा करें।

क्या "everything is a plugin" का अर्थ है कि मैं इसे अपनी मनचाही किसी भी प्रकार के एजेंट में बदल सकता/सकती हूँ?

बिना वास्तविक इंजीनियरिंग कार्य के नहीं। मॉडल अडैप्टर या एजेंट लूप को बदलने के लिए अभी भी सही सर्विस कॉन्ट्रैक्ट का पालन करने वाला प्लगइन चाहिए। प्लगइन सिस्टम आपको अधिक भागों तक पहुंच देता है; यह काम गायब नहीं कर देता।

विषय
एआई एजेंट्स
कृत्रिम बुद्धिमत्ता

DataCamp के साथ Agentic AI सीखें!

Track

एआई एजेंट मूलभूत बातें

6 घंटा
जानें कि AI एजेंट आपके काम करने के तरीके और आपके संगठन के लिए मूल्य प्रदान करने के तरीके को कैसे बदल सकते हैं!
विस्तृत जानकारी देखेंRight Arrow
कोर्स शुरू करें
और देखेंRight Arrow