मुख्य सामग्री पर जाएं

Claude Sonnet 5.5: फीचर्स, बेंचमार्क्स, प्राइसिंग, और अधिक

Anthropic का नया मिड-टियर मॉडल टर्मिनल कोडिंग पर Opus 5.5 से आगे निकलता है, बाकी जगहों पर कुछ अंकों के भीतर रहता है, और Sonnet 5 की $2/$10 प्राइसिंग बनाए रखता है।
अद्यतन 28 सित॰ 2026  · 12 मि॰ पढ़ना

AI के साथ खोजें

ChatGPTClaudePerplexity

Anthropic द्वारा Claude Opus 5.5 को लाइनअप के शीर्ष पर लाने के छह दिन बाद, मिड-टियर मॉडल ने आधी कीमत पर अधिकांश अंतर बंद कर दिया है। Claude Sonnet 5.5 एक बेंचमार्क पर Opus 5.5 को मात देता है और बाकी में उससे केवल कुछ अंकों से पीछे है, और यह सब Sonnet 5 की प्राइसिंग बरकरार रखते हुए।

हमने यह पैटर्न पहले भी देखा है। Claude Sonnet 5 लॉन्च हुआ, जो Opus 4.8 के एजेंटिक बेंचमार्क्स के करीब था और लागत का एक अंश मांगता था। उससे पहले, Sonnet 4.6 भी Opus 4.6 के काफी करीब आया था। हर बार, फ्लैगशिप के कुछ दिन या हफ्ते बाद एक मिड-टियर मॉडल आता है और आधी कीमत पर अधिकांश गैप बंद कर देता है।

बाहर से देखने पर यही एक लघुगणकीय स्केलिंग कर्व जैसा दिखता है। परफॉर्मेंस मोटे तौर पर कंप्यूट के लॉग के साथ बढ़ती है, इसलिए लागत परफॉर्मेंस के साथ लगभग एक्सपोनेंशियली बढ़ती है। एक फ्लैगशिप मॉडल उस कर्व के शीर्ष पर बैठता है, जहां वह अंतिम कुछ अंकों के लिए भारी खर्च कर रहा होता है। कुछ हफ्तों बाद बना सस्ता मॉडल, उन्हीं मूलभूत प्रगतियों से लाभ उठाते हुए, कर्व पर एक निचले बिंदु तक ही पहुंचना चाहता है ताकि लगभग उतना ही अच्छा दिखे। यानी, कर्व का अधिकांश “वैल्यू” अभी भी सस्ते में मिल जाता है और केवल अंतिम खिंचाव महंगा है।

मुझे लगता है इसे अलग करके देखना जरूरी है क्योंकि अग्रणी कंपनियां PR और ब्रांडिंग के साथ थोड़ा जादू दिखाती हैं।

TL;DR

  • Sonnet 5.5 Anthropic का नया मिड-टियर मॉडल है, जो उसी कीमत पर Sonnet 5 की जगह लेता है।
  • सबसे बड़ी बढ़त एजेंटिक टर्मिनल कोडिंग में है, जहां यह अब वास्तव में Opus 5.5 से थोड़ा आगे निकलता है।
  • नॉलेज वर्क और कंप्यूटर उपयोग पर, यह आधी प्रति-टोकन कीमत पर Opus 5.5 से बस थोड़ा पीछे बैठता है।
  • इसे अपना डिफॉल्ट Claude मॉडल बनाएं और खुली-अवधि, निर्णय-प्रधान काम के लिए Opus 5.5 रखें।

Claude Sonnet 5.5 क्या है?

Anthropic के मॉडल दस्तावेज़ के अनुसार, Claude Sonnet 5.5 वर्तमान लाइनअप में “स्पीड और इंटेलिजेंस का सर्वश्रेष्ठ संयोजन” है। यह Anthropic के Claude 5.5 परिवार का मिड-टियर मॉडल है, जो फ्लैगशिप Claude Opus 5.5 और आने वाले Claude Haiku 5.5 के बीच बैठता है। (हम Haiku 5.5 पर आपको अपडेट देते रहेंगे, हालांकि Haiku 5 कभी आया नहीं।)

Sonnet 5 की तुलना में, छलांग आधा-वर्ज़न नंबर से कही ज्यादा बड़ी है। यह चौंकाने वाला नहीं है, क्योंकि हमने देखा था कि Opus 5.5 और Opus 5 के बीच की छलांग भी उम्मीद से बड़ी थी।

लॉन्च पोस्ट की बात करें—Anthropic ने हर प्रकाशित बेंचमार्क पर बढ़त की रिपोर्ट की है, जिसमें सबसे बड़ी छलांग टर्मिनल कोडिंग, चार्ट रीडिंग, और नॉलेज-वर्क इवैल्यूएशंस में है।

दिलचस्प बात यह है कि Anthropic का कहना है कि यह Sonnet मॉडल स्क्रीनशॉट्स से ही काम करते हुए Pokémon Red को हराने वाला पहला है। यह असामान्य लगता है लेकिन यह एक टेस्ट है जिसे Anthropic लंबी-अवधि के काम और इमेज समझ के लिए प्रॉक्सी के रूप में इस्तेमाल करता है।

तो, कंपनी के शब्दों में, Opus 5.5 अब भी जटिल, खुले-छोर वाले काम में स्पष्ट रूप से मजबूत है, जहां निरंतर निर्णय की जरूरत होती है। लेकिन Sonnet 5.5 उन कार्यों का मॉडल है जिनमें आपको पता होता है कि “डन” कैसा दिखता है—यह एक अच्छा ह्यूरिस्टिक है।

Claude Sonnet 5.5 के मुख्य फीचर्स

Sonnet 5.5 में ज़्यादातर नई चीजें वही काम तेज़ी से और कम टोकन्स में करने पर केंद्रित हैं, साथ ही कुछ बदलाव जिनके लिए API उपयोगकर्ताओं को योजना बनानी होगी। 

रोज़मर्रा के काम में Sonnet की स्पीड पर near-Opus नतीजे पाएं

आप Sonnet 5.5 को वह काम दे सकते हैं जो पहले Opus चाहता था, और वह काम आपको जल्दी वापस मिलेगा। Anthropic कहता है कि आउटपुट जेनरेशन Sonnet 5 की तुलना में 30% से अधिक तेज़ है, और मॉडल प्रति टास्क कम टोकन्स उपयोग करता है—“प्रति टास्क 30% तक कम”—यही आंकड़ा वे उपयोग करते हैं। 

लॉन्च पोस्ट में उद्धृत शुरुआती टेस्टर्स अपने आंकड़ों से इसे पुष्ट करते हैं:

  • Base44 के अनुसार Sonnet 5.5 के साथ प्रति ऐप बिल्ड 3.6 इटरशन हुए, जबकि Opus 5 के साथ 7.7।
  • Box ने अपने वर्कलोड्स को 2.4x तेज़ चलते देखा, कुल टोकन्स 12% कम हुए।
  • Zendesk ने टिकट प्रोसेसिंग 20% तेज़ मापी।
  • Slack ने लगभग 14% कम आउटपुट टोकन्स रिपोर्ट किए।

ये वेंडर-चुने हुए कस्टमर कोट्स हैं। फिर भी, इसमें एक पैटर्न है—कम इटरशन और कम टोकन्स—जो आपके बिल के लिए मायने रखता है, प्रति-टोकन दर के साथ-साथ।

टर्मिनल और डेस्कटॉप पर कोडिंग एजेंट्स चलाएं

Sonnet 5.5 एजेंट की तरह काम करने के लिए बना है: शेल कमांड चलाना, पूरे रिपो में बग फिक्स करना, और स्क्रीनशॉट्स के जरिए डेस्कटॉप ऑपरेट करना। यह लॉन्च के समय से ही Claude Code में लाइव है, और Anthropic इसका कंप्यूटर उपयोग Opus 5.5 के काफी करीब बताता है।

अधिकांश लोगों के लिए व्यावहारिक नतीजा यह है कि Sonnet 5.5 अब Claude Code सेशन्स के लिए और हमारे Claude API गाइड से बनाए गए आपके अपने एजेंट लूप्स के लिए एक भरोसेमंद डिफॉल्ट है। 

पॉलिश्ड डॉक्यूमेंट्स, स्लाइड्स, और इंटरफेस बनाएं

Anthropic ने “डिज़ाइन के लिए तेज़ नजर” को Sonnet 5.5 की ताकत के रूप में चिन्हित किया है। प्रैक्टिस में, इसका मतलब होना चाहिए कि जब आप फ्रंट-एंड कोड रिफाइन करने को कहें तो बेहतर दिखते UI, और जब आप स्लाइड्स, स्प्रेडशीट्स, या लंबे डॉक्यूमेंट्स मांगे तो अधिक फिनिश्ड आउटपुट। 

डिज़ाइन का दावा सबसे ज्यादा स्वतंत्र जाँच मांगता है। इसे बेंचमार्क करना सबसे मुश्किल है, और लॉन्च पोस्ट इसे केवल ग्राहक उद्धरणों से सपोर्ट करता है।

सुरक्षा और बायोलॉजी कार्यों पर सेफगार्ड्स की उम्मीद रखें

Sonnet 5.5 Opus 5.5 जैसे साइबरसिक्योरिटी सेफगार्ड्स के साथ लॉन्च होने वाला पहला Sonnet मॉडल है। जब कोई रिक्वेस्ट उच्च-जोखिम सुरक्षा कार्य के रूप में वर्गीकृत होती है, तो रिक्वेस्ट Sonnet 5 पर फॉल-बैक हो जाती है। बायोलॉजी सेफगार्ड्स Sonnet 5 जैसे ही हैं, और Anthropic कहता है कि अधिकांश सॉफ्टवेयर डेवलपमेंट और लाइफ साइंसेज कार्य अप्रभावित रहेंगे।

यह ऐसा पहला Sonnet भी है जो रीज़निंग एक्स्ट्रैक्शन ब्लॉक करने वाले क्लासिफायर के साथ आता है, और थिंकिंग ब्लॉक्स अब उस अकाउंट और बातचीत से बंधे हैं जिसने उन्हें उत्पन्न किया। यदि आप सिक्योरिटी टूलिंग चलाते हैं, तो पाइपलाइन बदलने से पहले अपने प्रॉम्प्ट्स का परीक्षण करें।

कुछ कोड बदलावों के साथ Sonnet 5 से माइग्रेट करें

सिर्फ मॉडल ID बदलना पर्याप्त नहीं है। Anthropic के दस्तावेज़ में Sonnet 5 पर पहले से चल रहे कोड के लिए पांच ब्रेकिंग चेंजेस सूचीबद्ध हैं:

  • एडेप्टिव थिंकिंग डिफॉल्ट रूप से ऑन है, और सबसे निम्न सेटिंग between_tools है, जो upfront थिंकिंग बंद करती है।

  • फोर्स्ड टूल यूज़ एक एरर लौटाता है।

  • थिंकिंग ब्लॉक्स उस मॉडल और बातचीत से बंधे हैं जिन्होंने उन्हें उत्पन्न किया।

  • पुराना computer_20251124 कंप्यूटर यूज़ टूल Claude API और Google Cloud पर रिजेक्ट हो जाता है।

  • एडवाइजर टूल अब Opus 4.8, Opus 4.7, या Sonnet 5 को एडवाइजर के रूप में स्वीकार नहीं करता।

एक शांत बदलाव भी है: अब टूल कॉल्स के बीच का टेक्स्ट thinking ब्लॉक्स में आता है। कोई ऐप जो यूज़र्स को टेक्स्ट स्ट्रीम करता है, तब तक चुप रहेगा जब तक आप उसके display सेटिंग को अपडेट नहीं करते। temperature, top_p, या top_k को नॉन-डिफॉल्ट वैल्यू पर सेट करना भी 400 एरर देता है। ये वे खास चीजें हैं जो आपको पता चल सकती हैं।

बेंचमार्क्स पर Claude Sonnet 5.5 का प्रदर्शन कैसा है?

Anthropic द्वारा प्रकाशित हर बेंचमार्क पर Claude Sonnet 5.5 ने Sonnet 5 को पीछे छोड़ा, टर्मिनल कोडिंग पर Opus 5.5 को मात दी, और बाकी जगहों पर उससे कुछ अंकों से पीछे रहा। OpenAI के GPT-6 Sol के मुकाबले, यह नॉलेज-वर्क और चार्ट-रीडिंग इवैल्यूएशंस पर आगे है लेकिन FrontierCode पर पीछे। नीचे दिए सभी आंकड़े Anthropic के लॉन्च पोस्ट से हैं।

Benchmark Sonnet 5.5 Sonnet 5 Opus 5.5 GPT-6 Sol
Terminal-Bench 4.0 70.6% 10.3% 66.4% Not reported
CursorBench 4.0 55.5% 34.1% 57.8% Not reported
FrontierCode 1.1 (Main) 46.2% (max effort) 42.4% 54.4% 49.3% (52.1% at xhigh)
GDPval-AA v2.1 (Elo) 1844 1449 1846 1487
AA-Briefcase v1.1 (Elo) 1811 1359 1822 1483
Humanity's Last Exam (with tools) 64.5% 54.9% 67.7% Not reported
OSWorld 2.1 80.1% 57.0% 81.8% Not reported
Chartography (no tools) 61.6% 15.6% 64.4% 53.6%

तालिका एक सरल कहानी बताती है: Sonnet 5 पर एक बड़ी जनरेशन-स्तरीय छलांग, और Opus 5.5 के साथ लगभग टाई। आइए देखें कि आपके काम के लिए हर क्षेत्र का क्या मतलब है।

एजेंटिक कोडिंग

Terminal-Bench 4.0 वह जगह है जहां Sonnet 5.5 खुद को अलग करता है। यह 70.6% स्कोर करता है, जो Sonnet 5 के 10.3% से ऊपर और Opus 5.5 के 66.4% से आगे है। यह बेंचमार्क मापता है कि क्या कोई मॉडल कमांड-लाइन वातावरण में वास्तविक कार्य पूरे कर सकता है, जैसे मल्टी-स्टेप शेल वर्कफ्लोज़—यानी यह Claude Code के उपयोग से काफ़ी मेल खाता है।

एक ही रिलीज़ में 60-पॉइंट की छलांग असामान्य ही है। बाकी कोडिंग तस्वीर कम नाटकीय है।

नॉलेज वर्क

GDPval-AA v2.1 पर, जो वास्तविक व्यवसायों से आर्थिक रूप से मूल्यवान कार्यों पर मॉडल आउटपुट को Elo-शैली के स्कोर से रेट करता है, Sonnet 5.5 1844 स्कोर करता है। यह Opus 5.5 से 2 अंक पीछे है और Sonnet 5 से लगभग 400 आगे। 

रिपोर्ट्स, विश्लेषण, और व्यवसायिक दस्तावेज़ों के लिए Claude का उपयोग करने वाली टीमों के लिए, यह तालिका में सबसे उपयोगी परिणाम है। इस तरह के काम पर, Opus 5.5 की अतिरिक्त लागत बहुत थोड़ा ही खरीदती है।

रीज़निंग और विज़ुअल अंडरस्टैंडिंग

Chartography, जो बिना टूल्स के चार्ट्स को पढ़ने और उन पर तर्क करने का परीक्षण है, सबसे बड़ा सापेक्ष लाभ दिखाता है: Sonnet 5.5 61.6% स्कोर करता है जबकि Sonnet 5 15.6% पर था। यह Anthropic के बेहतर इमेज अंडरस्टैंडिंग के दावों से मेल खाता है। 

कंप्यूटर उपयोग

OSWorld 2.1 पर, जो मापता है कि क्या कोई मॉडल वास्तविक डेस्कटॉप ऑपरेटिंग सिस्टम चलाकर कार्य पूरे कर सकता है, Sonnet 5.5 80.1% तक पहुंचता है—Sonnet 5 के 57.0% से ऊपर और Opus 5.5 से सिर्फ 2 अंकों के भीतर। 

आपको कौन-सा टियर इस्तेमाल करना चाहिए?

अधिकांश डेवलपर्स के लिए, Sonnet 5.5 अब डिफॉल्ट Claude मॉडल होना चाहिए। Opus 5.5 अपनी ऊंची कीमत तभी कमाता है जब काम इतना खुला-छोर वाला हो कि बाधा स्पीड नहीं बल्कि निर्णय हो।

Anthropic की मॉडल तुलना तालिका के अनुसार मौजूदा लाइनअप इस प्रकार है। Haiku 4.5 को छोड़कर बाकी चारों मॉडल 1M-टोकन कॉन्टेक्स्ट विंडो और 128K अधिकतम आउटपुट साझा करते हैं।

Model Price (input / output per 1M tokens) Latency Best for
Claude Fable 5.1 $10 / $50 Slower टॉप-एंड काम जहाँ क्षमता लागत से अधिक मायने रखती है
Claude Opus 5.5 $4 / $20 Moderate जटिल, खुले-छोर वाले काम जिन्हें निरंतर निर्णय चाहिए
Claude Sonnet 5.5 $2 / $10 Fast अच्छी तरह-परिभाषित कोडिंग, एजेंट्स, और डॉक्यूमेंट कार्य
Claude Haiku 4.5 $1 / $5 Fastest बड़े पैमाने, लागत-संवेदनशील कार्य

Sonnet 5.5 के भीतर, “effort” सेटिंग दूसरा लीवर है। Anthropic ने पांच स्तरों को फिर से कैलिब्रेट किया है: low, medium, high, xhigh, और max। निचली सेटिंग्स स्पीड और लागत को तरजीह देती हैं, जबकि ऊंची सेटिंग्स मॉडल को ज्यादा देर तर्क करने और अपना काम जांचने देती हैं। डिफॉल्ट Claude ऐप्स और Claude Code में medium है, और API पर high।

लॉन्च पोस्ट का एक विवरण मेरे उपयोग को बदलता है: लो या मीडियम effort पर, Sonnet 5.5 कई बेंचमार्क्स पर Sonnet 5 के सर्वश्रेष्ठ स्कोर को प्रति टास्क लगभग दसवें हिस्से की लागत में पछाड़ देता है। संक्षेप में:

  • बग फिक्स, रिफैक्टर्स, और Claude Code सेशन्स: डिफॉल्ट effort पर Sonnet 5.5।

  • हाई-थ्रूपुट एजेंट लूप्स और पाइपलाइन्स: low या medium पर Sonnet 5.5, फिर केवल असफलताओं पर effort बढ़ाएं।

  • साफ स्पेक वाले कठिन कोडिंग प्रॉब्लम्स: Opus का खर्चा करने से पहले xhigh या max पर Sonnet 5.5।

  • अस्पष्ट, कई-दिनों के प्रोजेक्ट्स: Opus 5.5।

Claude Sonnet 5.5 का परीक्षण: हैंड्स-ऑन उदाहरण

उपरोक्त बेंचमार्क Anthropic के अपने हैं, इसलिए मैंने एक बिल्ड टास्क Claude Sonnet 5.5 और Claude Sonnet 5 पर एक समान प्रॉम्प्ट और एक समान टूलिंग के साथ चलाया।

टास्क: FiveThirtyEight के recent college grads डेटासेट (173 U.S. मेजर्स, CC BY 4.0) को एक सिंगल-फाइल HTML डैशबोर्ड में बदलना, जो किसी भविष्य के छात्र को अर्निंग्स और एम्प्लॉयमेंट पर केटेगरीज़ की तुलना करने और सबसे अधिक तथा सबसे कम कमाने वाले मेजर्स खोजने में मदद करे। 

वास्तविक टेस्ट डेटा में है, जिसमें कुछ विशेषताएं हैं जिनका प्रॉम्प्ट कभी ज़िक्र नहीं करता:

  • टॉप अर्नर, Petroleum Engineering, में केवल 36 सर्वे उत्तरदाता हैं, और 173 में से 76 मेजर्स में 100 से कम हैं
  • अर्निंग्स स्क्योड हैं, इसलिए एक अकेला मीडियन बार बहुत कुछ छुपा देता है
  • एक मेजर, Food Science, में हेडकाउंट फील्ड्स खाली हैं
  • जॉब-टाइप कॉलम्स नियोजित लोगों की संख्या के बराबर नहीं जोड़ते

इन मुद्दों को नोटिस करना ही टेस्ट का मकसद है। टेस्ट Anthropic के “डिज़ाइन के लिए तेज़ नजर” वाले दावे की पड़ताल करता है।

मुख्य निष्कर्ष:

  • सिर्फ Sonnet 5.5 ने काम करता हुआ डैशबोर्ड डिलीवर किया। Sonnet 5 ने एक Chart.js फाइल से लिंक किया जो cdnjs पर मौजूद ही नहीं है (URL 404 लौटाता है), इसलिए लाइब्रेरी कभी लोड ही नहीं हुई और हर पैनल, उसके सादे टेबल्स सहित, खाली रेंडर हुए। Sonnet 5.5 यह भी चेक करता है कि उसकी चार्ट लाइब्रेरी लोड हुई या नहीं और यदि नहीं हुई तो भी अपने टेबल्स को काम करता रखता है।
  • Sonnet 5.5 ने छोटे-सैंपल का जाल पकड़ा, ज्यादातर हद तक। यह 30 से कम उत्तरदाताओं वाले मेजर्स को “सावधानी से लें” के रूप में मार्क करता है और एक न्यूनतम-उत्तरदाता फ़िल्टर जोड़ता है। उसका डिफॉल्ट व्यू Petroleum Engineering को #1 पर रखता है, बिना चेतावनी के।
  • Sonnet 5 इसे वैसे भी मिस कर देता। उसका कोड सैंपल-साइज़ और सैलरी-रेंज कॉलम्स को पढ़ता है, फिर उनका कभी उपयोग नहीं करता, और केवल मीडियन के आधार पर मेजर्स को रैंक करता है।
  • छोटे जाल किसी को नहीं फंसाए। दोनों ने खाली Food Science पंक्ति को स्पष्ट रूप से संभाला, और Sonnet 5.5 ने अपने कॉलेज-जॉब शेयर की गणना इस तरह की कि जॉब कॉलम्स के कुल रोजगार के बराबर होने का संकेत न मिले।

यह रहा Sonnet 5.5 का डैशबोर्ड, जिसमें फ़िल्टर कम-से-कम 100 उत्तरदाताओं वाले मेजर्स पर सेट है।

मैंने Sonnet 5.5 के डैशबोर्ड को ईमानदार डेटा हैंडलिंग के लिए 5 में से 4, विश्लेषणात्मक उपयोगिता के लिए 5, और चार्ट व लेआउट क्वालिटी के लिए 4 अंक दिए। Sonnet 5 का खाली पेज नीचे शामिल कर रहा हूँ। 

तो Sonnet 5 असफल क्यों हुआ? समस्या यह थी कि डैशबोर्ड को एक चार्टिंग लाइब्रेरी चाहिए थी। Sonnet 5 ने cdnjs से एक ऐसा वर्ज़न मांगा जो वह होस्ट नहीं करता। फिर उसे “404” एरर मिला। लाइब्रेरी के बिना, Sonnet 5 का कोड क्रैश हो गया: “Chart is not defined.” जाहिर है, Sonnet 5 ने पेज इस तरह लिखा था कि सब कुछ, उसके सादे टेक्स्ट टेबल्स भी, उसी स्टेप के बाद रन होते थे, और वह गलती पकड़ नहीं सका।

प्रति रन लागत मूलतः समान थी: Sonnet 5.5 के लिए $0.56 और Sonnet 5 के लिए $0.57। साथ ही, Sonnet 5.5 ने काम तेज़ी से पूरा किया।

तो क्या Sonnet 5.5 सच में एक कदम आगे है? इस टास्क पर, हाँ। Sonnet 5.5 ने काम करता हुआ डैशबोर्ड भेजा जो पतले डेटा के बारे में चेतावनी भी देता है, जबकि Sonnet 5 ने खाली पेज भेजा।

Claude Sonnet 5.5 की प्राइसिंग और उपलब्धता

Claude Sonnet 5.5 की कीमत API पर प्रति मिलियन इनपुट टोकन्स $2 और प्रति मिलियन आउटपुट टोकन्स $10 है, जो Sonnet 5 जैसी ही है और Opus 5.5 की आधी। Anthropic प्रति टास्क कम टोकन्स की रिपोर्ट करता है, जो दर फ्लैट होने के बावजूद किसी जॉब की प्रभावी लागत को कम करेगा। हालांकि, हमारे हैंड्स-ऑन टेस्ट में, दोनों मॉडलों की टास्क पूरी करने की लागत लगभग समान थी।

Token type Price per 1M tokens
Input $2
Output $10
Cache write (5-minute) $2.50
Cache write (1-hour) $4
Cache read $0.20

Batch API इनपुट और आउटपुट—दोनों पर 50% की छूट देता है। न्यूनतम कैश योग्य प्रॉम्प्ट 512 टोकन्स है, और Batch API पर मॉडल output-300k-2026-03-24 बीटा हेडर के साथ 300K तक आउटपुट टोकन्स लौटा सकता है।

Sonnet 5.5 जनरल उपलब्ध है, प्रीव्यू नहीं, और ज़ीरो डेटा रिटेंशन का विकल्प देता है। Anthropic इसे 28 सितंबर, 2027 से पहले रिटायर न करने की प्रतिबद्धता देता है। 

Claude Sonnet 5.5 तक एक्सेस कैसे पाएं?

आप Claude Sonnet 5.5 का उपयोग आज ही Claude ऐप्स, Claude Code, और API के जरिए मॉडल ID claude-sonnet-5-5 के साथ कर सकते हैं। यह Amazon Bedrock पर anthropic.claude-sonnet-5-5 के रूप में, और Google Cloud, Microsoft Foundry, तथा AWS पर Claude Platform पर claude-sonnet-5-5 के तहत भी उपलब्ध है।

यह रहा एक न्यूनतम Python कॉल। एडेप्टिव थिंकिंग डिफॉल्ट रूप से ऑन है, इसलिए रिस्पॉन्स में टेक्स्ट से पहले थिंकिंग ब्लॉक्स शामिल हो सकते हैं:

from anthropic import Anthropic

client = Anthropic()
response = client.messages.create(
    model="claude-sonnet-5-5",
    max_tokens=2048,
    messages=[{"role": "user", "content": "Find the off-by-one bug in this loop: ..."}],
)
for block in response.content:
    if block.type == "text":
        print(block.text)

कुंजियों, लागत, और आपके पहले प्रोजेक्ट का एक वास्तविक walkthrough के लिए हमारा Claude API का संपूर्ण गाइड देखें। यदि आप एजेंट्स बना रहे हैं, तो Claude Managed Agents बनाने पर हमारा ट्यूटोरियल अगला अच्छा कदम है। हम जल्द ही Claude Sonnet 5.5 API पर ट्यूटोरियल प्रकाशित करेंगे।

अंतिम विचार

Anthropic यह दांव लगा रहा है कि अधिकांश पेड वर्क, जिसमें अधिकांश कोडिंग-एजेंट वर्क भी शामिल है, इस नए मिड-टियर मॉडल पर चलेगा। यह OpenAI के GPT-6 Sol पर भी सीधा दबाव डालता है, जो Anthropic के नॉलेज-वर्क नंबरों पर इससे पीछे है।

यदि आप Sonnet 5 पर हैं तो मैं अभी स्विच करूँगा, लेकिन API बदलावों पर खुद को अपडेट ज़रूर करें। वे प्रोजेक्ट्स जिनमें मॉडल को तय करना होता है कि क्या बनाना है, उनके लिए Opus 5.5 रखें।

यदि आप Anthropic के मॉडलों के साथ बिल्डिंग के बारे में और सीखना चाहते हैं, तो मैं हमारे Introduction to Claude Models कोर्स को देखने की सलाह देता हूँ।

FAQs

Claude Sonnet 5.5, Claude Opus 5.5 की तुलना में कैसा है?

Claude Sonnet 5.5 Terminal-Bench 4.0 पर Opus 5.5 से अधिक स्कोर करता है (70.6% बनाम 66.4%) और GDPval-AA, OSWorld 2.1, तथा Humanity's Last Exam पर उससे कुछ अंकों के भीतर आता है। Opus 5.5 प्रति टोकन दोगुनी कीमत का है और जटिल, खुले-छोर वाले, निरंतर निर्णय-आधारित कार्यों में अब भी अधिक मजबूत है।

Claude Sonnet 5.5 की कीमत कितनी है?

Claude Sonnet 5.5 की कीमत प्रति मिलियन इनपुट टोकन्स $2 और प्रति मिलियन आउटपुट टोकन्स $10 है, जो Sonnet 5 के समान है। कैश रीड्स की कीमत प्रति मिलियन टोकन्स $0.20 है, और Batch API 50% की छूट देता है। Anthropic का कहना है कि यह Sonnet 5 की तुलना में प्रति टास्क 30% तक कम लागत आती है क्योंकि यह कम टोकन्स उपयोग करता है।

मैं Claude Sonnet 5.5 कहाँ एक्सेस कर सकता/सकती हूँ?

Claude Sonnet 5.5 Claude ऐप्स, Claude Code, और Claude API में मॉडल ID claude-sonnet-5-5 के तहत उपलब्ध है। यह Amazon Bedrock (anthropic.claude-sonnet-5-5), Google Cloud, Microsoft Foundry, और AWS पर Claude Platform पर भी मौजूद है।

Claude Sonnet 5.5 का कॉन्टेक्स्ट विंडो क्या है?

Claude Sonnet 5.5 में Messages API पर 1M-टोकन का कॉन्टेक्स्ट विंडो और 128K-टोकन अधिकतम आउटपुट है। Message Batches API पर, यह output-300k-2026-03-24 बीटा हेडर के साथ 300K तक आउटपुट टोकन्स लौटा सकता है।

Sonnet 5 की तुलना में Claude Sonnet 5.5 API में क्या बदला?

Anthropic पाँच ब्रेकिंग चेंजेस सूचीबद्ध करता है: एडेप्टिव थिंकिंग डिफॉल्ट रूप से ऑन है (up-front थिंकिंग बंद करने के लिए between_tools इस्तेमाल करें), फोर्स्ड टूल यूज़ एरर लौटाता है, थिंकिंग ब्लॉक्स मॉडल और बातचीत से बंधे हैं, computer_20251124 टूल Claude API और Google Cloud पर रिजेक्ट होता है, और एडवाइजर टूल पुराने मॉडलों को एडवाइजर के रूप में रिजेक्ट करता है। नॉन-डिफॉल्ट temperature, top_p, या top_k वैल्यू भी 400 एरर लौटाती हैं।

विषय
कृत्रिम बुद्धिमत्ता