मुख्य सामग्री पर जाएं

Google AI Studio ट्यूटोरियल: चैट, बिल्ड, और स्ट्रीम मोड्स की संपूर्ण गाइड

Gemini मॉडलों के साथ प्रोटोटाइपिंग के लिए Google AI Studio के Chat, Build, और Stream मोड्स का उपयोग करना सीखें।
अपडेट किया गया 24 सित॰ 2026  · 12 मि॰ पढ़ें

AI के साथ खोजें

ChatGPTClaudePerplexity

AI मॉडलों के साथ निर्माण करना अक्सर API कुंजियाँ संभालना, दस्तावेज़ पढ़ना, और एक भी प्रॉम्प्ट टेस्ट करने से पहले बोइलरप्लेट कोड लिखना होता है। Google AI Studio इस सेटअप को छोड़ देता है और आपको सीधे ब्राउज़र-आधारित प्लेग्राउंड में ले जाता है, जहाँ आप Gemini मॉडलों से चैट कर सकते हैं, मीडिया जनरेट कर सकते हैं, और बिना कोड छुए एप्लिकेशन का प्रोटोटाइप बना सकते हैं।

यह ट्यूटोरियल Google AI Studio की मुख्य विशेषताओं को कवर करता है: प्रॉम्प्ट टेस्टिंग के लिए Chat मोड, वॉइस और वीडियो इंटरैक्शन के लिए Stream मोड, प्राकृतिक भाषा से ऐप बनाने के लिए Build मोड, और छवियों, वीडियो और ऑडियो के लिए मीडिया जेनरेशन टूल्स। 

आप सीखेंगे कि अलग-अलग कार्यों के लिए किन Gemini मॉडलों का उपयोग करना है और अपने प्रोटोटाइप को प्रोडक्शन-रेडी कोड में कैसे एक्सपोर्ट करना है। Google की इस वर्ष की नवीनतम AI घोषणाओं के लिए, हमारे Gemini 3.5 Flash और Nano Banana 2 पर गाइड देखें, या हमारा Google Antigravity CLI ट्यूटोरियल। आप यह भी सीख सकते हैं Google ADK के साथ AI एजेंट कैसे बनाएं।

संक्षेप में

  • Google AI Studio Gemini मॉडलों के साथ टेक्स्ट, इमेज, वीडियो और ऑडियो में प्रोटोटाइपिंग के लिए एक निःशुल्क, ब्राउज़र-आधारित प्लेटफ़ॉर्म है
  • Chat मोड प्रॉम्प्ट्स का परीक्षण करता है, Build मोड प्राकृतिक भाषा से पूरी React और Android ऐप्स बनाता है, और Stream मोड वॉइस/वीडियो वार्तालाप सक्षम करता है
  • Gemini 3.5 Flash (मई 2026 को Google I/O 2026 में जारी) नया फ़्लैगशिप मॉडल है, जिसमें 1M कॉन्टेक्स्ट विंडो और 65K आउटपुट टोकन हैं
  • Build मोड अब Antigravity Agent द्वारा संचालित है और Kotlin तथा Jetpack Compose के साथ नेटिव Android ऐप विकास को सपोर्ट करता है
  • मुफ़्त स्तर में कम्प्यूट-आधारित उपयोग सीमाएँ होती हैं जो हर पाँच घंटे में रिफ्रेश होती हैं, और सभी Gemini 3 मॉडल सुलभ हैं

Google AI Studio क्या है?

Google AI Studio Gemini AI मॉडलों के साथ प्रोटोटाइपिंग के लिए एक निःशुल्क, ब्राउज़र-आधारित प्लेटफ़ॉर्म है। यह प्रॉम्प्ट्स की टेस्टिंग के लिए Chat मोड, प्राकृतिक भाषा से React ऐप बनाने के लिए Build मोड, और वॉइस व वीडियो इंटरैक्शन के लिए Stream मोड प्रदान करता है—वह भी बिना सेटअप कोड लिखे।

Google AI Studio के साथ आरंभ करना

Google AI Studio के साथ शुरुआत करने में एक मिनट से भी कम लगता है। aistudio.google.com पर जाएँ और किसी भी Google खाते से साइन इन करें। न इंस्टॉलेशन, न क्रेडिट कार्ड की आवश्यकता, और न ही कोई वेटिंग पीरियड। प्लेटफ़ॉर्म पूरी तरह आपके ब्राउज़र में चलता है।

इंटरफ़ेस नेविगेशन के लिए बाएँ साइडबार का उपयोग करता है, जिसमें पाँच मुख्य सेक्शन हैं: Home, Playground, Build, Dashboard, और Documentation। होमपेज पर तीन एक्शन कार्ड सामान्य कार्यों—जैसे मॉडलों से चैट करना या एप्लिकेशन बनाना—तक त्वरित पहुँच देते हैं। साइडबार के नीचे, आपको अपने खाते के प्रबंधन के लिए "Get API key" और "Settings" के लिंक मिलेंगे।

Google AI Studio होम पेज

Google AI Studio होमपेज

अपनी स्वयं की एप्लिकेशनों में Gemini API का उपयोग शुरू करने के लिए, बाएँ साइडबार के नीचे "Get API key" पर क्लिक करें। इससे API Keys मैनेजमेंट पेज खुलता है, जहाँ आप "Create API key" बटन से नई कुंजी बना सकते हैं। 

Google AI Studio API कुंजी

API Keys मैनेजमेंट पेज

अपनी API कुंजी सुरक्षित रखें और उसे सार्वजनिक रिपॉजिटरीज़ में कमिट करने से बचें।

प्रयोग शुरू करने से पहले, आप समझना चाहेंगे कि कौन-सा Gemini मॉडल आपके कार्य के अनुरूप है। AI Studio आपको कई विकल्प देता है, प्रत्येक की अलग-अलग शक्तियाँ हैं।

Google AI Studio में कौन-से मॉडल उपलब्ध हैं?

AI Studio में आपको कई Gemini मॉडल मिलेंगे, जो अलग-अलग कार्यों के लिए बनाए गए हैं। आपकी पसंद इस पर निर्भर करती है कि आप तर्क-क्षमता, गति, लागत, या इमेज जेनरेशन जैसी विशिष्ट सुविधाओं के लिए अनुकूलन कर रहे हैं।

Gemini 3 श्रृंखला

gemini-3-pro मॉडल जटिल तर्क संबंधी कार्यों को संभालता है जहाँ आपको गहन विश्लेषण चाहिए। लॉन्च के समय यह Elo लीडरबोर्ड पर 1501 अंक पर था। हालांकि, gemini-3-pro को मार्च 2026 में अप्रचलित घोषित कर बंद कर दिया गया। इसका उत्तराधिकारी gemini-3.1-pro-preview कोडिंग और एजेंटिक प्रदर्शन में सुधार करता है। नवीनतम फ़्लैगशिप के लिए नीचे Gemini 3.5 Flash देखें। 

1 मिलियन टोकन की कॉन्टेक्स्ट विंडो के साथ, आप इसे पूरे कोडबेस या शोध पत्र दे सकते हैं और बदले में 65,000 टोकन तक प्राप्त कर सकते हैं। 

मॉडल में एक thinking_level पैरामीटर शामिल है, जो आपको अपने कार्य के अनुसार तर्क की गहराई को बढ़ाने या घटाने देता है। Gemini 3 की विशेषताओं और बेंचमार्क्स पर गहराई से जानकारी के लिए DataCamp की Gemini 3 गाइड देखें।

इमेज जेनरेशन के लिए, gemini-3-pro-image (उपनाम Nano Banana Pro) 2K और 4K छवियाँ बना सकता है, जिनके भीतर पढ़ने योग्य टेक्स्ट होता है। अधिकांश इमेज मॉडल टेक्स्ट रेंडरिंग में विफल रहते हैं, लेकिन यह इसे अच्छी तरह संभालता है। आपको 65,000 इनपुट टोकन और 32,000 आउटपुट टोकन मिलते हैं।

एक बात ध्यान देने योग्य: Google Maps ग्राउंडिंग Gemini 3 मॉडलों में उपलब्ध नहीं है। यदि आपको लोकेशन फीचर्स चाहिए, तो आपको Gemini 2.5 Pro का उपयोग करना होगा।

Gemini 2.5 श्रृंखला

gemini-2.5-pro मॉडल सोच-प्रथम (thinking-first) दृष्टिकोण अपनाता है, प्रतिक्रिया देने से पहले जटिल विश्लेषणात्मक कार्य पर अधिक समय लगाता है। यह Gemini 3 Pro की तरह 1M कॉन्टेक्स्ट और 65K आउटपुट क्षमता से मेल खाता है, और यही एकमात्र मॉडल है जो Google Maps ग्राउंडिंग को सपोर्ट करता है।

Flash वेरिएंट गति और लागत के लिए कुछ तर्क-गहराई का सौदा करते हैं:

  • gemini-2.5-flash: Pro मॉडलों की तुलना में तेज़ प्रतिक्रियाएँ, साथ ही 1M कॉन्टेक्स्ट विंडो बरकरार। सामान्य कार्यों के लिए अच्छा डिफ़ॉल्ट

  • gemini-2.5-flash-lite: उच्च-वॉल्यूम कार्य के लिए बनाया गया है जहाँ आप बड़े पैमाने पर सरल क्वेरी चलाते हैं

Gemini 3.5 श्रृंखला (मई 2026)

Google I/O 2026 में, Google ने gemini-3.5-flash लॉन्च किया, जो Gemini उत्पादों में नया डिफ़ॉल्ट मॉडल है। यह कोडिंग और एजेंटिक बेंचमार्क्स पर Gemini 3.1 Pro से बेहतर है: Terminal-Bench 2.1 पर 76.2%, MCP Atlas पर 83.6%, और GDPval-AA पर 1656 Elo। इसमें 1 मिलियन टोकन की कॉन्टेक्स्ट विंडो और 65,536 आउटपुट टोकन बरकरार हैं, और यह लगभग 289 टोकन प्रति सेकंड की गति से चलता है।

यह मॉडल Antigravity एजेंट हार्नेस के साथ सह-अनुकूलित किया गया, जिससे यह बहु-स्टेप टूल उपयोग की आवश्यकता वाले एजेंटिक वर्कफ़्लो के लिए प्रथम पसंद बन जाता है। API की कीमतें $1.50 प्रति मिलियन इनपुट टोकन और $9.00 प्रति मिलियन आउटपुट टोकन हैं, और कैश्ड इनपुट पर 90% की छूट मिलती है।

gemini-3.5-pro आंतरिक परीक्षण में है और जून 2026 में रोलआउट की उम्मीद है।

Google AI Studio में सही मॉडल कैसे चुनें

  • यदि आप कोडिंग समस्याओं, गणितीय विश्लेषण, या चरण-दर-चरण तर्क की आवश्यकता वाले किसी भी कार्य पर काम कर रहे हैं, तो gemini-3.5-flash से शुरू करें। 

  • जब आपको Maps ग्राउंडिंग चाहिए या सोच-केंद्रित दृष्टिकोण चाहते हैं, तो gemini-2.5-pro पर स्विच करें। 

  • अधिकांश रोज़मर्रा के कार्यों के लिए, gemini-2.5-flash आपको बिना अधिक लागत के अच्छा प्रदर्शन देता है। 

  • जब आप सरल अनुरोधों की उच्च मात्रा प्रोसेस कर रहे हों, तो gemini-2.5-flash-lite का उपयोग करें। 

  • और जब आपको पढ़ने योग्य टेक्स्ट वाली छवियाँ चाहिए हों, तो nano-banana-pro चुनें।

सभी Gemini मॉडलों—जिनमें Gemini 3 Flash और Gemini 3 Pro शामिल हैं—के लिए मुफ्त स्तर की पहुँच उपलब्ध है, उपयोग सीमाएँ हर पाँच घंटे में रिफ्रेश होती हैं। I/O 2026 से, Google प्रति-मिनट रेट लिमिट्स से कम्प्यूट-आधारित उपयोग कैप्स पर चला गया है, जहाँ हल्की क्वेरीज़ आपकी अलाउंस कम उपयोग करती हैं, जबकि जटिल कोडिंग या वीडियो अनुरोध अधिक।

अब जब आपको पता है कि कौन-सा मॉडल इस्तेमाल करना है, तो चलिए Chat मोड के ज़रिए उनसे इंटरैक्ट करना देखते हैं, जहाँ आप कोड लिखने से पहले प्रॉम्प्ट्स टेस्ट कर सकते हैं और अपना दृष्टिकोण सुधार सकते हैं।

AI Studio Chat मोड और Playground

Playground आपको हर सेटिंग के लिए विज़ुअल नियंत्रण के साथ प्रॉम्प्ट्स टेस्ट करने देता है। आप पैरामीटर्स को समायोजित कर सकते हैं, टूल्स को ऑन/ऑफ कर सकते हैं, और जब कुछ काम करने लगे तो पूरी कॉन्फ़िगरेशन को कार्यशील कोड के रूप में एक्सपोर्ट कर सकते हैं।

Google AI Studio Chat मोड

Google AI Studio Playground इंटरफ़ेस, जिसमें सिस्टम निर्देश, तापमान और thinking level जैसे मॉडल पैरामीटर, तथा कोड एक्ज़िक्यूशन और Google Search ग्राउंडिंग सहित टूल्स दिख रहे हैं

सिस्टम निर्देश पूरी बातचीत के लिए मॉडल का व्यवहार निर्धारित करते हैं, ताकि आपको हर प्रॉम्प्ट में वही संदर्भ दोहराना न पड़े। तापमान यह नियंत्रित करता है कि प्रतिक्रियाएँ कितनी यादृच्छिक होंगी: लगभग 0.3 जैसे कम मान लगातार फ़ॉर्मैटिंग देते हैं, जबकि लगभग 1.5 जैसे ऊँचे मान रचनात्मक लेखन के लिए बेहतर काम करते हैं। Gemini 3 मॉडलों में thinking level ड्रॉपडाउन आपको गति के बदले तर्क-गहराई का सौदा करने देता है।

यदि आप टेक्स्ट के बजाय इमेज जनरेट करना चाहते हैं, तो ऊपर वाले ड्रॉपडाउन से मॉडल को Nano Banana Pro पर स्विच करें। वही पैरामीटर नियंत्रण लागू होते हैं, लेकिन आपको 2K या 4K छवियाँ मिलेंगी जिनमें पढ़ने योग्य टेक्स्ट रेंडरिंग होगी। 

छवियों से आगे, Chat मोड अन्य मीडिया भी संभालता है। Veo 3.1 नैटिव ऑडियो, लिप सिंक, नैटिव 9:16 वर्टिकल आउटपुट, और 1080p/4K अपस्केलिंग के साथ वीडियो जनरेट करता है।

Google ने I/O 2026 में Gemini Omni Flash भी पेश किया, जो एक नया मल्टीमॉडल मॉडल है जो टेक्स्ट, इमेज और वीडियो इनपुट्स को मिलाकर वीडियो जनरेट और एडिट करता है।

ऑडियो के लिए, आप टेक्स्ट-टू-स्पीच या म्यूज़िक जेनरेशन के लिए Lyria 3 का उपयोग कर सकते हैं (Lyria 3 Pro अधिकतम 3 मिनट तक के पूरे गीत बनाता है, जबकि Lyria 3 Clip 30-सेकंड के क्लिप संभालता है)। Lyria RealTime इंटरैक्टिव संगीत निर्माण जोड़ता है, जहाँ मॉडल रियल टाइम में आपके इनपुट्स का जवाब देता है।

Google Search के साथ Grounding जैसे टूल्स, तब वर्तमान जानकारी खींचते हैं जब मॉडल के प्रशिक्षण डेटा में कमी रह जाती है। 

कोड एक्ज़िक्यूशन सीधे Python चलाता है, गणनाओं या डेटा कार्य के लिए। अन्य टॉगल्स आपकी अपनी APIs से कनेक्ट करते हैं, JSON स्कीमा लागू करते हैं, या बातचीत में URLs फ़ीड करते हैं।

Google AI Studio में Get code डायलॉग

Google AI Studio में Get code डायलॉग, जिसमें Gemini API इम्प्लीमेंटेशन के साथ Python कोड एक्सपोर्ट दिख रहा है

जब आप टेस्टिंग से प्रोडक्शन पर जाने के लिए तैयार हों, तो "Get code" सब कुछ इम्प्लीमेंटेशन कोड के रूप में एक्सपोर्ट करता है।

Stream मोड इसे आगे बढ़ाता है, वॉइस और वीडियो इंटरैक्शन जोड़कर।

AI Studio Stream मोड (Live API)

Stream मोड टेक्स्ट-आधारित प्रॉम्प्ट्स को ऐसी बातचीत में बदल देता है जहाँ Gemini आपको देख और सुन सकता है। आप माइक्रोफोन के ज़रिए मॉडल से बात करते हैं, अपनी स्क्रीन दिखाते हैं, और बिना टाइप किए रियल टाइम में बोले हुए जवाब पाते हैं। 

स्ट्रीम मोड तक पहुँचने के लिए, आप https://aistudio.google.com/live पर जा सकते हैं।

Google AI Studio Stream मोड

Google AI Studio Stream मोड इंटरफ़ेस, जिसमें Talk, Webcam, और Share Screen बटन, वॉइस सेटिंग्स और साइडबार में कॉन्फ़िगरेशन विकल्प दिख रहे हैं

इंटरफ़ेस तीन विकल्प देता है: केवल वॉइस इंटरैक्शन के लिए Talk, स्वयं का वीडियो शामिल करने के लिए Webcam, या अपनी डिस्प्ले दिखाने के लिए Share Screen। 

वॉइस एक्टिविटी डिटेक्शन स्वचालित रूप से चलता है। Gemini आपके रुकने का इंतज़ार करता है, फिर प्रतिक्रिया देता है, ताकि आप बिना बारी-बारी से क्लिक किए अपनी बात सोच-समझकर रख सकें। मॉडल आपकी आवाज़, वेबकैम से आने वाले किसी भी वीडियो, और जो भी आप दिखा रहे हैं—इन सबको एक साथ प्रोसेस करता है। 

आप मॉडल की प्रतिक्रियाओं के लिए अलग-अलग आवाज़ें भी चुन सकते हैं, जैसे सेटिंग्स में दिख रही "Zephyr" आवाज़। मॉडल का आंतरिक तर्क Thoughts सेक्शनों में विस्तार योग्य रूप में दिखता है, जिससे आप देख सकते हैं कि वह हर प्रतिक्रिया तक कैसे पहुँचा।

Stream मोड वार्तालाप

Stream मोड वार्तालाप, जिसमें ऑडियो वेवफ़ॉर्म, मॉडल थॉट्स, और उपयोगकर्ता तथा Gemini के बीच रियल टाइम प्रतिक्रियाएँ दिखाई दे रही हैं

हैंड्स-फ़्री इंटरैक्शन लाइव ट्यूशन सत्रों में अच्छा काम करता है, जहाँ आपको अपना काम दिखाना होता है और उसी क्षण मौखिक मार्गदर्शन चाहिए होता है। 

आप किसी गणित समस्या से गुज़रते हुए अपनी सोच ज़ोर से बतला सकते हैं, और Gemini यह पकड़ सकता है कि आपकी तर्क-श्रृंखला कहाँ टूटी। डिबगिंग तब तेज़ हो जाती है जब आप अपना IDE दिखा सकते हैं और जो त्रुटि आप देख रहे हैं उसे वर्णित कर सकते हैं। आपकी स्क्रीन पिक्चर-इन-पिक्चर मोड में दिखाई देती है, ताकि Gemini ठीक वही देख सके जिसका आप संदर्भ दे रहे हैं।

स्क्रीन शेयरिंग सक्रिय के साथ Stream मोड

स्क्रीन शेयरिंग सक्रिय के साथ Stream मोड, जिसमें साझा स्क्रीन का पिक्चर-इन-पिक्चर दृश्य और Gemini द्वारा प्रदर्शित सामग्री का विश्लेषण करते हुए ऑडियो प्रतिक्रियाएँ दिखाई दे रही हैं

यदि आप प्रस्तुति का रिहर्सल कर रहे हैं या डेमो चला रहे हैं, तो Stream मोड आपकी स्लाइड्स देख सकता है और सामग्री से जुड़े प्रश्नों का उत्तर दे सकता है। यह तब भी मदद करता है जब आप नया सॉफ़्टवेयर सीख रहे हों। आप Gemini को अपना इंटरफ़ेस दिखा सकते हैं, पूछ सकते हैं कि कोई विशिष्ट फीचर कहाँ मिलेगा, और नेविगेट करते समय दिशा-निर्देश प्राप्त कर सकते हैं।

Stream मोड उन परिदृश्यों में फिट बैठता है जहाँ आप वॉइस और विज़ुअल्स के साथ रियल टाइम बैक-एंड-फ़ोर्थ चाहते हैं। टेक्स्ट-प्रधान कार्यों के लिए—जहाँ आपको प्रतिक्रियाएँ कॉपी करनी हों या लिखित प्रॉम्प्ट्स पर इटरेट करना हो—Chat मोड अभी भी अधिक उपयुक्त है। जबकि Stream मोड रियल टाइम इंटरैक्शन संभालता है, Build मोड आपको प्राकृतिक भाषा विवरणों से संपूर्ण एप्लिकेशन बनाने देता है।

AI Studio Build मोड (Vibe Coding)

Build मोड विवरणों को कार्यशील ऐप्स में बदल देता है। आप लिखते हैं कि आपको क्या चाहिए, और Antigravity Agent कोड लिखता है। Google इसे "vibe coding" कहता है, और I/O 2026 से यह React वेब ऐप्स से कहीं आगे चला गया है। अब आप Kotlin और Jetpack Compose के साथ नेटिव Android ऐप्स बना सकते हैं, उन्हें ब्राउज़र-आधारित Android एमुलेटर में प्रीव्यू कर सकते हैं, ADB के ज़रिए किसी फ़िज़िकल डिवाइस पर टेस्ट कर सकते हैं, और सीधे Google Play के Internal Test Track पर प्रकाशित भी कर सकते हैं।

AI Studio Build मोड लैंडिंग पेज

Build मोड लैंडिंग पेज, जिसमें प्रॉम्प्ट इनपुट बॉक्स, Gemini 3 Pro Preview मॉडल सेलेक्टर, I'm feeling lucky बटन, और AI Chips सेक्शन में Nano Banana संचालित ऐप, वार्तालाप-आधारित वॉइस ऐप्स, Veo वीडियो एनीमेशन, और Google Search डेटा इंटीग्रेशन के विकल्प दिख रहे हैं

मैंने पहले स्टार्टर गैलरी ब्राउज़ की। Shader Pilot जैसी ऐप्स दिखाती हैं कि क्या-क्या संभव है—इंटरैक्टिव 3D विज़ुअलाइज़ेशन, कस्टम टाइपोग्राफ़ी वाली लैंडिंग पेज, यहाँ तक कि छोटे गेम्स भी। आप किसी भी उदाहरण को फोर्क कर सकते हैं और असिस्टेंट पैनल के माध्यम से कोड संशोधित कर सकते हैं।

AI Studio Starter ऐप्स गैलरी, जिसमें Gemini 3 Pro की फ़ीचर्ड मिसालें दिखाई गई हैं

Starter ऐप्स गैलरी, जिसमें Gemini 3 Pro की फ़ीचर्ड मिसालें—3D गेम्स, मल्टीमॉडल ऐप्स, और सुंदर लैंडिंग पेज—शामिल हैं, जैसे AlphaQubit रिसर्च विज़ुअलाइज़ेशन, Lumina Festival इवेंट पेज, और Aura Quiet Living ई-कॉमर्स डेमो

मैं शुरू से बनाना चाहता था, इसलिए मैंने टाइप किया: "एक मिनिमलिस्टिक और फिर भी दृश्य रूप से प्रभावशाली एप्लिकेशन जो मुझे पोलर कोऑर्डिनेट्स में अधिकतम 3 वेरिएबल्स तक के किसी भी समीकरण को विज़ुअलाइज़ करने देता है।"

Polar.ai बनते हुए दिख रहा है—उपयोगकर्ता प्रॉम्प्ट में पोलर कोऑर्डिनेट समीकरण विज़ुअलाइज़र का अनुरोध, Gemini 3 Pro Preview स्टेटस इंडिकेटर में 24s से Running और Building the Core Logic की प्रगति संदेश, तथा फ़ाइल एक्सप्लोरर पैनल में जनरेट हुए index.tsx और metadata.json फ़ाइलें

लगभग 60 सेकंड बाद, Polar.ai दिखाई दिया। मॉडल ने React फ़ाइलें (index.tsx, metadata.json) जनरेट कीं, एक समीकरण पार्सर बनाया, और वेरिएबल स्लाइडर्स सेट कर दिए। मैंने "a heart" टाइप किया और उसे पोलर कर्व बनाते देखा। "bat" पर स्विच करने से अलग आकृति निकली।

Polar.ai ऐप, जिसमें दिल-आकृति वाली पोलर कर्व गहरे ग्रिड बैकग्राउंड पर सियान रंग में रेंडर हो रही है; इक्वेशन एडिटर में r equals a times sine फ़ॉर्मूला, a, b, t के लिए वेरिएबल स्लाइडर्स 1.0 पर, Max theta 2 pi पर, Animate T बटन, और Powered by Gemini 2.5 Flash क्रेडिट

Polar.ai ऐप, जिसमें चमगादड़-आकृति वाला पोलर विज़ुअलाइज़ेशन सियान रंग में छह-लॉब वाला सममित पैटर्न दिखा रहा है; इक्वेशन एडिटर में संशोधित कोसाइन फ़ॉर्मूला और a, b, t के वेरिएबल कंट्रोल्स तथा Max theta स्लाइडर

जब चमगादड़ के कोऑर्डिनेट्स कर्व के बीच में गायब हो गए, तो मैंने चैट में समस्या का वर्णन किया। मॉडल ने निदान किया (काल्पनिक संख्याएँ रेंडरर तोड़ रही थीं), समाधान समझाया, और "View diff" के साथ एक चेकपॉइंट बनाया ताकि मैं बदलाव देख सकूँ।

Polar.ai डिबगिंग सत्र, जिसमें बाएँ पैनल में उपयोगकर्ता की बग रिपोर्ट (चमगादड़ कोऑर्डिनेट्स गायब होना), मॉडल द्वारा 83-सेकंड की सोच समय के साथ समीकरण मूल्यांकन में काल्पनिक संख्या समस्या का विश्लेषण, रेंडरिंग पाइपलाइन को पुन:क्रमित करने की विस्तृत फ़िक्स योजना, View diff और Restore बटनों के साथ चेकपॉइंट कंट्रोल्स, और दाएँ पैनल में लाइव प्रीव्यू तथा नीचे एनोटेशन टूलबार में ड्रॉइंग टूल्स और Add to chat विकल्प दिख रहे हैं

एनोटेशन टूलबार आपको इंटरफ़ेस एलिमेंट्स पर क्लिक करके विज़ुअल बदलाव का अनुरोध करने देता है। एक बार ऐप काम करने लगे, तो इसे ZIP के रूप में एक्सपोर्ट करें, GitHub पर पुश करें, या क्लाउड होस्टिंग पर डिप्लॉय करें। जनरेट किया गया कोड मानक React पैटर्न का उपयोग करता है, हालांकि प्रोडक्शन में डिप्लॉय करने से पहले आपको इसे परिष्कृत करने की संभावना है।

Google AI Studio Export टूलबार

Export टूलबार, जिसमें Unsaved स्थिति और छह एक्शन आइकन दिख रहे हैं—प्रोजेक्ट को Google Drive में सेव करना, ZIP फ़ाइल के रूप में डाउनलोड करना, GitHub रिपॉजिटरी में पुश करना, क्लाउड होस्टिंग पर डिप्लॉय करना, लिंक के ज़रिए शेयर करना, और प्रोजेक्ट प्रबंधन विकल्प

Google I/O 2026 में Build मोड को कई क्षमताएँ मिलीं। Google Workspace इंटीग्रेशन आपको Drive, Sheets, और Docs को सीधे अपनी ऐप्स से जोड़ने देता है। Cloud Run पर वन-क्लिक डिप्लॉय, Firebase बैकएंड सपोर्ट के साथ, प्रमाणीकरण और डेटाबेस स्टोरेज को संभालता है। आप अपना पूरा प्रोजेक्ट Google Antigravity के डेस्कटॉप ऐप में लोकल विकास के लिए एक्सपोर्ट भी कर सकते हैं, जिसमें बातचीत का इतिहास और प्रोजेक्ट फ़ाइलें साथ चली जाती हैं।

Google AI Studio बनाम विकल्प

अपडेट (मई 2026): Google I/O 2026 ने AI Studio और उसके प्रतिस्पर्धियों में बड़े बदलाव लाए। नीचे दी तुलना मूल लेख के समय के परिदृश्य को दर्शाती है। मुख्य बदलाव:

  • AI Studio अब Android ऐप्स बनाता है
  • Gemini 3.5 Flash नया डिफ़ॉल्ट मॉडल है
  • Google प्रति-मिनट रेट लिमिट्स से कम्प्यूट-आधारित उपयोग कैप्स पर चला गया

जब आप Google के प्लेटफ़ॉर्म से आगे AI कार्य ले जाने के लिए तैयार हों, तो प्रतिस्पर्धी सेवाओं में अलग-अलग समझौते मिलेंगे। ChatGPT की विस्तृत प्लगइन लाइब्रेरी और क्रॉस-सेशन मेमोरी ने इसे कई उपयोगकर्ताओं के लिए डिफ़ॉल्ट बना दिया है। 

Claude डेवलपर्स को लक्षित करता है, Artifacts के साथ जो वार्तालापों को पर्सिस्टेंट ऐप्स में बदल देते हैं, और MCP कनेक्शनों के माध्यम से Slack या Asana से जुड़ते हैं। 

Grok X के रियल टाइम फ़ीड से जुड़ता है, लेकिन जटिल तर्क संबंधी कार्यों में पीछे रह जाता है। Gemini की कोडिंग क्षमताओं पर अधिक जानकारी के लिए, हमारा Gemini 3.1 Pro कोडिंग एजेंट ट्यूटोरियल देखें। Gemini और ChatGPT के प्रदर्शन की अलग-अलग बेंचमार्क्स पर विस्तृत तुलना के लिए, हमारा Gemini बनाम ChatGPT हेड-टू-हेड विश्लेषण देखें।

प्लेटफ़ॉर्म

मुफ़्त स्तर

पेड स्तर

मुख्य शक्तियाँ

उपयुक्त किसके लिए

Google AI Studio

सीमित (5-15 RPM, प्रीमियम मॉडल पेड)

पे-एज़-यू-गो

Build मोड (React + Android), Stream मोड, वीडियो (Veo 3.1, Gemini Omni), Maps ग्राउंडिंग

मल्टीमॉडल प्रोटोटाइपिंग, Gemini के साथ प्रयोग

ChatGPT

10-60 संदेश/5घं (GPT-4o)

$20/माह

मेमोरी, प्लगइन्स, परिपक्व इकोसिस्टम

सामान्य कार्य, स्थापित वर्कफ़्लोज़

Claude

20-40 संदेश/दिन

$20/माह

Artifacts, Projects (200K), कोडिंग में मजबूत

ऐप प्रोटोटाइपिंग, कोडिंग सहायता

Grok

2-10 प्रॉम्प्ट/2घं

$40/माह

रियल टाइम X डेटा, Aurora इमेजेज

X इंटीग्रेशन, हल्का उपयोग

मुफ़्त स्तर की स्थिति प्लेटफ़ॉर्म्स में काफी भिन्न है:

  • AI Studio: कम्प्यूट-आधारित सीमाएँ, 5-घंटे के रिफ्रेश विंडोज़ के साथ। फ्री टियर पर सभी Gemini 3 मॉडल सुलभ।
  • ChatGPT: हर 5 घंटे में 10-60 GPT-4o संदेश, उसके बाद मिनी पर स्विच।
  • Claude: लगभग 20-40 दैनिक संदेश, 5-घंटे के रीसेट विंडोज़ के साथ।
  • Grok: हर 2 घंटे में 2-10 प्रॉम्प्ट।

ChatGPT और Claude पूर्ण वेब एक्सेस के लिए प्रति माह $20 माँगते हैं। Grok ने इसे दोगुना कर $40 कर दिया। हालांकि API कार्य के लिए, Grok $0.20 प्रति मिलियन टोकन पर जीतता है, जबकि GPT-4o के लिए $5 या Claude Sonnet के लिए $3 लगते हैं।

बजट और प्राथमिकताएँ हर किसी के लिए इस निर्णय को अलग बनाती हैं। यदि आप मल्टीमॉडल ऐप्स का प्रोटोटाइप बना रहे हैं, तो AI Studio का Build मोड और वीडियो जेनरेशन इसकी कड़ी रेट लिमिट्स को जायज़ ठहरा सकते हैं। 

ChatGPT इकोसिस्टम के पास गति है: प्लगइन्स, मेमोरी, और स्थापित वर्कफ़्लोज़ स्विचिंग लागत को ऊँचा बनाते हैं। Claude के 200K-टोकन Projects उन डेवलपर्स को आकर्षित करते हैं जिन्हें कोड के लिए बड़े कॉन्टेक्स्ट विंडो चाहिए। Grok ने सस्ता API एक्सेस ($0.20 प्रति मिलियन टोकन) और रियल टाइम X इंटीग्रेशन में अपनी जगह बनाई, तर्क-प्रदर्शन के समझौते को स्वीकार करते हुए।

अंतिम विचार

इस ट्यूटोरियल में, मैंने दिखाया कि Google AI Studio तीन अलग-अलग वर्कफ़्लो कैसे संभालता है: Chat मोड में प्रॉम्प्ट्स की टेस्टिंग, Build मोड में प्राकृतिक भाषा के ज़रिए ऐप बनाना, और Stream मोड में वॉइस व वीडियो के साथ समस्याओं पर बातचीत करना। जब आपको सेटअप कोड लिखे बिना Gemini मॉडलों के साथ प्रोटोटाइपिंग करनी हो, तब यह प्लेटफ़ॉर्म सबसे अच्छा काम करता है।

मुफ़्त स्तर की कम्प्यूट-आधारित उपयोग सीमाएँ शुरुआती टेस्टिंग के लिए उपयुक्त हैं। जब आप Gemini को प्रोडक्शन एप्लिकेशनों में इंटीग्रेट करने के लिए तैयार हों, तो मैं Gemini API ट्यूटोरियल देखने की सलाह देता हूँ, जो प्रमाणीकरण, त्रुटि प्रबंधन और ऑप्टिमाइज़ेशन पैटर्न कवर करता है। आप एडवांस्ड तर्क के लिए Gemini Deep Think भी देख सकते हैं या Gemini CLI का उपयोग कैसे करें सीख सकते हैं।

AI Studio की ताकत तेज़ प्रोटोटाइपिंग है। आप Chat मोड में कोई आइडिया टेस्ट कर सकते हैं, Build मोड में उसे तैयार कर सकते हैं, और काम करने पर कोड एक्सपोर्ट कर सकते हैं। ब्राउज़र-आधारित इंटरफ़ेस सामान्य झंझट हटा देता है, लेकिन प्रोडक्शन उपयोग के लिए फिर भी उचित API इंटीग्रेशन की आवश्यकता होगी।

Google AI Studio FAQs

Google AI Studio क्या है?

Google AI Studio Gemini AI मॉडलों के साथ प्रोटोटाइपिंग के लिए एक निःशुल्क, ब्राउज़र-आधारित प्लेटफ़ॉर्म है। यह Chat मोड (प्रॉम्प्ट टेस्टिंग), Build मोड (प्राकृतिक भाषा से React और नेटिव Android ऐप्स—Antigravity Agent द्वारा संचालित), और Stream मोड (वॉइस और वीडियो इंटरैक्शन) प्रदान करता है—वह भी बिना सेटअप कोड लिखे।

क्या Google AI Studio का उपयोग निःशुल्क है?

हाँ, Google AI Studio में एक मुफ्त स्तर है, जिसमें कम्प्यूट-आधारित उपयोग सीमाएँ होती हैं जो हर पाँच घंटे में रिफ्रेश होती हैं। शुरू करने के लिए क्रेडिट कार्ड की आवश्यकता नहीं है। सभी Gemini 3 मॉडल, जिनमें Gemini 3.5 Flash शामिल है, मुफ्त स्तर पर सुलभ हैं। अधिक सीमाओं के लिए, पेड Google AI सदस्यताएँ $20/माह (AI Plus) से शुरू होती हैं, और डेवलपर्स के लिए $100/माह का AI Ultra टियर उपलब्ध है।

Google AI Studio के Build मोड से आप क्या बना सकते हैं?

Build मोड (जिसे "vibe coding" भी कहा जाता है) प्राकृतिक भाषा विवरणों को एक मिनट से कम समय में कार्यशील एप्लिकेशनों में बदल देता है। Google I/O 2026 से, आप React वेब ऐप्स और Kotlin तथा Jetpack Compose के साथ नेटिव Android ऐप्स बना सकते हैं। जनरेट किया गया कोड ZIP फ़ाइल के रूप में एक्सपोर्ट किया जा सकता है, GitHub पर पुश किया जा सकता है, Cloud Run पर डिप्लॉय किया जा सकता है, या लोकल विकास के लिए Google Antigravity को सौंपा जा सकता है।

Google AI Studio, ChatGPT की तुलना में कैसा है?

Google AI Studio प्रोटोटाइपिंग और डेवलपमेंट पर केंद्रित है—जैसे प्राकृतिक भाषा से React और Android ऐप्स जेनरेट करने के लिए Build मोड, और वॉइस/वीडियो इंटरैक्शन के लिए Stream मोड। ChatGPT प्लगइन्स और क्रॉस-सेशन मेमोरी वाले अधिक परिपक्व इकोसिस्टम की पेशकश करता है। AI Studio, Gemini मॉडलों के साथ मल्टीमॉडल प्रोटोटाइपिंग के लिए सर्वोत्तम है, जबकि ChatGPT सामान्य कार्यों और स्थापित वर्कफ़्लो के लिए उपयुक्त है। विस्तृत तुलना के लिए हमारा Gemini बनाम ChatGPT विश्लेषण देखें।

Google AI Studio में कौन-से Gemini मॉडल उपलब्ध हैं?

मई 2026 तक, AI Studio Gemini 3.5 Flash (कोडिंग और एजेंटिक कार्यों के लिए नया डिफ़ॉल्ट), Gemini 3.1 Pro Preview (गहन तर्क के लिए), Gemini 2.5 Flash (तेज़ सामान्य कार्य), और Nano Banana Pro (पढ़ने योग्य टेक्स्ट वाली इमेज जेनरेशन) प्रदान करता है। Gemini 3.5 Flash में 1M टोकन कॉन्टेक्स्ट विंडो है और Terminal-Bench 2.1 पर 76.2% स्कोर करता है। Gemini 3.5 Pro के जून 2026 में आने की उम्मीद है।

विषय
कृत्रिम बुद्धिमत्ता
एआई एजेंट्स