भले ही Google अपने खुले बड़े भाषा मॉडल जेम्मा 4 को जारी करता है, लेकिन इसका एक संक्षिप्त ऐतिहासिक महत्व है। इन मॉडलों में जेमिनी 3 प्रो मॉडल के समान तकनीकी और अनुसंधान आधार हैं, जो पिछले साल के अंत में जारी किए गए थे, और मालिकाना बड़े भाषा मॉडल के लिए एक बड़ा कदम है। जेम्मा 4 उन्नत तर्क और एजेंटिक वर्कफ़्लो पर ध्यान देने के साथ, खुले मॉडल के लिए उन सुधारों को लाता है। यह 140 से अधिक भाषाओं में मूल रूप से प्रशिक्षित है।

जेम्मा 4, नाम में चार पीढ़ी के संदर्भ के साथ, चार मॉडल आकारों में भी उपलब्ध है। इसमें इफेक्टिव 2बी (ई2बी), इफेक्टिव 4बी (ई4बी), 26बी मिक्सचर ऑफ एक्सपर्ट्स (एमओई) और 31बी डेंस है। 26बी और 31बी मॉडल व्यक्तिगत सिस्टम पर ऑफ़लाइन गणना के साथ फ्रंटियर इंटेलिजेंस के लिए तैयार हैं। छोटे पैरामीटर आकार वाले E2B और E4B मॉडल स्मार्टफोन, मोबाइल डिवाइस और इंटरनेट ऑफ थिंग्स (IoT) इकोसिस्टम के साथ-साथ रास्पबेरी पाई और एनवीडिया के जेटसन सहित एज डिवाइस के लिए अधिक उपयुक्त हैं।
यदि आप सोच रहे हैं कि जेम्मा जेमिनी से कैसे अलग है, तो मुख्य अंतर यह है कि जेम्मा एक एआई प्रोसेसिंग इंजन है, न कि चैटबॉट-एस्क कार्यान्वयन। जबकि अंतर्निहित तकनीक काफी हद तक समान है, जेम्मा एक खुला मॉडल है जिसे स्थानीय स्तर पर मुफ्त में डाउनलोड और चलाया जा सकता है। यह विशिष्ट वर्कफ़्लो और कंप्यूटिंग आवश्यकताओं के आधार पर संशोधित, फ़ाइन-ट्यून और कस्टमाइज़ करने के लिए अधिक लचीलापन भी लाता है। तथ्य यह है कि इन मॉडलों को स्थानीय रूप से चलाया जा सकता है और क्लाउड पर नहीं, कई अनुप्रयोगों के लिए डेटा गोपनीयता और लागत के लाभ भी हैं।
सुविधा और लचीलापन व्यक्तिगत, व्यावसायिक और उद्यम उपयोग तक विस्तारित है।
Google ने इन मॉडलों के लिए क्वालकॉम, मीडियाटेक और एनवीडिया सहित भागीदारों के साथ मिलकर काम किया है। नए मॉडल अपाचे 2.0 लाइसेंस के तहत जारी किए गए हैं, जिसका अर्थ है डेवलपर्स, शोधकर्ताओं और वाणिज्यिक संस्थाओं को न्यूनतम प्रतिबंधों के साथ मॉडल का उपयोग करने, संशोधित करने, ठीक करने और पुनर्वितरित करने के लिए महत्वपूर्ण स्वतंत्रता प्रदान करना। पहले, वह लचीलापन तुलनात्मक रूप से सीमित था।
“उन्नत तर्क और एजेंटिक वर्कफ़्लो के उद्देश्य से निर्मित, जेम्मा 4 प्रति-पैरामीटर बुद्धिमत्ता का एक अभूतपूर्व स्तर प्रदान करता है। यह सफलता अविश्वसनीय सामुदायिक गति पर आधारित है: हमारी पहली पीढ़ी के लॉन्च के बाद से, डेवलपर्स ने जेम्मा को 400 मिलियन से अधिक बार डाउनलोड किया है, जिससे 100,000 से अधिक वेरिएंट का एक जीवंत जेम्मावर्स तैयार हुआ है,” Google डीपमाइंड में अनुसंधान के उपाध्यक्ष क्लेमेंट फ़राबेट कहते हैं।
एरिना एआई, एक सार्वजनिक, वेब-आधारित प्लेटफ़ॉर्म जो बड़े भाषा मॉडल (एलएलएम) का मूल्यांकन करता है, जेम्मा 4 के 31 बिलियन पैरामीटर मॉडल को जीएलएम -5 (1456 स्कोर) और किमी के 2.5 थिंकिंग 1453 स्कोर के बाद तीसरे नंबर (1452 का स्कोर) पर रखता है, जबकि 26 बिलियन पैरामीटर मॉडल छठे स्थान पर है (1441 स्कोर)। GLM-5 चीनी AI कंपनी Z.ai द्वारा बनाया गया है, जबकि किमी मॉडल चीनी कंपनी मूनशॉट AI द्वारा विकसित किया गया है। अगस्त में जारी OpenAI का gpt-oss-20b ओपन-वेट भाषा मॉडल, स्कोर 1318 है।
फ़राबेट का कहना है कि जेम्मा 4 अपने से 20 गुना बड़े मॉडल को मात देता है। जेम्मा 4 से टेक्स्ट, ऑडियो और छवि इनपुट, 140 से अधिक भाषाओं के लिए समर्थन और लंबी 128K और 256K तक की संदर्भ विंडो के साथ विभिन्न प्रकार के जेनरेटिव एआई कार्यों को हल करने की उम्मीद है। 31बी और 26बी पैरामीटर मॉडल एनवीडिया के एच100 सहित शक्तिशाली जीपीयू वाले उच्च-स्तरीय सर्वर के लिए डिज़ाइन किए गए हैं।
“26बी और 31बी मॉडल उच्च-प्रदर्शन तर्क और डेवलपर-केंद्रित वर्कफ़्लो के लिए डिज़ाइन किए गए हैं, जो उन्हें एजेंटिक एआई के लिए उपयुक्त बनाते हैं। अत्याधुनिक, सुलभ तर्क देने के लिए अनुकूलित, ये मॉडल एनवीडिया आरटीएक्स जीपीयू और डीजीएक्स स्पार्क पर कुशलतापूर्वक चलते हैं – विकास वातावरण, कोडिंग सहायक और एजेंट-संचालित वर्कफ़्लो को सशक्त बनाते हैं,” एनवीडिया के उत्पाद प्रबंधक माइकल फुकुयामा कहते हैं।
E2B और E4B मॉडल के 2 बिलियन और 4 बिलियन पैरामीटर फ़ुटप्रिंट, रैम और बैटरी जीवन को संरक्षित करने के अनुकूलन के साथ, मोबाइल उपकरणों पर जेम्मा 4 की उपयोगिता के लिए महत्वपूर्ण होंगे। एनवीडिया पुष्टि करता है कि जेटसन ओरिन नैनो जेम्मा 4 ई2बी और ई4बी वेरिएंट का समर्थन करता है, जो जेटसन प्लेटफॉर्म पर जेटसन थॉर तक समान मॉडल परिवार स्केलिंग के साथ, छोटे, एम्बेडेड और पावर-बाधित सिस्टम पर मल्टीमॉडल अनुमान को सक्षम बनाता है।
(टैग्सटूट्रांसलेट)जेम्मा 4(टी)गूगल(टी)एआई(टी)बड़े भाषा मॉडल(टी)एआई प्रसंस्करण इंजन(टी)उन्नत तर्क




