पत्र कली
मुफ्त
जेम्मा जेमिनी शोध परिणामों के आधार पर Google DeepMind द्वारा जारी की गई एक ओपन सोर्स लाइटवेट
जेम्मा - Google की ओपन सोर्स लाइटवेट बड़ी भाषा मॉडल श्रृंखला
मुख्य पैरामीटर और आँकड़े
| पैरामीटर्स | विवरण |
|---|---|
| नवीनतम संस्करण | जेम्मा 2 (2बी/9बी/27बी) |
| रिलीज की तारीख | 2024-06-27 |
| लाइसेंस | अपाचे 2.0 (व्यावसायिक उपयोग के लिए पूरी तरह से खुला, कोई मासिक गतिविधि सीमा नहीं) |
| प्रसंग विंडो | 8192 टोकन (जेम्मा 2) |
| प्रौद्योगिकी स्रोत | जेमिनी अनुसंधान परिणामों के आधार पर, ज्ञान आसवन प्रौद्योगिकी का उपयोग करना |
| रिलीज़ चैनल | हगिंगफेस, कागल, गूगल क्लाउड वर्टेक्स एआई |
| वेरिएंट मॉडल | कोडजेम्मा (कोड), पालीजेम्मा (दृश्य भाषा), रिकरंटजेम्मा |
| परिमाणीकरण समर्थन | GGUF, GPTQ, AWQ और अन्य मुख्यधारा परिमाणीकरण प्रारूप |
| अनुमान रूपरेखा | हगिंगफेस ट्रांसफॉर्मर्स, llama.cpp, ओलामा, vLLM |
| गूगल कोलाब समर्थन | मुफ़्त कोलाब नोटबुक, जेम्मा को सीधे ब्राउज़र में चलाएँ |
जेम्मा और लामा के बीच मुख्य अंतर लाइसेंस है: जेम्मा अपाचे 2.0 (कोई उपयोगकर्ता आकार सीमा नहीं, वास्तव में पूरी तरह से खुला स्रोत) का उपयोग करता है, जबकि लामा 3 के मेटा लामा लाइसेंस को 700 मिलियन मासिक सक्रिय उपयोगकर्ताओं से अधिक होने के बाद विशेष लाइसेंस की आवश्यकता होती है। बढ़ते व्यावसायिक अनुप्रयोगों के लिए, जेम्मा का अपाचे 2.0 लाइसेंस और भी अधिक चिंता मुक्त कानूनी सुरक्षा प्रदान करता है।
उपयोगकर्ता और बाज़ार की पहचान
फरवरी 2024 में रिलीज़ होने के बाद से, जेम्मा ने हगिंगफेस पर डाउनलोड में वृद्धि जारी रखी है, जो लामा श्रृंखला के बाद दूसरा सबसे लोकप्रिय ओपन सोर्स एलएलएम परिवार बन गया है। Google का शक्तिशाली डेवलपर पारिस्थितिकी तंत्र (कागल, कोलाब, Google क्लाउड) जेम्मा को एक अद्वितीय वितरण चैनल प्रदान करता है। बड़ी संख्या में डेटा वैज्ञानिकों और कागल प्रतियोगिता प्रतिभागियों के पास एक परिचित मंच के माध्यम से जेम्मा तक पहुंच है, जिससे तेजी से बढ़ता उपयोगकर्ता आधार बनता है।
जेम्मा 2 27B LMSys Chatbot Arena की ब्लाइंड टेस्ट रैंकिंग में GPT-4 टर्बो के करीब पहुंच गया। इस बेंचमार्क परिणाम ने खुले स्रोत समुदाय में व्यापक ध्यान आकर्षित किया और साबित किया कि पैरामीटर-कुशल छोटे मॉडल ज्ञान आसवन के माध्यम से मापदंडों की अपेक्षित संख्या से कहीं अधिक प्रदर्शन स्तर प्राप्त कर सकते हैं। कोडजेम्मा और पालीजेम्मा जैसे पेशेवर वेरिएंट के लॉन्च से जेम्मा पारिस्थितिकी तंत्र के एप्लिकेशन परिदृश्य कवरेज का और विस्तार होता है।
लागत लाभ
| विधि | कीमत | मुख्य लागू परिदृश्य | विशेषताएँ |
|---|---|---|---|
| स्थानीय तैनाती | हार्डवेयर लागत (एकमुश्त) | गोपनीयता अनुप्रयोग, विकास प्रयोग | अपाचे 2.0, कोई व्यावसायिक प्रतिबंध नहीं |
| गूगल क्लाउड वर्टेक्स एआई | टोकन द्वारा बिलिंग (मिथुन मूल्य निर्धारण प्रणाली) | एंटरप्राइज एपीआई एकीकरण | Google क्लाउड के साथ गहन एकीकरण |
| हगिंगफेस अनुमान | मुफ़्त (सीमित) या PRO योजना | हल्के ऐप परीक्षण | आरंभ करने के लिए सबसे तेज़, किसी स्थानीय GPU की आवश्यकता नहीं |
| कागल नोटबुक | मुफ़्त (जीपीयू शामिल) | डेटा विज्ञान प्रयोग | कागल उपयोगकर्ताओं के लिए शून्य-लागत पहुंच |
जेम्मा 2 2बी का परिमाणित संस्करण मुश्किल से सीपीयू पर चल सकता है और मैकबुक (एम चिप) या आरटीएक्स 3060 पर आसानी से चलता है। यह "एआई मॉडल जो लैपटॉप पर चलाया जा सकता है" के बीच सबसे शक्तिशाली विकल्पों में से एक है। जेम्मा 2बी/9बी की हार्डवेयर आवश्यकताओं के परिणामस्वरूप ए100 की आवश्यकता वाले बड़े पैमाने के मॉडल की तुलना में विकास लागत काफी कम हो जाती है।
मुख्य कार्य
- जेम्मा 2 मल्टी-स्केल प्री-ट्रेनिंग मॉडल (बेस): निर्देश फाइन-ट्यूनिंग के बिना एक बुनियादी प्री-ट्रेनिंग मॉडल प्रदान करता है, जो शोधकर्ताओं के लिए विशिष्ट कार्यों या क्षेत्रों में सेकेंडरी फाइन-ट्यूनिंग करने के लिए उपयुक्त है। 2बी/9बी/27बी के तीन पैमाने टर्मिनल-साइड परिनियोजन से लेकर उच्च-प्रदर्शन सर्वर तक विभिन्न कंप्यूटिंग पावर परिदृश्यों को कवर करते हैं।
- जेम्मा 2 इंस्ट्रक्शन फाइन-ट्यून संस्करण (निर्देश): निर्देशों के पालन और सुरक्षित संरेखण के साथ प्रशिक्षित एक संवादात्मक संस्करण। इसका उपयोग बॉक्स से बाहर चैट सहायकों और प्रश्नोत्तर अनुप्रयोगों में किया जा सकता है। यह अतिरिक्त फाइन-ट्यूनिंग के बिना उच्च गुणवत्ता वाली प्राकृतिक भाषा इंटरैक्शन क्षमताएं प्राप्त कर सकता है।
- ज्ञान आसवन अनुकूलन की अल्ट्रा-उच्च पैरामीटर दक्षता: जेम्मा 2 बड़े पैमाने के जेमिनी मॉडल (जेमिनी से 27बी डिस्टिल्ड, 27बी से 9बी/2बी डिस्टिल्ड) से पैरामीटर दक्षता प्राप्त करके समान पैरामीटर स्केल में महत्वपूर्ण रूप से अग्रणी बेंचमार्क परीक्षण परिणाम प्राप्त करता है। यह "आसवन श्रृंखला" रणनीति जेम्मा श्रृंखला का मुख्य तकनीकी नवाचार है।
- कोडजेम्मा (कोड-विशिष्ट संस्करण): एक जेम्मा संस्करण विशेष रूप से कोड पूर्णता, कोड निर्माण और गणितीय तर्क के लिए अनुकूलित है। यह दो विशिष्टताएँ प्रदान करता है: 2बी (कोड भरना) और 7बी (निर्देश संस्करण)। कोड कार्यों का प्रदर्शन समान पैमाने के सामान्य जेम्मा मॉडल से बेहतर है।
- पालीजेम्मा (दृश्य भाषा मल्टी-मोडल संस्करण): एक मल्टी-मोडल जेम्मा वेरिएंट जो छवि समझ का समर्थन करता है। यह छवियों और पाठ के मिश्रित इनपुट को संभाल सकता है, छवि विवरण, दृश्य प्रश्न उत्तर और दस्तावेज़ समझने के कार्य कर सकता है। यह Google के हल्के मल्टी-मॉडल ओपन सोर्स मॉडल का प्रतिनिधि है।
- अपाचे 2.0 अप्रतिबंधित वाणिज्यिक लाइसेंस: सभी जेम्मा मॉडल अपाचे 2.0 लाइसेंस का पालन करते हैं और उपयोगकर्ताओं की संख्या या आय पर कोई प्रतिबंध नहीं होने के साथ, किसी भी आकार के वाणिज्यिक उत्पादों में स्वतंत्र रूप से उपयोग, संशोधित और वितरित किया जा सकता है। यह सबसे उदार ओपन सोर्स एलएलएम वाणिज्यिक लाइसेंसों में से एक है।
- Google Colab शून्य-कॉन्फ़िगरेशन अनुभव: Google Gemma के लिए एक आधिकारिक Colab नोटबुक प्रदान करता है। उपयोगकर्ता जेम्मा को स्थानीय जीपीयू के बिना सीधे ब्राउज़र में चला सकते हैं। यह एआई शिक्षार्थियों और डेटा वैज्ञानिकों के लिए जेम्मा का अनुभव करने का सबसे निचला प्रवेश बिंदु है।
- कागल पारिस्थितिक गहन एकीकरण: जेम्मा कागल मंच में गहराई से एकीकृत है और कागल प्रतियोगिताओं में भागीदारी का समर्थन करती है और
नोटबुक में सीधी कॉल और डेटा विज्ञान समुदाय के लिए एक अद्वितीय वितरण चैनल एक अद्वितीय स्थान बनाता है जो जेम्मा को अन्य ओपन सोर्स एलएलएम से अलग करता है।
मॉडल और संस्करण विकास
| संस्करण | रिलीज की तारीख | विवरण |
|---|---|---|
| जेम्मा 1.0 (2बी/7बी) | 2024-02-21 | Google की पहली जेम्मा रिलीज़, मूल संस्करण + कमांड संस्करण, अपाचे 2.0 लाइसेंस |
| कोडजेम्मा (2बी/7बी) | 2024-04-09 | कोड-विशिष्ट वेरिएंट, कोड भरना और पीढ़ी अनुकूलन |
| जेम्मा 1.1 (2बी/7बी अद्यतन संस्करण) | 2024-04-05 | आदेश गुणवत्ता सुधार का पालन करते हैं, संस्करण 1.0 में संवाद समस्याओं को ठीक करते हैं |
| रिकरंटजेम्मा (2बी/9बी) | 2024-04 | रैखिक पुनरावर्ती वास्तुकला पर आधारित कुशल अनुमान संस्करण, किनारे वाले उपकरणों के लिए उपयुक्त |
| पालीजेम्मा (3बी मल्टी-मोडल) | 2024-05 | छवि समझ कार्यों का समर्थन करने के लिए दृश्य भाषा मॉडल |
| जेम्मा 2 (2बी/9बी/27बी) | 2024-06-27 | दूसरी पीढ़ी, ज्ञान आसवन अनुकूलन, प्रदर्शन में काफी सुधार, 27B GPT-4 टर्बो के करीब है |
| जेम्मा 2 जेटब्रेन/ओलामा | 2024-08 | मुख्यधारा के आईडीई और स्थानीय अनुमान उपकरण जेम्मा 2 का समर्थन करते हैं, और पारिस्थितिकी तंत्र का विस्तार जारी है |
तकनीकी लाभ
ज्ञान आसवन श्रृंखला द्वारा लाई गई अल्ट्रा-उच्च पैरामीटर दक्षता: जेम्मा 2 का तकनीकी मूल बहु-स्तरीय ज्ञान आसवन है - 27बी बड़े मिथुन से आसुत है, और 9बी और 2बी 27बी से आसुत हैं। यह आसवन श्रृंखला जेम्मा 2 मॉडल के प्रत्येक आकार को उसके पैरामीटर आकार से कहीं अधिक प्रदर्शन स्तर प्राप्त करने में सक्षम बनाती है। यह तकनीकी कारण है कि जेम्मा 2 9बी ने हगिंगफेस ओपन एलएलएम लीडरबोर्ड पर लामा 3 70बी को पीछे छोड़ दिया, और मॉडल संपीड़न और ज्ञान हस्तांतरण के क्षेत्र में Google डीपमाइंड के अग्रणी शोध परिणामों को दर्शाता है।
अपाचे 2.0 का सबसे ढीला वाणिज्यिक लाइसेंस: लामा के मेटा लामा लाइसेंस (700 मिलियन से अधिक एमएयू के लिए विशेष प्राधिकरण की आवश्यकता है) की तुलना में, जेम्मा के अपाचे 2.0 लाइसेंस के किसी भी व्यावसायिक उपयोग पर कोई प्रतिबंध नहीं है। डेवलपर्स और उद्यम जेम्मा को किसी भी पैमाने के वाणिज्यिक उत्पादों में एकीकृत कर सकते हैं, जैसे-जैसे व्यवसाय बढ़ता है, लाइसेंस प्रतिबंध शुरू होने की चिंता किए बिना, ओपन सोर्स एलएलएम का उपयोग करने वाले उद्यमों के कानूनी अनुपालन जोखिमों को कम किया जा सकता है।
गूगल इन्फ्रास्ट्रक्चर के साथ कड़ा एकीकरण: जेम्मा गूगल क्लाउड, वर्टेक्स एआई, कोलाब और कागल के लिए एक मूल समर्थन मॉडल है, जिसमें इन प्लेटफार्मों पर इष्टतम पहुंच और टूल समर्थन है। उन उद्यमों के लिए जिन्होंने अपने क्लाउड इंफ्रास्ट्रक्चर के लिए Google क्लाउड को अपनाया है, जेम्मा का उपयोग Google पारिस्थितिकी तंत्र के साथ सबसे गहरा एकीकरण प्रदान करता है, जिसमें वर्टेक्स एआई की प्रबंधित फाइन-ट्यून मॉडल रजिस्ट्री और सुरक्षा निगरानी क्षमताएं शामिल हैं।
छोटे पैमाने पर उच्च-प्रदर्शन अंत-साइड परिनियोजन मूल्य: जेम्मा 2 2बी वर्तमान में सबसे अच्छा प्रदर्शन करने वाले 2बी पैरामीटर-स्केल ओपन सोर्स मॉडल में से एक है। यह स्थानीय रूप से मध्यम-कॉन्फ़िगरेशन एंड्रॉइड फोन (Google एआई एज फ्रेमवर्क के साथ) पर चल सकता है और एंड-साइड एआई अनुप्रयोगों (ऑफ़लाइन वॉयस असिस्टेंट, गोपनीयता सुरक्षा डिवाइस-साइड प्रोसेसिंग इत्यादि) के लिए व्यावहारिक स्थानीय एलएलएम क्षमताएं प्रदान करता है। यह लामा (न्यूनतम 8बी) की तुलना में जेम्मा का एक महत्वपूर्ण विभेदक लाभ है।
कैसे उपयोग करें
| प्रवेश | विवरण |
|---|---|
| आलिंगन चेहरा | मॉडल तक पहुंच का अनुरोध करने और डाउनलोड करने के लिए https://huggingface.co/google/gemma-2-9b पर जाएं |
| कागल | जीपीयू एक्सेलेरेशन सहित कागल नोटबुक में जेम्मा का निःशुल्क उपयोग करें |
| गूगल कोलाब | स्थानीय GPU के बिना चलाने के लिए Google की आधिकारिक Colab नोटबुक का उपयोग करें |
| ओलामा (स्थानीय) | ओलामा रन जेम्मा2:9बी एक-क्लिक स्थानीय परिनियोजन |
| वर्टेक्स एआई | Google क्लाउड वर्टेक्स एआई के माध्यम से जेम्मा एपीआई सेवा तक पहुंचें |
विशिष्ट उपयोग चरण (हगिंगफेस जेम्मा 2 से जुड़ा):
- https://huggingface.co/google/gemma-2-9b पर जाएं, अपने HuggingFace खाते में लॉग इन करें और उपयोग अनुबंध स्वीकार करें (Apache 2.0, कोई अतिरिक्त प्रतिबंध नहीं)।
- निर्भरताएँ स्थापित करें:
पिप इंस्टाल ट्रांसफार्मर त्वरित करें। - मॉडल को लोड करने के लिए हगिंगफेस ट्रांसफॉर्मर का उपयोग करें:
ट्रांसफार्मर से ऑटोटोकनाइज़र, ऑटोमॉडलफॉरकॉसलएलएम आयात करें। - टोकनाइज़र और मॉडल को लोड करें (9B मॉडल को चलाने के लिए कम से कम 20GB वीडियो मेमोरी की आवश्यकता होती है, 2B लगभग 6GB है), या वीडियो मेमोरी आवश्यकताओं को कम करने के लिए मात्राबद्ध संस्करण का उपयोग करें।
- अनुमान कोड लिखें और टेक्स्ट जेनरेट करने के लिए
model.generate()का उपयोग करें। जेम्मा कमांड संस्करण<start_of_turn>user ... <end_of_turn>वार्तालाप प्रारूप का अनुसरण करता है। - यदि फाइन-ट्यूनिंग की आवश्यकता है, तो मापदंडों की कुशल फाइन-ट्यूनिंग के लिए हगिंगफेस टीआरएल + लोआरए का उपयोग करने की अनुशंसा की जाती है।
उत्पाद का मूल्य निर्धारण
जेम्मा मॉडल वेट पूरी तरह से मुफ़्त हैं, और प्रत्येक प्लेटफ़ॉर्म का उपयोग करने की लागत अलग है:
- मॉडल वेट डाउनलोड: पूरी तरह से मुफ़्त, अपाचे 2.0 लाइसेंस, कोई व्यावसायिक प्रतिबंध नहीं, सीधे हगिंगफेस या कागल से डाउनलोड किया जा सकता है, किसी विशेष एप्लिकेशन की आवश्यकता नहीं है।
- स्थानीय परिनियोजन: केवल हार्डवेयर लागत, जेम्मा 2 2बी आरटीएक्स 3060 (12जीबी) पर आसानी से चलता है, 9बी के लिए आरटीएक्स 3090 (24जीबी) या मल्टी-कार्ड परिनियोजन की आवश्यकता होती है।
- कागल नोटबुक: कागल मुक्त खाता सीमित जीपीयू कोटा (लगभग 30 घंटे/सप्ताह टी4 जीपीयू) प्रदान करता है, जो जेम्मा प्रयोग चला सकता है और शून्य लागत पर आरंभ कर सकता है।
- Google Colab: मुफ़्त संस्करण सीमित GPU उपयोग प्रदान करता है, और Colab Pro (लगभग $10/माह) अधिक GPU संसाधन प्रदान करता है और मध्यम-स्तरीय प्रयोगों के लिए उपयुक्त है।
- गूगल क्लाउड वर्टेक्स एआई: वाणिज्यिक एपीआई सेवाओं का बिल टोकन द्वारा किया जाता है। विशिष्ट कीमतों के लिए, कृपया Google क्लाउड आधिकारिक मूल्य पृष्ठ देखें। यह एंटरप्राइज़-स्तरीय अनुप्रयोगों के लिए प्रबंधित अनुमान सेवाएँ प्रदान करता है।
अनुप्रयोग परिदृश्य
-
मोबाइल और एज डिवाइस एआई फ़ंक्शंस: जेम्मा 2 2बी का कॉम्पैक्ट डिज़ाइन एंड-साइड परिनियोजन के लिए अनुकूलित है। यह Google AI Edge फ्रेमवर्क के माध्यम से मध्य-से-उच्च-अंत एंड्रॉइड डिवाइस पर स्थानीय रूप से चल सकता है। यह ऑफ़लाइन बुद्धिमान सहायकों, वास्तविक समय पाठ प्रसंस्करण और गोपनीयता-सुरक्षा डिवाइस-साइड एनएलपी कार्यों का समर्थन करता है। यह उन मोबाइल एप्लिकेशन के लिए पसंदीदा ओपन सोर्स समाधान है जिनके लिए ऑफ़लाइन AI क्षमताओं की आवश्यकता होती है।
-
सीमित संसाधनों के साथ एआई परिनियोजन: एम्बेडेड सिस्टम, एज सर्वर और कम-कंप्यूटिंग क्लाउड इंस्टेंसेस में एआई एप्लिकेशन सीमित जीपीयू मेमोरी (8-16 जीबी) के भीतर व्यावहारिक पाठ पीढ़ी और प्रश्न-उत्तर क्षमता प्रदान करने के लिए जेम्मा 2बी/9बी क्वांटाइज्ड मॉडल का उपयोग करते हैं। हार्डवेयर स्थितियाँ सीमित होने पर AI क्षमताओं को अधिकतम करने के लिए यह एक आदर्श विकल्प है।
-
छात्रों और शोधकर्ताओं के लिए एआई लर्निंग प्रयोग: कागल नोटबुक (मुफ्त जीपीयू) के माध्यम से जेम्मा तक पहुंच, डेटा विज्ञान के छात्र शून्य लागत पर संपूर्ण एलएलएम फाइन-ट्यूनिंग, मूल्यांकन और तैनाती प्रक्रिया का अनुभव कर सकते हैं। अपाचे 2.0 लाइसेंस यह सुनिश्चित करता है कि अकादमिक शोध परिणामों को स्वतंत्र रूप से प्रकाशित और व्यावसायीकरण किया जा सकता है, जो इसे एआई शिक्षा के लिए सबसे बाधा मुक्त ओपन सोर्स एलएलएम में से एक बनाता है।
-
Google क्लाउड उद्यमों के लिए AI एकीकरण: जिन उद्यमों ने Google क्लाउड को अपनाया है, वे Google बुनियादी ढांचे, प्रबंधित फाइन-ट्यूनिंग सेवा मॉडल रजिस्ट्री संस्करण प्रबंधन और एंटरप्राइज़-ग्रेड सुरक्षा अनुपालन क्षमताओं के साथ गहन एकीकरण का आनंद लेने के लिए वर्टेक्स AI पर जेम्मा का उपयोग करते हैं, जो Google क्लाउड की इंजीनियरिंग विश्वसनीयता के साथ ओपन सोर्स मॉडल के लागत लाभ का संयोजन करते हैं।
-
कोड-सहायता उपकरण विकास: निजीकृत कोड पूर्णता और कोड समीक्षा टूल बनाने, उन्हें स्थानीय या इंट्रानेट पर तैनात करने और GitHub Copilot जैसी क्लाउड सेवाओं के माध्यम से कोड ट्रांसमिशन से बचने के लिए CodeGemma 7B का उपयोग करें। अपाचे 2.0 लाइसेंस यह सुनिश्चित करता है कि कोड टूल का स्वतंत्र रूप से व्यावसायीकरण किया जा सकता है, जो बौद्धिक संपदा संरक्षण आवश्यकताओं वाली सॉफ्टवेयर कंपनियों के लिए उपयुक्त है।
लागू लोग
- डेटा वैज्ञानिक और कागल प्रतियोगिता के प्रतिभागी: कागल प्लेटफॉर्म का गहरा एकीकरण और मुफ्त जीपीयू एक्सेस जेम्मा को इस समूह के लिए एक स्वाभाविक पसंद बनाता है, जो मौजूदा वर्कफ़्लो में सहजता से फिट बैठता है।
- मोबाइल और क्लाइंट-साइड एआई डेवलपर्स: एंड्रॉइड डेवलपर्स के लिए जिन्हें डिवाइस पर एलएलएम चलाने की आवश्यकता है, जेम्मा 2बी और Google एआई एज का संयोजन वर्तमान में सबसे परिपक्व क्लाइंट-साइड एलएलएम विकास समाधान है।
- अपाचे 2.0 लाइसेंस की आवश्यकता वाले उद्यम: उन उद्यमों के लिए जिनके पास लामा के मेटा लामा लाइसेंस के बारे में कानूनी चिंताएं हैं और उन्हें अधिक आरामदायक ओपन सोर्स लाइसेंस की आवश्यकता है, अपाचे 2.0 के लिए जेम्मा चिंता मुक्त व्यावसायिक उपयोग की गारंटी प्रदान करता है।
- Google क्लाउड उपयोगकर्ता: जिन टीमों ने Google क्लाउड बुनियादी ढांचे को तैनात किया है, वे सर्वोत्तम एकीकरण अनुभव और एंटरप्राइज़-ग्रेड समर्थन प्राप्त करने के लिए वर्टेक्स एआई पर जेम्मा का उपयोग कर सकते हैं।
- अनुपयुक्त परिदृश्य: ऐसे अनुप्रयोग जिनके लिए अल्ट्रा-लॉन्ग संदर्भ प्रसंस्करण (>8K टोकन) की आवश्यकता होती है (जेम्मा 2 संदर्भ विंडो अपेक्षाकृत छोटी है, लामा 3.1 का 128K अधिक उपयुक्त है); उत्पादन-स्तर के अनुप्रयोग जिनके लिए उच्चतम प्रदर्शन की आवश्यकता होती है (जेम्मा 27बी समान पैमाने के प्रतिस्पर्धी उत्पादों की तुलना में अधिक मजबूत है, लेकिन लामा 3.1 405बी या जीपीटी-4 की तुलना में अभी भी एक अंतर है); ऐसी टीमें जिनके पास पहले से ही एक स्थिर लामा प्रौद्योगिकी स्टैक है और उनके पास प्रवास करने की कोई प्रेरणा नहीं है।
सारांश और आउटलुक
जेम्मा श्रृंखला ओपन सोर्स एआई के क्षेत्र में Google के रणनीतिक लेआउट का प्रतिनिधित्व करती है - जेमिनी के शीर्ष शोध परिणामों को ओपन लाइसेंस के रूप में डेवलपर समुदाय को जारी करके, यह न केवल एआई की लोकप्रियता को बढ़ावा देता है, बल्कि बड़ी संख्या में डेवलपर्स को Google पारिस्थितिकी तंत्र (क्लाउड, कोलाब, कागल) में भी आकर्षित करता है। ज्ञान आसवन श्रृंखला द्वारा लाई गई अल्ट्रा-हाई पैरामीटर दक्षता जेम्मा का सबसे महत्वपूर्ण तकनीकी भेदभाव बिंदु है, जो छोटे पैमाने के मॉडल को पैरामीटर स्केल के अपेक्षित प्रदर्शन से अधिक प्रदर्शन करने में सक्षम बनाती है।
अपाचे 2.0 लाइसेंस का चुनाव ओपन सोर्स समुदाय के प्रति Google की ईमानदार प्रतिबद्धता को दर्शाता है। यह मेटा के लामा लाइसेंस की तुलना में अधिक खुला है, जो उद्यम बाजार में एक अनूठा लाभ बनाता है जो कानूनी अनुपालन के प्रति संवेदनशील है।
अनुवर्ती फोकस: जेम्मा 3 श्रृंखला के पैरामीटर स्केल विस्तार और मल्टी-मोडल क्षमता वृद्धि (दृश्य, ऑडियो), पालीजेम्मा विज़ुअल भाषा मॉडल का कार्यात्मक विकास, Google एआई एज के डिवाइस-साइड परिनियोजन पारिस्थितिकी तंत्र की पूर्णता, और जेमिनी नैनो (डिवाइस-साइड जेमिनी) के साथ इसकी विभेदित स्थिति ओपन सोर्स एलएलएम प्रतियोगिता परिदृश्य में जेम्मा की दीर्घकालिक स्थिति निर्धारित करेगी।
संबंधित टूल: <एक्सलिंक टाइप='टूल' स्लग='हगिंग-फेस'>, <एक्सलिंक टाइप='टूल' स्लग='रेप्लिकेट'>
संस्करण जानकारी
- जेम्मा 2(2बी/9बी/27बी) :जेम्मा 2 आधिकारिक तौर पर 2बी, 9बी और 27बी के तीन पैरामीटर आकारों के साथ जारी किया गया है। यह बड़े मॉडल क्षमताओं को छोटे मॉडलों में संपीड़ित करने के लिए ज्ञान आसवन तकनीक का उपयोग करता है। LMSys Chatbot Arena जैसे मुख्यधारा के बेंचमार्क परीक्षणों में, जेम्मा 2 27B GPT-4 टर्बो स्तर के करीब है, और 9B संस्करण समान पैमाने के सभी ओपन सोर्स मॉडल से आगे निकल जाता है। सभी संस्करण अपाचे 2.0 लाइसेंस का पालन करते हैं और व्यावसायिक उपयोग के लिए निःशुल्क हैं; एक ही समय में, हगिंगफेस, कागल और गूगल क्लाउड में तीन प्रमुख चैनल एक साथ जारी किए जाते हैं, जो पहुंच सीमा को बहुत कम कर देता है।
- जेम्मा 1.1 (2बी/7बी अद्यतन संस्करण) :जेम्मा 1.1 का अद्यतन संस्करण जारी किया गया। जेम्मा 1.0 में उपयोगकर्ताओं द्वारा रिपोर्ट की गई गुणवत्ता संबंधी समस्याओं के बाद निर्देश को संबोधित करने के लिए विशेष सुधार किए गए, और निर्देश संस्करण (इंस्ट्रक्ट) की संवाद क्षमताओं में काफी सुधार किया गया। उसी समय, CodeGemma (2B/7B कोड-विशिष्ट संस्करण) और RecurrentGemma (उच्च दक्षता तर्क संस्करण) को आधिकारिक तौर पर लॉन्च किया गया, जिससे Gemma मॉडल परिवार को कोड पीढ़ी जैसे पेशेवर परिदृश्यों तक विस्तारित किया गया।
- :Google ने पहली बार जेम्मा ओपन सोर्स मॉडल श्रृंखला जारी की, प्री-ट्रेनिंग संस्करण (बेस) और इंस्ट्रक्शन फाइन-ट्यूनिंग संस्करण (इंस्ट्रक्ट) को दो आकारों में लॉन्च किया: 2बी और 7बी। जेमिनी मॉडल अनुसंधान परिणामों के आसवन के आधार पर, इसने समान पैरामीटर पैमाने के ओपन सोर्स मॉडल बेंचमार्क परीक्षणों में अग्रणी परिणाम प्राप्त किए। यह तीन एक्सेस चैनल प्रदान करता है: हगिंगफेस, कागल और गूगल कोलाब, और एक जिम्मेदार एआई उपयोग टूलकिट जारी करता है।
उपयोगकर्ता समीक्षाएं