एंथ्रोपिक ने क्लाउड फैबल 5 जारी किया: सुरक्षा रेलिंग के साथ पहला मिथोस-क्लास यूनिवर्सल मॉडल
एंथ्रोपिक ने माइथोस-क्लास मॉडल क्लाउड फैबल 5 (सुरक्षा रेलिंग के साथ सार्वभौमिक संस्करण) और माइथोस 5 (साइबर रक्षा अप्रतिबंधित संस्करण) जारी किया। $10/$50/मिलियन टोकन की कीमत पर, स्ट्राइप एक दिन में दो महीने का काम पूरा कर सकता है, और इवोज़िन की दवा डिजाइन 10 गुना तेज हो जाती है।
एंथ्रोपिक ने आधिकारिक तौर पर अब तक का सबसे शक्तिशाली क्लाउड मॉडल जारी किया है: क्लाउड फैबल 5 पहला मिथोस-स्तरीय मॉडल (सुरक्षा रेलिंग के साथ) है जो सामान्य उपयोगकर्ताओं के लिए खुला है। यह सॉफ्टवेयर इंजीनियरिंग, ज्ञान कार्य, दृष्टि, वैज्ञानिक अनुसंधान आदि के क्षेत्र में लगभग सभी परीक्षण बेंचमार्क पर SOTA तक पहुंचता है। कार्य जितना अधिक जटिल और लंबा होगा, नेतृत्व उतना ही अधिक स्पष्ट होगा। क्लाउड माइथोस 5 एक ऐसा संस्करण है जिसमें कोई सुरक्षा रेलिंग नहीं है और यह केवल प्रोजेक्ट ग्लासविंग के माध्यम से साइबर रक्षा संगठनों के लिए उपलब्ध है। सुरक्षा क्लासिफायर का एक उन्नत संस्करण एक साथ लॉन्च किया गया था, जिसने आधिकारिक परीक्षणों के अनुसार 95% खतरनाक वैक्टर को समाप्त कर दिया। मूल्य निर्धारण $10/$50 प्रति मिलियन टोकन।
ऑनलाइन मूल्यांकन (चैटबॉट एरिना): फैबल 5 सभी श्रेणियों में पहले स्थान पर है, दूसरे स्थान से आगे 70 ईएलओ - जीपीटी-5.4 से जीपीटी-5.5 के अंतर के बराबर। जीत की दर 86% तक है, और टाई और मैच जीतने की दर 96% है। प्रोग्रामिंग क्षमता ईएलओ 1794 तक पहुंच गई, कोडिंग शैली कार्य स्कोर 96.8 है।
मूल्य निर्धारण: इनपुट $10/मिलियन टोकन, आउटपुट $50/मिलियन टोकन।
सुरक्षा रेलिंग डिजाइन
माइथोस-स्तरीय मॉडल की क्षमताएं जोखिमों के साथ आती हैं - साइबर सुरक्षा जैसे क्षेत्रों में फैबल 5 की क्षमताओं का दुर्भावनापूर्ण उद्देश्यों के लिए उपयोग किया जा सकता है। इसलिए, एंथ्रोपिक ने फैबल 5 के लिए गार्ड क्लासिफायर (गार्ड क्लासिफायर) तैनात किए, और कुछ श्रेणियों के लिए प्रश्नों को क्लाउड ओपस 4.8 द्वारा नियंत्रित किया जाएगा। इन सुरक्षा रेलिंगों को रूढ़िवादी बनाया गया है - जो औसतन 5% से भी कम सत्रों में ट्रिगर होती हैं।
उन्नत सुरक्षा क्लासिफायरियर
92% से अधिक सौम्य संकेतों की उत्तीर्ण दर को बनाए रखते हुए, नया क्लासिफायरियर आधिकारिक परीक्षण डेटा में 95% हानिकारक वैक्टर को समाप्त कर सकता है, जो 60% के पिछले स्तर से एक महत्वपूर्ण सुधार है। एआई सिक्योरिटी इंस्टीट्यूट (एआईएसआई) ने स्वतंत्र रूप से आकलन किया कि यह पर्याप्त रूप से मजबूत है।
मिथोस 5 + प्रोजेक्ट ग्लासविंग
मिथोस 5, जो फ़ेबल 5 के समान ही है लेकिन सुरक्षा रेलिंग को हटा देता है, प्रोजेक्ट ग्लासविंग साझेदारी कार्यक्रम के माध्यम से केवल कुछ मुट्ठी भर साइबर रक्षा संगठनों और बुनियादी ढांचा प्रदाताओं के लिए उपलब्ध है। एंथ्रोपिक को अमेरिकी सरकार के साथ साझेदारी में तैनात किया जाएगा।
व्यावहारिक अनुप्रयोग मामले
- पट्टी: दो महीने का पारंपरिक काम एक दिन में पूरा किया (पहली बार, "अत्यधिक क्षमता" के कारण आंतरिक सुरक्षा अलार्म चालू हो गया था)
- इवोज़ीन ड्रग डिज़ाइन: नए प्रोटीन को 10 गुना तेज़ी से डिज़ाइन करें
क्लाउड फैबल 5 एंथ्रोपिक का अब तक का सबसे मौलिक मॉडल रिलीज़ है। माइथोस-स्तरीय क्षमताएं "सुरक्षा क्लासिफायर" डाउनग्रेड तंत्र के माध्यम से बाहरी दुनिया तक सार्वभौमिक पहुंच प्रदान करती हैं, जबकि अप्रतिबंधित संस्करण को नेटवर्क रक्षा परिदृश्यों तक सीमित करती हैं - यह "क्षमता वर्गीकरण" रणनीति अत्याधुनिक एआई तैनाती के लिए एक नए प्रतिमान का प्रतिनिधित्व करती है। स्ट्राइप के दो महीने का काम एक ही दिन में पूरा करने और एवोज़ाइन की दवा डिज़ाइन की गति 10 गुना बढ़ने के वास्तविक मामले बताते हैं कि एंटरप्राइज़-स्तरीय प्रोग्रामिंग और दवा विकास में एआई की क्षमताएं तेजी से "प्रतिस्थापन स्तर" के करीब पहुंच रही हैं।
वर्तमान में
अनुवर्ती कार्रवाई के योग्य दिशा-निर्देश:
- गार्ड क्लासिफायर का वास्तविक प्रदर्शन: वास्तविक उत्पादन परिदृश्यों में 5% ट्रिगर दर की स्वीकार्यता
- प्रोजेक्ट ग्लासविंग का विस्तार: क्या मिथोस 5 तक पहुंच का विस्तार किया जाएगा?
- निर्यात नियंत्रण प्रभाव: मॉडलों के क्लाउड परिवार तक वैश्विक पहुंच पर अमेरिकी सरकार के निर्यात नियंत्रण का वास्तविक प्रभाव
समीक्षाएं