कल्पित 5 वैश्विक वापसी + जेलब्रेक गंभीरता स्कोरिंग ढांचा: एंथ्रोपिक एआई सुरक्षा "उद्योग सहयोग" को बढ़ावा देता है

एंथ्रोपिक ने 30 जून को घोषणा की कि फैबल 5 को 1 जुलाई को वैश्विक स्तर पर फिर से तैनात किया जाएगा। साथ ही, इसने "जेलब्रेक गंभीरता स्कोर" उद्योग ढांचे का प्रस्ताव रखा और अमेज़ॅन, माइक्रोसॉफ्ट और Google जैसे ग्लासविंग भागीदारों के साथ संयुक्त रूप से इसे बढ़ावा दिया, जो "प्रत्येक निर्माता द्वारा स्व-मूल्यांकन" से "उद्योग सहयोगी शासन" में अत्याधुनिक मॉडल सुरक्षा के बदलाव को दर्शाता है।

30 जून को, एंथ्रोपिक ने दो चीजों की घोषणा की: 1 जुलाई को फैबल 5 की वैश्विक पुन: तैनाती, और अधिक उद्योग भार के साथ एक कदम - एक स्कोरिंग जेलब्रेक गंभीरता ढांचे का प्रस्ताव और अमेज़ॅन, माइक्रोसॉफ्ट, Google और अन्य ग्लासविंग भागीदारों के साथ काम करना।

कल्पित 5 वापसी: सुरक्षा मूल्यांकन के बाद फिर से खोलना

फैबल 5 एंथ्रोपिक का अत्याधुनिक फ्लैगशिप मॉडल (2026 में जारी) है, जिसे पहले सुरक्षा कारणों से तैनाती से आंशिक रूप से वापस ले लिया गया था/प्रतिबंधित कर दिया गया था। इस पुन: तैनाती का मतलब है कि सुरक्षा मूल्यांकन के बाद इसे उपयोगकर्ताओं के लिए फिर से खोल दिया गया है - जो लोग एंथ्रोपिक मॉडल मैट्रिक्स का पालन करते हैं, उनके लिए यह एक महत्वपूर्ण संकेत है कि फैबल 5 "फ्लैगशिप उपलब्ध" स्थिति में वापस आ गया है, और 24 जुलाई को ओपस 5 को "आधी कीमत पर, फैबल 5 के करीब" रिलीज करने का मार्ग भी प्रशस्त किया है।

जेलब्रेक गंभीरता स्कोर: एक उद्योग-स्तरीय प्रस्ताव

प्रतिगमन से अधिक महत्वपूर्ण जेलब्रेक गंभीरता स्कोर ढांचा है। इसका मूल प्रश्न बहुत वास्तविक है: क्रॉस-वेंडर तुलना और प्रबंधन के लिए जेलब्रेक हमले की गंभीरता का निष्पक्ष मूल्यांकन कैसे करें? पहले, "जेलब्रेक कितना गंभीर है" पर प्रत्येक कंपनी की अलग-अलग राय थी और एक एकीकृत माप का अभाव था - जिससे सुरक्षा तुलना और नियामक आकलन पर चर्चा करना असंभव हो गया था। एंथ्रोपिक इस ढांचे को बढ़ावा देने में अग्रणी है, जो "एआई सुरक्षा" पर एक एकीकृत मानदंड स्थापित करने की कोशिश के समान है।

उद्योग के दृष्टिकोण से, यह 2026 में एआई सुरक्षा प्रशासन में एक महत्वपूर्ण घटना है: एंथ्रोपिक, अमेज़ॅन, माइक्रोसॉफ्ट और Google द्वारा गठित ग्लासविंग सहयोग अत्याधुनिक मॉडलों की सुरक्षा को "प्रत्येक निर्माता द्वारा स्व-मूल्यांकन" से "उद्योग सहयोगी शासन" की ओर ले जा रहा है। इस बदलाव का महत्व यह है कि जब सुरक्षा मूल्यांकन मानक एकीकृत हो जाएंगे, तो निर्माताओं के बीच सुरक्षा प्रतिस्पर्धा "आपस में बात करने" से "एक ही क्षेत्र में प्रतिस्पर्धा" में बदल जाएगी, और नियामक एजेंसियों के पास भी एक विश्वसनीय आधार होगा। एंथ्रोपिक, के पीछे की कंपनी ने इस समय उत्पाद संबंधी विचारों और 'सुरक्षा को परिभाषित करने के अधिकार' को जब्त करने के रणनीतिक इरादे दोनों के लिए, एक साथ 'मॉडल रिग्रेशन + मानक फॉर्मूलेशन' को बढ़ावा देने का विकल्प चुना है। घरेलू एआई सुरक्षा प्रशासन (जैसे बड़े मॉडल पंजीकरण और सुरक्षा मूल्यांकन मानकों) के लिए, इस ढांचे के विकास पर निरंतर ध्यान देने योग्य है - यह वैश्विक एआई सुरक्षा मूल्यांकन के लिए एक संदर्भ बेंचमार्क बनने की संभावना है।

भविष्य में ट्रैकिंग के लायक कई दिशाएँ:

  1. स्कोरिंग ढांचे के विशिष्ट आयाम: जेलब्रेक की गंभीरता को कैसे मापें और ग्रेड करें।
  2. ग्लासविंग सहयोग का निष्पादन: अमेज़ॅन, माइक्रोसॉफ्ट और Google एकीकृत मूल्यांकन कैसे लागू करते हैं।
  3. Fable 5 की वापसी के बाद प्रदर्शन: प्रमुख पुनर्नियोजन के बाद स्थिरता और उपयोग।
  4. घरेलू सुरक्षा मूल्यांकन मानकों के विरुद्ध बेंचमार्किंग: क्या बड़े मॉडल फाइलिंग इस गंभीरता ढांचे को संदर्भित करेंगे।
कॉपीराइट: सामग्री स्रोत मानवशास्त्रीय आधिकारिक समाचार । इस प्लेटफॉर्म ने सूचना प्रसार और सीखने के आदान-प्रदान के उद्देश्य से इस सामग्री को संकलित और व्यवस्थित किया है। कॉपीराइट संबंधी चिंताओं के लिए कृपया हमसे संपर्क करें।

समीक्षाएं

  • समीक्षाएं लोड हो रही हैं...