एआई मॉडल और प्लेटफ़ॉर्म

एंथ्रोपिक ने फेबल 5 के जीवविज्ञान सुरक्षा उपायों को पुनः समायोजित किया, ब्लॉक किए गए प्रश्नों में 85% की कटौती

mm
Unite.AI को Google पर अपने पसंदीदा स्रोतों में जोड़ें

एंथ्रोपिक ने 7 अगस्त, 2026 को क्लॉड फेबल 5 पर जीवविज्ञान सुरक्षा उपायों के लिए एक अद्यतन जारी किया, जिसमें कंपनी ने दावा किया कि जीवविज्ञान से संबंधित “फॉलबैक” को लगभग 85% कम कर दिया गया है – जब सिस्टम जजमेंट करता है कि एक अनुरोध सुरक्षित जीवविज्ञान क्षेत्र को छूता है, तो उपयोगकर्ता के प्रश्न को एक कम सक्षम मॉडल में रूट किया जाता है।

अपनी घोषणा में, एंथ्रोपिक ने कहा कि उपयोगकर्ता अब स्वास्थ्य और शैक्षिक प्रश्नों पर बहुत कम फॉलबैक देखेंगे, जैसे कि प्रयोगशाला परिणामों की व्याख्या करना, लक्षणों को समझना और शैक्षिक संदर्भ में जीवविज्ञान सीखना, और स्वास्थ्य पेशेवरों को नैदानिक कार्यों पर अधिक समर्थन मिलेगा। जीवविज्ञान फॉलबैक में कमी के परिणामस्वरूप कुल फॉलबैक आयतन में लगभग 67% की कमी आने की उम्मीद है क्लॉड.एआई पर, 55% कोवर्क पर, 17% क्लॉड कोड पर और 7% क्लॉड प्लेटफ़ॉर्म पर, पोस्ट में एक पाद लेख के अनुसार।

कंपनी स्पष्ट रूप से कहती है कि अद्यतन पेशेवर जीवविज्ञान अनुसंधान के लिए मॉडल को खोल नहीं रहा है। फेबल 5 अभी भी उन अनुरोधों के लिए क्लॉड ओपस 5 में वापस आ जाता है जिन्हें एंथ्रोपिक दोहरे उपयोग वाले मानता है, जिनमें वायरोलॉजी, विषविज्ञान और आणविक डिजाइन शामिल हैं, जो कंपनी के अनुसार मॉडल को “पेशेवर जीवविज्ञान अनुसंधान और दवा विकास के लिए अभी तक उपयोगी नहीं” बनाता है। एंथ्रोपिक कहता है कि यह अंतर को भरने के लिए विश्वसनीय पहुंच मार्गों के माध्यम से करने का इरादा रखता है, न कि सार्वजनिक वर्गीकारक के माध्यम से।

फॉलबैक सिस्टम का निर्माण क्या रोकने के लिए किया गया था

फॉलबैक आर्किटेक्चर फेबल 5 के 9 जून, 2026 को लॉन्च से है। एंथ्रोपिक ने मॉडल को साइबर सुरक्षा, जीवविज्ञान और रसायन विज्ञान, और आसवन प्रयासों को कवर करने वाले वर्गीकारकों के साथ जारी किया – छोटे स्वचालित एआई सिस्टम जो अनुरोधों की जांच करते हैं। जब एक वर्गीकारक आग लगता है, तो अनुरोध को अगले सबसे सक्षम ओपस मॉडल द्वारा फिर से परोसा जाता है। लॉन्च पर, एंथ्रोपिक ने कहा कि उसने सावधानी से सुरक्षा उपायों को ट्यून किया है और उन्हें कम से कम 5% सत्रों में आग लगने की उम्मीद है।

जीवविज्ञान कवरेज तीनों में से सबसे व्यापक था। एंथ्रोपिक का तर्क, जो लॉन्च पोस्ट और मॉडल के सिस्टम कार्ड में निर्धारित किया गया है, यह है कि मिथोस-श्रेणी के मॉडल कुछ जटिल जैविक कार्यों पर विशेषज्ञों को पीछे छोड़ सकते हैं और अन्य पर संचालन समर्थन प्रदान कर सकते हैं – क्षमता जिसे कंपनी एक दुर्भाग्यपूर्ण अभिनेता को महत्वपूर्ण बढ़ावा देने के लिए मूल्यांकन करती है। सिस्टम कार्ड मॉडल को “सीबी-1” क्षमता के रूप में मानता है, जिसका अर्थ है कि यह ज्ञात हथियार-संबंधित प्रक्रियाओं पर मूल तकनीकी पृष्ठभूमि वाले लोगों की महत्वपूर्ण मदद कर सकता है, जबकि यह निर्णय लेता है कि यह नovel जैविक हथियार विकास के पीछे दुर्लभ विश्व-स्तरीय विशेषज्ञता को प्रतिस्थापित करने के लिए “सीबी-2” सीमा को पार नहीं करता है – एक निर्णय जिसे कार्ड खुद “पिछले मॉडलों की तुलना में बहुत कम स्पष्ट” के रूप में वर्णित करता है।

आज का अद्यतन अमेरिकी खुफिया समुदाय के 2026 के वार्षिक खतरा मूल्यांकन का हवाला देता है, जो चेतावनी देता है कि जैव प्रौद्योगिकी में प्रगति, जिसमें सिंथेटिक जीवविज्ञान और जीनोम संपादन शामिल है, “नवीन जैविक खतरों” का कारण बन सकती है और यह ध्यान देती है कि कई राज्य अभिनेता संभवतः सक्रिय आक्रामक जैविक और रासायनिक हथियार कार्यक्रमों को बनाए रखते हैं।

वर्गीकारकों में क्या बदलाव आया

पिछले कई हफ्तों में, एंथ्रोपिक ने जीवविज्ञान वर्गीकारक के संविधान को फिर से लिखा – स्क्रीनिंग मॉडल द्वारा उपयोग किए जाने वाले नियमों का संग्रह – हानिरहित उपयोगों को अधिक विवरण में काटना, आंतरिक और बाहरी विशेषज्ञों से प्रतिक्रिया मांगना, वर्गीकारक को अद्यतन डेटा पर पुनः प्रशिक्षित करना और सत्यापित करना कि यह अभी भी हानिकारक और दोहरे उपयोग वाले अनुसंधान सामग्री पर ट्रिगर करता है। लॉन्च कॉन्फ़िगरेशन जानबूझकर व्यापक था: कंपनी ने स्वीकार किया कि यह सावधानी से एक उच्च मात्रा में झूठे सकारात्मक परिणामों को ब्लॉक करेगी, जो फेबल 5 को सामान्य उपयोगकर्ताओं के लिए हफ्तों या महीनों पहले एक संकरी सुरक्षा की अनुमति देगी।

कंपनी के अपने परिवर्तन के निर्णय का आरेख वर्गीकारक सीमा को उन अनुरोधों को स्वीकार करने के लिए स्थानांतरित करने के लिए दिखाता है जो पहले स्वत: सुरक्षा मार्जिन में पकड़े गए थे – सामग्री एंथ्रोपिक ने बहुत ही संभावित रूप से हानिरहित मूल्यांकन की लेकिन सावधानी से अवरुद्ध कर दिया। एंथ्रोपिक के साइबर सुरक्षा डोमेन में वर्गीकारक दृष्टिकोण पर पहले के लेखन में एक समान तनाव का वर्णन किया गया है – जेलब्रेक लचीलापन के बीच व्यापक कवरेज और तनाव, जिसके परिणामस्वरूप यूनाइट.एआई ने कवर किया जब क्लॉड मॉडल बिना उन सुरक्षा उपायों के चल रहे थे

एंथ्रोपिक अब सार्वजनिक रूप से जिस व्यापार का प्रबंधन कर रहा है

घोषणा उत्पाद नोट के रूप में एक शासन दस्तावेज है। एंथ्रोपिक ने फेबल 5 को लगभग सभी जीवविज्ञान प्रश्नों को अवरुद्ध करते हुए लॉन्च किया, झूठे सकारात्मक परिणामों की लागत के रूप में कई हफ्ते अवशोषित किए और अब संकीर्ण ब्लॉक को संकुचित करने के परिणामस्वरूप मापदंडों को प्रकाशित कर रहा है – जिसमें प्रति-सतह फॉलबैक कमी शामिल है, जो बाहरी पर्यवेक्षकों को अगले संशोधन के लिए एक ठोस आधार प्रदान करता है। शेष प्रतिबंध वहीं बैठता है जहां कंपनी कहती है कि वास्तविक जोखिम बैठता है: पेशेवर जीवविज्ञान अनुसंधान तब तक ओपस 5 फॉलबैक के पीछे रहता है जब तक कि विश्वसनीय पहुंच मार्ग, जिसे एंथ्रोपिक जून लॉन्च के बाद से वेटेड जीवविज्ञान शोधकर्ताओं के लिए विकसित कर रहा है, उस यातायात को वहन करते हैं।

कंपनी स्वीकार करती है कि शेष झूठे सकारात्मक परिणाम सुरक्षा मार्जिन के भीतर बने रहेंगे और कहती है कि सुरक्षा उपायों में सुधार जारी है। जो उसने 7 अगस्त के अद्यतन के साथ लिखा है, वह प्रगति की एक मापनीय परिभाषा है: फॉलबैक दर जिसके खिलाफ यह अब मूल्यांकन किया जाएगा।

मीरा केल्लन एक एआई-जनरेटेड कॉलम्निस्ट हैं जो एआई नैतिकता, शासन, और नियमन में विशेषज्ञता रखती हैं। उनका काम यह देखता है कि कैसे कृत्रिम बुद्धिमत्ता सार्वजनिक नीति, सामाजिक मूल्यों, और दीर्घकालिक जिम्मेदारी के साथ परस्पर क्रिया करती है, जिसमें जिम्मेदार नवाचार पर ध्यान केंद्रित किया जाता है।
जटिल मुद्दों पर एक तर्कसंगत और दार्शनिक दृष्टिकोण के साथ पहुंचते हुए, मीरा उभरते एआई नियमन, नैतिक ढांचे, और शासन मॉडलों का विश्लेषण करती हैं जो बुद्धिमान प्रणालियों के भविष्य को आकार दे रहे हैं। वह तेजी से तकनीकी प्रगति और एआई प्रणालियों को पारदर्शी, न्यायसंगत, और मानव हितों के साथ संरेखित रखने के लिए आवश्यक सुरक्षा उपायों के बीच की खाई को पाटने का लक्ष्य रखती हैं।
मीरा केल्लन द्वारा लिखित लेख एआई-जनरेटेड हैं और यूनाइट.एआई की संपादकीय टीम द्वारा सटीकता, संतुलन, और संपादकीय मानकों के अनुरूप होने के लिए समीक्षा की जाती हैं।