ओपनएआई जीपीटी-ओएसएस-120बी और जीपीटी-ओएसएस-20बी: क्या यह ओपन-वेट मॉडल के लिए एक नया युग है?

जीपीटी ओएसएस

ओपनएआई ने एक गेम-चेंजिंग रिलीज़ की घोषणा की: GPT-OSS-120B और GPT-OSS-20B । ये दो अत्याधुनिक ओपन-वेट मॉडल अब अपाचे 2.0 लाइसेंस के तहत जनता के लिए उपलब्ध हैं।

इस रिलीज़ को वास्तव में रोमांचक बनाने वाली बात है सुलभता, प्रदर्शन और सुरक्षा का मिश्रण। GPT-OSS के साथ, OpenAI ने डेवलपर्स, शोधकर्ताओं और उद्यमों के लिए तर्क क्षमताओं से समझौता किए बिना अपने हार्डवेयर पर उच्च-गुणवत्ता वाले AI मॉडल चलाने का द्वार खोल दिया है।

GPT-OSS क्या है?

GPT-OSS बड़े भाषा मॉडलों का एक परिवार है— GPT-OSS-120B और GPT-OSS-20B— जिन्हें खुले उपयोग के लिए डिज़ाइन किया गया है। ये वास्तविक दुनिया के तर्क, टूल उपयोग और कम विलंबता प्रतिक्रियाओं के लिए अनुकूलित हैं। और सबसे अच्छी बात? आप इन्हें स्थानीय रूप से तैनात कर सकते हैं।

दोनों मॉडल दक्षता को अधिकतम करने के लिए अत्याधुनिक मिक्सचर-ऑफ-एक्सपर्ट्स (MoE) आर्किटेक्चर का उपयोग करते हैं। प्रति टोकन कम सक्रिय पैरामीटर्स के साथ, वे हार्डवेयर की माँग को कम करते हुए शक्ति को बनाए रखने में कामयाब होते हैं।

यह क्यों मायने रखती है

ओपन-वेट मॉडल एआई का लोकतंत्रीकरण करते हैं। ये छोटी कंपनियों, शोधकर्ताओं और शौक़ीनों को मालिकाना एपीआई की लागत या प्रतिबंधों के बिना बड़े पैमाने के भाषा मॉडल का अन्वेषण करने की अनुमति देते हैं।

चाहे आप स्वास्थ्य सेवा, शिक्षा, उद्यम स्वचालन या रोबोटिक्स में काम कर रहे हों, GPT-OSS आपको अपनी स्वयं की AI पाइपलाइन बनाने के लिए एक सुरक्षित और लचीला मंच प्रदान करता है।

मालिकाना मॉडलों को टक्कर देने वाला प्रदर्शन

ओपनएआई के अनुसार, GPT-OSS-120B प्रमुख रीजनिंग बेंचमार्क पर GPT-4o-mini के लगभग बराबरी पर है । यह एक 80GB GPU पर चलता है और कॉम्पिटिशन कोडिंग (कोडफोर्स), हेल्थ Q&A (हेल्थबेंच), और जनरल रीजनिंग (MMLU) जैसे कार्यों में अविश्वसनीय रूप से अच्छा प्रदर्शन करता है।

GPT-OSS-20B, अपने छोटे आकार के बावजूद, बेहतरीन है। केवल 16 GB मेमोरी की आवश्यकता होने के कारण, यह एज डिप्लॉयमेंट और कम लागत वाले वातावरण के लिए आदर्श है।

तुलना तालिका

नमूना कुल पैरामीटर सक्रिय पैरामीटर विशेषज्ञों परतें संदर्भ लंबाई
जीपीटी-ओएसएस-120बी 117बी 5.1बी 128 (4 सक्रिय) 36 128 हजार
जीपीटी-ओएसएस-20बी 21बी 3.6बी 32 (4 सक्रिय) 24 128 हजार

प्रशिक्षण और वास्तुकला

ये मॉडल विरल ध्यान और समूहीकृत बहु-प्रश्न ध्यान (MQA) द्वारा संवर्धित एक ट्रांसफ़ॉर्मर आर्किटेक्चर पर आधारित हैं। GPT-OSS रोटरी पोज़िशनल एम्बेडिंग (RoPE) का उपयोग करता है और 128,000 टोकन तक की लंबी संदर्भ लंबाई का समर्थन करता है।

उन्हें मुख्य रूप से अंग्रेजी डेटा पर प्रशिक्षित किया गया, जिसमें STEM, सामान्य ज्ञान और प्रोग्रामिंग पर ज़ोर दिया गया। टोकनाइज़र, o200k_harmony , को भी ओपन-सोर्स किया जा रहा है।

प्रशिक्षण के बाद और तर्क मोड

ओपनएआई के आंतरिक मॉडलों की तरह, GPT-OSS भी एक प्रशिक्षण-पश्चात प्रक्रिया से गुज़रा जिसमें पर्यवेक्षित फ़ाइन-ट्यूनिंग और सुदृढीकरण अधिगम शामिल था। डेवलपर्स विलंबता और सटीकता आवश्यकताओं के आधार पर तर्क प्रयास को नियंत्रित कर सकते हैं —निम्न, मध्यम या उच्च—।

यह GPT-OSS को चैटबॉट, अनुसंधान सहायकों या स्वास्थ्य सूचना प्रणालियों जैसे अनुप्रयोगों के लिए विशेष रूप से अनुकूल बनाता है।

सुरक्षा: एक मुख्य चिंता

ओपनएआई ने यह सुनिश्चित करने के लिए अपने तैयारी ढाँचे का पालन किया कि GPT-OSS उच्च सुरक्षा मानकों को पूरा करे। उन्होंने सबसे खराब दुरुपयोग परिदृश्यों का अनुकरण करने के लिए मॉडलों को प्रतिकूल रूप से परिष्कृत किया और पाया कि व्यापक दुर्भावनापूर्ण प्रशिक्षण के बावजूद, मॉडल उच्च-जोखिम क्षमता सीमा तक नहीं पहुँच सके।

इस रिलीज़ में एक रेड टीमिंग चैलेंज भी शामिल है जिसमें नई सुरक्षा कमज़ोरियों का पता लगाने के लिए $500,000 का इनाम रखा गया है। आप यहाँ और अधिक जानकारी प्राप्त कर सकते हैं या इसमें भाग ले सकते हैं ।

मूल्यांकन मानक

ओपनएआई ने निम्नलिखित कार्यों के लिए दोनों मॉडलों का बेंचमार्क किया:

  • हेल्थबेंच: GPT-OSS-120B ने 59.8% स्कोर किया, जो GPT-4o-mini और o3 मॉडल से आगे रहा।
  • AIME 2025: GPT-OSS-20B ने 71.5% अंक प्राप्त किए, जो GPT-4o-mini के बराबर है।
  • GPQA: एक विज्ञान तर्क परीक्षण जिसमें GPT-OSS-120B ने 90% सटीकता हासिल की।

ये परिणाम GPT-OSS की प्रतिस्पर्धात्मक बढ़त को प्रदर्शित करते हैं, विशेष रूप से उन क्षेत्रों में जहां संरचित तर्क और उपकरण उपयोग की आवश्यकता होती है।

उपकरण का उपयोग और एकीकरण

GPT-OSS मॉडल OpenAI के फ़ंक्शन कॉलिंग API और अन्य एजेंटिक वर्कफ़्लो के साथ सहजता से काम करते हैं। वे वेब ब्राउज़ कर सकते हैं, पायथन कोड चला सकते हैं, और विभिन्न टूल्स के साथ एकीकृत हो सकते हैं।

आप संरचित आउटपुट सेट कर सकते हैं, विचार-श्रृंखला (सीओटी) तर्क का उपयोग कर सकते हैं, या उन्हें अपने मौजूदा उपकरणों और एपीआई के साथ मल्टी-एजेंट सेटअप में संयोजित कर सकते हैं।

परिनियोजन विकल्प

ये वेट हगिंग फेस पर डाउनलोड के लिए उपलब्ध हैं और मेमोरी दक्षता के लिए MXFP4 में क्वांटाइज़ किए गए हैं। GPT-OSS-20B उपभोक्ता-ग्रेड हार्डवेयर पर आसानी से चलता है, जिसमें ONNX रनटाइम वाले विंडोज डिवाइस भी शामिल हैं ।

ओपनएआई ने निम्नलिखित परिनियोजन प्लेटफार्मों के साथ साझेदारी की है:

  • गले लगाने वाला चेहरा
  • ओलामा
  • एलएम स्टूडियो
  • नीला
  • क्लाउडफ्लेयर
  • वीएलएलएम

और NVIDIA, AMD, और Cerebras जैसे हार्डवेयर विक्रेताओं के साथ मिलकर सभी प्रणालियों में इष्टतम प्रदर्शन सुनिश्चित किया जाएगा।

लाइसेंसिंग और उपयोग के मामले

दोनों मॉडल अपाचे 2.0 लाइसेंस के तहत जारी किए गए हैं , जो वाणिज्यिक और शैक्षणिक उपयोग के लिए लचीलापन प्रदान करते हैं।

निम्नलिखित उपयोग मामलों के लिए आदर्श:

  • सुरक्षित ऑन-प्रिमाइसेस परिनियोजन
  • स्वास्थ्य सेवा या कानूनी फर्मों के लिए कस्टम AI पाइपलाइन
  • डोमेन-विशिष्ट कार्यों के लिए फ़ाइन-ट्यूनिंग
  • स्थानीय उपकरणों पर चलने वाले रीयल-टाइम सहायक

कैसे शुरू करें

आज ही GPT-OSS मॉडल का अन्वेषण शुरू करें:

सारांश

संक्षेप में, GPT-OSS की मुख्य विशेषताएं इस प्रकार हैं:

  • दो शक्तिशाली मॉडल: उच्च-स्तरीय GPU के लिए 120B, उपभोक्ता हार्डवेयर के लिए 20B
  • पूरी तरह से ओपन-वेट और अपाचे 2.0 लाइसेंस प्राप्त
  • तर्क, उपकरण उपयोग और वास्तविक दुनिया के कार्यों में मजबूत प्रदर्शन
  • अत्याधुनिक संरेखण तकनीकों के साथ सुरक्षा-परीक्षण किया गया
  • स्थानीय रूप से, डिवाइस पर, या भागीदारों के माध्यम से परिनियोजित किया जा सकता है

ओपनएआई का GPT-OSS सिर्फ़ एक मॉडल से कहीं बढ़कर है—यह ज़िम्मेदारी से नवाचार करने का एक आमंत्रण है। चाहे आप शोधकर्ता हों, डेवलपर हों या उद्यम, ये खुले मॉडल आपको बिना किसी बाधा के एआई को आगे बढ़ाने की शक्ति देते हैं।