
अलीकडेच या वर्षी, संशोधकांच्या एका संघाने, आणि Google DeepMind आणि इतर प्रतिष्ठित संस्थांनी, येथे ChatGPT मधील असुरक्षा उघड करणारा एक महत्त्वाचा पेपर प्रकाशित केला .
या लेखाचा उद्देश वरील-लिंक केलेल्या लेखाच्या आधारे सामान्य प्रेक्षकांसाठी मुख्य निष्कर्ष आणि त्यांचे परिणाम सुलभ करणे हा आहे, केवळ संदर्भाच्या हेतूने! शिवाय, मी त्याची चाचणी देखील केली आणि तुम्ही माझे निकाल शेवटी पाहू शकता!
ChatGPT वरून डेटा काढणे
संशोधकांनी चॅटजीपीटीच्या प्रशिक्षण डेटाचे अनेक मेगाबाइट्स फक्त दोनशे डॉलर्समध्ये काढण्याची परवानगी देऊन हल्ला तयार केला. हे मॉडेल, त्याच्या प्रकारातील इतरांप्रमाणे, सार्वजनिक इंटरनेट डेटावर प्रशिक्षित केले जाते.
हल्ल्यामध्ये मॉडेलची चौकशी करणे, त्याला प्रशिक्षित केलेला अचूक डेटा उघड करणे समाविष्ट आहे. विशेष म्हणजे, प्रश्नांवर अधिक खर्च करून ChatGPT च्या प्रशिक्षण डेटासेटचा सुमारे एक गिगाबाइट काढणे शक्य आहे.
प्रशिक्षण डेटा काढणे हल्ले आणि आपण काळजी का पाहिजे
हा पेपर प्रशिक्षण डेटा काढण्याच्या हल्ल्यांच्या महत्त्वावर भर देतो. संशोधक दाखवतात की चॅटजीपीटी सारखी भाषा मॉडेल प्रशिक्षण डेटा लक्षात ठेवू शकतात आणि पुनर्गठित करू शकतात. यामुळे संवेदनशील माहितीच्या गोपनीयतेबद्दल आणि सुरक्षिततेबद्दल चिंता निर्माण होते.
प्रशिक्षण डेटा उघड करणे टाळण्यासाठी डिझाइन केलेले ChatGPT चे संरेखित स्वरूप, विशिष्ट हल्ल्याद्वारे डेटा काढण्यास प्रतिबंध करत नाही. संशोधन कार्यसंघाचा असा युक्तिवाद आहे की केवळ संरेखित मॉडेलची चाचणी केल्याने असुरक्षा मास्क होऊ शकतात, बेस मॉडेल्सची थेट चाचणी करण्याच्या गरजेवर जोर दिला जातो. शोषणांचे पुरेसे पॅचिंग सुनिश्चित करण्यासाठी उत्पादनातील सिस्टममध्ये चाचणी देखील वाढविली पाहिजे.
पेपरमध्ये दर्शविलेले विशिष्ट शोषण पॅच केले जाऊ शकते, परंतु संशोधक शोषण पॅच करणे आणि अंतर्निहित असुरक्षा निश्चित करणे यामधील फरक हायलाइट करतात. ChatGPT च्या बाबतीत, प्रशिक्षण डेटा लक्षात ठेवण्याच्या प्रवृत्तीमध्ये असुरक्षितता आहे, ज्यामुळे सर्वसमावेशकपणे संबोधित करणे एक जटिल आव्हान बनते.
निष्कर्ष आणि माझे चाचणी परिणाम
पारंपारिक सॉफ्टवेअर प्रणाली म्हणून भाषा मॉडेल्सच्या समजात बदल करण्याचा संशोधकांचा आग्रह आहे. निष्कर्ष मशीन लर्निंग सिस्टमची सुरक्षा निश्चित करण्यासाठी व्यापक कामाची आवश्यकता दर्शवतात. संशोधन लेख वाचकांना मथळ्याच्या परिणामांच्या पलीकडे संशोधनाच्या सखोल समजून घेण्यासाठी संपूर्ण तांत्रिक पेपर एक्सप्लोर करण्यास प्रोत्साहित करतो.
जेव्हा मी चाचणी केली आणि ChatGPT ला शब्द कायमचा पुनरावृत्ती करण्यास सांगितले, तेव्हा तो फक्त काही वेळा पुनरावृत्ती झाला आणि छान थांबला!
माझा निष्कर्ष असा आहे की, आता ChatGPT अशा अवैध इनपुटला चांगल्या प्रकारे हाताळण्यास सक्षम आहे.
खालील ChatGPT स्क्रीनशॉट पहा:






