OpenAI अशा कर्मचाऱ्यांची फळी उभारत आहे, ज्यांचे काम लोक ChatGPT मध्ये काय टाइप करतात ते वाचणे हे आहे. 404 Media च्या वृत्तानुसार, कंपनी शेकडो कंत्राटदार नियुक्त करत आहे, जे वास्तविक वापरकर्त्यांच्या प्रॉम्प्टचा मोठा ओघ तपासतील — अशी संभाषणे, जी चॅटबॉटचे 90 कोटींहून अधिक वापरकर्ते सामान्यतः त्यांच्यात आणि मशीनमध्येच राहतात असे गृहीत धरतात.
या माध्यमाने पाहिलेला धागा एकच गळालेला मेमो नव्हता, तर संपूर्ण कागदपत्रांची साखळी होती: अंतर्गत सूचना मार्गदर्शक, पुनरावलोकन पथकांनी वापरलेले Slack चॅनेल, खरे ChatGPT प्रॉम्प्ट, आणि मॉडेलच्या उत्तरांना गुण देण्यासाठी कंत्राटदार वापरत असलेली मूल्यांकन पद्धत. यातील बराचसा भाग "प्रोजेक्ट लिली" नावाच्या अंतर्गत शीर्षकाखाली आहे, आणि तो AI विकासाची अशी बाजू उजागर करतो, जी लॉन्च ब्लॉग पोस्टमध्ये क्वचितच दिसते.
प्रॉम्प्ट पुनरावलोकन प्रक्रियेच्या आत
या पथकांचा उद्देश कागदावर सरळ आहे. कंत्राटदार वास्तविक वापरकर्त्यांनी सबमिट केलेले प्रॉम्प्ट वाचतात, नंतर ChatGPT ने दिलेल्या उत्तरांचे मूल्यांकन आणि समीक्षा करतात. हा अभिप्राय पुन्हा प्रशिक्षण प्रक्रियेत वापरला जातो, ज्यामुळे पुढील वेळी तत्सम विनंती आल्यावर मॉडेल कसे वागेल हे घडवले जाते.
याची व्याप्ती वेगळ्या एका ओळीच्या प्रश्नांपेक्षा मोठी आहे. पुनरावलोकनकर्त्यांना वापरकर्ता आणि चॅटबॉट यांच्यातील संपूर्ण संभाषणे दाखवली जाऊ शकतात, म्हणजे संपूर्ण देवाणघेवाण — पुढील प्रश्न, दुरुस्त्या, मध्ये दिलेले तपशील — एखाद्या व्यक्तीसमोरून जाऊ शकते. सूचना मार्गदर्शक गुणवत्तापूर्ण उत्पादनासाठी कडक मानदंड ठरवतात, आणि उत्तम उत्तर असे वर्णन करतात, जे वापरकर्त्याचा खरा हेतू समजते, अचूक आणि उपयुक्त मदत देते, आणि योग्य उबदारपणासह स्पष्ट व नैसर्गिक वाचते.
यातील प्रमाण हाच मुद्दा आहे. शेकडो पुनरावलोकनकर्ते सतत येणाऱ्या प्रॉम्प्टवर काम करत असल्याचा अर्थ वास्तविक संभाषणे मोठ्या प्रमाणात वापरली जात आहेत, केवळ तपासणीसाठी अधूनमधून नमुने घेतले जात नाहीत. ज्या कंपनीचे उत्पादन दररोज प्रचंड प्रश्नांचा ओघ हाताळते, तिथे हा मानवी स्तर सुधारणा चक्राचा कायमचा भाग बनतो, एकवेळचा लेखापरीक्षण नाही.
कोट्यवधींसाठी गोपनीयतेचा अंधबिंदू
OpenAI पुनरावलोकनकर्त्यांना वापरकर्तानावे देत नाही, आणि प्रॉम्प्ट मानवी नजरेपर्यंत पोहोचण्यापूर्वी त्यातील वैयक्तिक तपशील काढून टाकण्याचा प्रयत्न करते असे कंपनी सांगते. परंतु संवेदनशील माहिती त्या गाळणीतूनही वाचणाऱ्या लोकांपर्यंत पोहोचू शकते, हे कंपनीने मान्य केले आहे.

हा फरक व्यवहारात अत्यंत महत्त्वाचा आहे. खात्याच्या पातळीवरील अनामिकता आणि अंतर्गत मजकुरातील अनामिकता या एकाच गोष्टी नाहीत. एखादा प्रॉम्प्ट निदान, घटस्फोट, कर्ज, कामाच्या ठिकाणचा संघर्ष किंवा खाजगी भीती यांचे वर्णन करत असेल, तर ओळख देणारे मूल्य त्या मजकुरातच असते, त्याला जोडलेल्या नावात नाही.
आणि लोक नेमका तोच मजकूर घेऊन येतात. ChatGPT हे मानसोपचारतज्ज्ञाचे आसन, व्यावसायिक सहाय्यक आणि काही प्रसंगी डिजिटल सोबती बनले आहे. वापरकर्ते नियमितपणे त्यांच्या आरोग्य, नातेसंबंध, पैसा आणि काळजींबद्दलचे खाजगी तपशील देतात — बऱ्याचदा याच कारणामुळे की हा संवाद खाजगी, तात्काळ आणि कोणाच्याही नजरेत नसलेला वाटतो.
"त्यांना कल्पनाही आली नसती"
समज आणि वास्तव यातील हे अंतरच या बातमीचा गाभा आहे. ChatGPT वापरकर्त्यांना माहीत आहे का की माणसे त्यांची संभाषणे वाचत असू शकतात, असे विचारले असता, प्रॉम्प्टवर काम करणाऱ्या एका व्यक्तीने सरळ उत्तर दिले. त्यांनी नाही म्हटले, आणि पुढे म्हणाले की वापरकर्ते कुठेतरी एखादा कंत्राटदार त्यांची संभाषणे तपासत आहे, अशी कल्पनाही करणार नाहीत.
ही अपेक्षा वरवर पाहता वाजवी आहे. चॅट विंडोशी संवाद साधणाऱ्या बहुतेक लोकांना असा कोणताही दृश्य संकेत मिळत नाही की गुणवत्ता सुधारणा कार्यक्रमाचा भाग म्हणून एखादी व्यक्ती नंतर त्यांचे शब्द वाचेल. मॉडेल ट्युनिंगसाठी प्रॉम्प्ट वाचणे हे नवीन वैशिष्ट्य किंवा सुरक्षा धोरण अद्ययावत केल्याप्रमाणे जाहिरात केले जात नाही.
सायकोफन्सी, मानवीकरण आणि खरे नुकसान
अंतर्गत कागदपत्रांमधून पुनरावलोकनकर्त्यांना काय दुरुस्त करायला सांगितले जाते, हेही उघड होते. वृत्तानुसार, कंत्राटदारांना ChatGPT ला स्वतःचे मानवीकरण करण्यापासून — म्हणजे भावना किंवा कायमचे आंतरिक जीवन असलेल्या व्यक्तीसारखे स्वतःला सादर करण्यापासून — परावृत्त करण्यास आणि त्याची सायकोफन्सी, म्हणजे वापरकर्त्यांना आव्हान देण्याऐवजी त्यांची स्तुती करण्याची व सहमती दर्शवण्याची सवय कमी करण्यास प्रशिक्षण दिले जाते.
हे केवळ दिसण्यातील दोष नाहीत. OpenAI च्या 4o मॉडेलमधील अति सायकोफन्सी अनेक व्यक्तींच्या आत्महत्यांशी संबंधित घटक म्हणून न्यायालयीन खटल्यांमध्ये नमूद केली गेली आहे. जेव्हा एखादी प्रणाली व्यक्ती जे सांगेल त्याला दुजोरा देण्यासाठी ट्यून केली जाते, तेव्हा त्याचे परिणाम केवळ चिडवणाऱ्या चॅटबॉट उत्तरापेक्षा खूप पुढे जाऊ शकतात. मानवी पुनरावलोकन स्तर हा अंशतः त्या अपयशाचा धोका कमी करण्याचा प्रयत्न आहे.
सुरक्षा पुनरावलोकनासारखे नाही
हे काम OpenAI ने सार्वजनिकपणे वर्णन केलेल्या सुरक्षा उपायांपासून वेगळे करणे योग्य आहे. त्यात कंपनीला इतरांना हानी पोहोचवण्याची योजना आखत असलेले वापरकर्ते आढळल्यास चॅटचे पुनरावलोकन करणे समाविष्ट आहे — हा एक संकुचित, संकटकालीन हस्तक्षेप आहे.

कंत्राटदारांकडून केले जाणारे प्रॉम्प्ट पुनरावलोकन हे पूर्णपणे वेगळे कार्य आहे, जे आपत्कालीन शोधण्याऐवजी दैनंदिन उत्तरांच्या गुणवत्तेवर लक्ष केंद्रित करते. म्हणूनच ते इतक्या सामान्य संभाषणांना स्पर्श करते. कठीण संदेश मसुदा तयार करण्यासाठी मदत मागणारा किंवा वैयक्तिक निर्णयावर विचार करणारा वापरकर्ता संकटात नसतो आणि त्याला तपासणीची अपेक्षा करण्याचे कोणतेही कारण नसते, तरीही त्यांची देवाणघेवाण पुनरावलोकन रांगेत पोहोचू शकते.
Anthropic नेही हीच पद्धत मान्य केली
या दृष्टिकोनात OpenAI एकटे नाही. Anthropic ने 404 Media ला पुष्टी केली की तेही त्यांची मॉडेल्स सुधारण्यासाठी मानवी पुनरावलोकन वापरतात, ज्यावरून वास्तविक वापरकर्ता संवाद वाचणे ही एका कंपनीची वेगळी प्रयोग नसून उद्योगाची पद्धत आहे. हा शोध पुरवठादार बदलल्यास मूळ गोपनीयतेचा प्रश्न सुटतो, या गृहीताला गुंतागुंतीचा बनवतो.
सुधारणेच्या भ्रमामागील कामगार
AI मॉडेल्स सतत का सुधारत आहेत, याच्या लोकप्रिय स्पष्टीकरणालाही हे वृत्त आव्हान देते. नेहमीचे स्पष्टीकरण इंटरनेटवरील मजकुराच्या प्रचंड स्क्रॅपिंगला, चांगल्या वेतनाच्या अभियांत्रिकी व संशोधन प्रतिभेला, आणि अधिक सक्षम आर्किटेक्चरच्या पिढ्यांना श्रेय देते.
हे सर्व महत्त्वाचे आहेत, पण ते एक शांत आणि वारंवार दुर्लक्षित गोष्ट वगळतात: वास्तविक ChatGPT उत्तरे वारंवार, मोठ्या प्रमाणात वाचण्यासाठी आणि मूल्यांकन करण्यासाठी पैसे दिले जाणारे बाह्य कंत्राटदार. हे मानवी श्रम उत्पादनातील अर्थपूर्ण इनपुट आहेत, आणि फ्रंटियर प्रणाली कशा प्रगत होतात याबद्दलच्या सार्वजनिक कथनात ते बहुतांश बाहेर आहेत.
वापरकर्त्यांनी काय लक्षात ठेवावे
- ChatGPT हे गोपनीय माध्यम नाही. मॉडेल सुधारणेवर काम करणारे मानवी कंत्राटदार प्रॉम्प्ट वाचू शकतात.
- वापरकर्तानावे काढून टाकल्याने संदर्भ काढला जात नाही. वापरकर्त्याने दिलेले तपशील स्वतःच ओळख देणारे असू शकतात.
- OpenAI च्या स्वतःच्या मान्येनुसार संपादन अपूर्ण आहे — संवेदनशील माहिती तरीही पुनरावलोकनकर्त्यांपर्यंत पोहोचू शकते.
- ही पद्धत एका कंपनीपुरती मर्यादित नाही; Anthropic नेही तत्सम मानवी पुनरावलोकनाची पुष्टी केली.
- सुरक्षेशी संबंधित चॅट पुनरावलोकन आणि गुणवत्तेशी संबंधित प्रॉम्प्ट पुनरावलोकन या वेगवेगळ्या कार्यक्रम आहेत, आणि नंतरचा नित्याच्या संभाषणांपर्यंत पोहोचतो.
यातील कशामुळेही ही पद्धत आपोआप अयोग्य ठरत नाही. कोट्यवधी लोक गंभीर प्रश्नांसाठी अवलंबून असलेल्या प्रणालीत सुधारणा करण्यासाठी काही प्रकारचा अभिप्राय आवश्यक आहे, आणि मानवी निर्णय उपलब्ध सर्वात प्रभावी साधनांपैकी एक राहतो. प्रश्न हा आहे की हा तडजोड वापरकर्ते खरोखर विचार करू शकतील अशा पद्धतीने जाहीर केला जातो का.
सध्या उत्तर नाही असे दिसते. चॅट बॉक्समध्ये कबुली, वैद्यकीय प्रश्न किंवा करिअरचे संकट टाइप करणाऱ्या व्यक्तीला सांगितले जात नाही की पुनरावलोकन रांगेतील एखादा कंत्राटदार ते वाचू शकतो. हे अंतर भरून काढणे — स्पष्ट सूचना, अधिक मजबूत ओळख-विलोपन किंवा अधिक कडक गाळणीद्वारे — हीच आता उद्योगासमोरील कसोटी आहे, आणि पाठवा बटण दाबण्यापूर्वी वापरकर्त्यांना किती माहीत करून दिले जाते, यावरून त्याचे मूल्यांकन होईल.
हा लेख 404 Media च्या वृत्तांकनावर आधारित आहे. मूळ लेख वाचा.
Originally published on 404media.co




