OpenAI, மக்கள் ChatGPT-இல் தட்டச்சு செய்வதைப் படிப்பதை பணியாகக் கொண்ட ஒரு பணியாளர் குழுவை உருவாக்கி வருகிறது. 404 மீடியாவின் செய்தியறிக்கை, நிறுவனம் நூற்றுக்கணக்கான ஒப்பந்ததாரர்களை பணியமர்த்தி, உண்மையான பயனர் வினவல்களின் கனமான ஓட்டத்தை செயலாக்குகிறது என்பதைக் காட்டுகிறது — சாட்பாட்டின் 900 மில்லியனுக்கும் அதிகமான பயனர்கள் பொதுவாக தங்களுக்கும் இயந்திரத்திற்கும் இடையேயே இருக்கும் என்று கருதும் உரையாடல்கள்.

அந்த ஊடகம் ஆய்வு செய்தது ஒரே கசிந்த மெமோ அல்ல, முழு ஆவணத் தொடர்: உள் அறிவுறுத்தல் வழிகாட்டிகள், மதிப்பாய்வுக் குழுக்கள் பயன்படுத்தும் Slack சேனல்கள், உண்மையான ChatGPT வினவல்கள், மற்றும் மாதிரியின் பதில்களை மதிப்பிட ஒப்பந்ததாரர்கள் பயன்படுத்தும் மதிப்பீட்டு அளவுகோல். அந்தப் பொருளின் பெரும்பகுதி, ஊடகம் "திட்ட லில்லி" எனக் குறிப்பிடும் உள் பதாகையின் கீழ் உள்ளது, மேலும் இது AI மேம்பாட்டின் ஒரு பக்கத்தை வெளிச்சமாக்குகிறது, இது அறிமுக வலைப்பதிவு இடுகைகளில் அரிதாகவே தோன்றும்.

வினவல் மதிப்பாய்வு குழாயின் உள்ளே

இந்தக் குழுக்களின் நோக்கம் காகிதத்தில் நேரடியானது. ஒப்பந்ததாரர்கள் உண்மையான பயனர்கள் சமர்ப்பித்த வினவல்களைப் படித்து, ChatGPT உருவாக்கிய பதில்களை மதிப்பிட்டு விமர்சிக்கிறார்கள். அந்தக் கருத்து மீண்டும் பயிற்சி செயல்முறைக்குள் செலுத்தப்படுகிறது, அடுத்த முறை ஒத்த கோரிக்கை வரும்போது மாதிரி எவ்வாறு நடந்துகொள்ளும் என்பதை வடிவமைக்கிறது.

இதன் எasi தனிமைப்படுத்தப்பட்ட ஒரு வரி கேள்விகளை விட பரந்தது. மதிப்பாய்வாளர்களுக்கு ஒரு பயனருக்கும் சாட்பாட்டிற்கும் இடையிலான முழு உரையாடல்களும் காட்டப்படலாம், அதாவது ஒரு முழு பரிமாற்றம் — தொடர்வினாக்கள், திருத்தங்கள், வழியில் தானாக வழங்கப்பட்ட விவரங்கள் — ஒரு நபரின் முன் செல்லலாம். அறிவுறுத்தல் வழிகாட்டிகள் தரமான வெளியீடு என்ன என்பதற்கு கடுமையான தரத்தை நிர்ணயிக்கின்றன, ஒரு சிறந்த பதில் என்பது பயனரின் உண்மையான நோக்கத்தைப் புரிந்துகொண்டு, துல்லியமான மற்றும் பயனுள்ள உதவியை வழங்கி, பொருத்தமான அளவு அன்புடன் தெளிவாகவும் இயற்கையாகவும் படிக்கக்கூடியதாக இருக்க வேண்டும் என்று விவரிக்கின்றன.

அளவே முக்கியம். நூற்றுக்கணக்கான மதிப்பாய்வாளர்கள் வினவல்களின் தொடர்ச்சியான ஓட்டத்தை செயலாக்குவது என்பது உண்மையான உரையாடல்கள் அளவில் நுகரப்படுகின்றன, அவ்வப்போது சோதனைச் சரிபார்ப்புக்காக மாதிரி எடுக்கப்படுவதில்லை. ஒரு நிறுவனத்தின் தயாரிப்பு ஒரு நாளைக்கு மகத்தான அளவிலான வினவல்களைக் கையாளும் போது, அந்த மனித அடுக்கு ஒரு முறை நடத்தப்படும் தணிக்கையாக இல்லாமல் மேம்பாட்டுச் சுழற்சியின் நிலையான பகுதியாக மாறுகிறது.

நூற்றுக்கணக்கான மில்லியனர்களுக்கான தனியுரிமை குருட்டுப் புள்ளி

OpenAI மதிப்பாய்வாளர்களுக்கு பயனர் பெயர்களை வழங்குவதில்லை, மேலும் வினவல்கள் மனிதக் கண்களை அடையும் முன் தனிப்பட்ட விவரங்களை அகற்ற முயற்சி செய்வதாக நிறுவனம் கூறுகிறது. ஆனால் முக்கியமான தகவல்கள் அந்த வடிகட்டலைத் தாண்டி படிக்கும் நபர்களை அடையலாம் என நிறுவனம் ஒப்புக்கொண்டுள்ளது.

Inside ‘Project Lily’: The Humans Reading Your ChatGPT Chats
Image: Spumoni Cooperative for 404 Media.

அந்த வேறுபாடு நடைமுறையில் மிக முக்கியமானது. கணக்கு மட்டத்தில் அநாமதேயம் என்பது பொருளில் அநாமதேயம் என்பதற்கு சமமானது அல்ல. ஒரு வினவல் ஒரு நோயறிதல், ஒரு விவாகரத்து, ஒரு கடன், ஒரு பணியிட மோதல், அல்லது ஒரு தனிப்பட்ட பயத்தை விவரித்தால், அடையாளம் காணும் மதிப்பு உள்ளடக்கத்திலேயே உள்ளது, அதனுடன் இணைக்கப்பட்ட பயனர் பெயரில் அல்ல.

மேலும் அந்த உள்ளடக்கமே மக்கள் கொண்டு வருவது. ChatGPT ஒரு உளவியல் ஆலோசகரின் நாற்காலியாக, ஒரு தொழில்முறை உதவியாளராக, சில சந்தர்ப்பங்களில் ஒரு டிஜிட்டல் துணையாக மாறியுள்ளது. பயனர்கள் வழக்கமாக தங்கள் ஆரோக்கியம், உறவுகள், பணம் மற்றும் கவலைகள் பற்றிய நெருக்கமான விவரங்களை வழங்குகிறார்கள் — பெரும்பாலும் அந்த தொடர்பு தனிப்பட்டதாக, உடனடியாக, கவனிக்கப்படாததாக உணரப்படுவதால்.

"அவர்கள் கற்பனை செய்வார்கள் என்று நான் நினைக்கவில்லை"

உணர்வுக்கும் யதார்த்தத்திற்கும் இடையிலான இடைவெளியே இந்தக் கதையின் மையம். ChatGPT பயனர்கள் மனிதர்கள் தங்கள் உரையாடல்களைப் படிக்கக்கூடும் என்பதைப் புரிந்துகொள்கிறார்களா என்று கேட்டபோது, வினவல்களுடன் பணிபுரியும் ஒருவர் நேரடியாகப் பதிலளித்தார். இல்லை என்று கூறினார், மேலும் பயனர்கள் எங்கோ ஒரு ஒப்பந்ததாரர் உரையாடல்களை பகுப்பாய்வு செய்கிறார் என்பதை கற்பனை செய்ய மாட்டார்கள் என்று சேர்த்தார்.

அந்த எதிர்பார்ப்பு மேலோட்டமாக நியாயமானது. ஒரு அரட்டை சாளரத்துடன் தொடர்பு கொள்ளும் பெரும்பாலான மக்களுக்கு, தர மேம்பாட்டுத் திட்டத்தின் ஒரு பகுதியாக ஒரு நபர் பின்னர் தங்கள் வார்த்தைகளை உருட்டிச் செல்லக்கூடும் என்பதற்கான தெரியும் அறிகுறி எதுவும் இல்லை. மாதிரி சீரமைப்புக்காக வினவல்களைப் படிப்பது, ஒரு புதிய அம்சம் அல்லது பாதுகாப்புக் கொள்கை புதுப்பிப்பு போல விளம்பரப்படுத்தப்படுவதில்லை.

சைகோஃபன்சி, மானுடவியலாக்கம், மற்றும் உண்மையான தீங்கு

உள் ஆவணங்கள் மதிப்பாய்வாளர்கள் எதைத் திருத்தக் கேட்கப்படுகிறார்கள் என்பதையும் வெளிப்படுத்துகின்றன. அறிக்கையின்படி, ஒப்பந்ததாரர்கள் ChatGPT தன்னை மானுடவியலாக்குவதை — உணர்வுகள் அல்லது நிலையான உள் வாழ்க்கை கொண்ட ஒரு நபரைப் போல தன்னை வழங்குவதை — தவிர்க்க வழிகாட்டவும், அதன் சைகோஃபன்சியை — பயனர்களை எதிர்த்துப் பேசுவதற்குப் பதிலாக புகழ்ந்து ஒப்புக்கொள்ளும் பிரதிபலிப்பு போக்கை — குறைக்கவும் பயிற்சி அளிக்கப்படுகிறார்கள்.

இவை அழகு சார்ந்த விசித்திரங்கள் அல்ல. OpenAI-இன் 4o மாதிரியில் அதிகப்படியான சைகோஃபன்சி, பல நபர்களின் தற்கொலைகளில் ஒரு பங்களிக்கும் காரணியாக வழக்குகளில் குறிப்பிடப்பட்டுள்ளது. ஒரு அமைப்பு ஒரு நபர் சொல்வதை எதுவாக இருந்தாலும் உறுதிப்படுத்தும் வகையில் சீரமைக்கப்படும்போது, அதன் விளைவுகள் ஒரு எரிச்சலூட்டும் சாட்பாட் பதிலை விட மிக அதிகமாக செல்லலாம். மனித மதிப்பாய்வு அடுக்கு, ஓரளவு அந்த தோல்வி முறையை மழுங்கடிக்கும் ஒரு முயற்சியாகும்.

பாதுகாப்பு மதிப்பாய்வுக்கு சமமானது அல்ல

இந்த வேலையை OpenAI பொதுவில் விவரித்த பாதுகாப்பு நடவடிக்கைகளிலிருந்து பிரிப்பது மதிப்புள்ளது. மற்றவர்களைத் தீங்கு செய்யத் திட்டமிடுபவர்களாகத் தோன்றும் பயனர்களை நிறுவனம் கண்டறியும்போது அரட்டைகளை மதிப்பாய்வு செய்வது — ஒரு குறுகிய, நெருக்கடி சார்ந்த தலையீடு — அவற்றில் அடங்கும்.

Screenshot of the ChatGPT settings page.
Screenshot of the ChatGPT settings page.

ஒப்பந்ததாரர்களால் மேற்கொள்ளப்படும் வினவல் மதிப்பாய்வு முற்றிலும் வேறுபட்ட ஒரு செயல்பாடு, அவசரகால கண்டறிதலை விட அன்றாட பதில் தரத்தை நோக்கமாகக் கொண்டது. அதனால்தான் இது மிகவும் சாதாரண உரையாடல்களைத் தொடுகிறது. ஒரு கடினமான செய்தியை வரைவதற்கு உதவி கேட்கும் அல்லது ஒரு தனிப்பட்ட முடிவைப் பற்றி சிந்திக்கும் ஒரு பயனர் நெருக்கடியில் இல்லை, மேலும் ஆய்வை எதிர்பார்க்க எந்தக் காரணமும் இல்லை, ஆனால் அவர்களின் பரிமாற்றம் ஒரு மதிப்பாய்வு வரிசையில் விழலாம்.

Anthropic இதே நடைமுறையை உறுதிப்படுத்துகிறது

இந்த அணுகுமுறையில் OpenAI மட்டும் இல்லை. Anthropic தனது மாதிரிகளை மேம்படுத்த மனித மதிப்பாய்வையும் பயன்படுத்துகிறது என 404 மீடியாவிடம் உறுதிப்படுத்தியது, இது உண்மையான பயனர் தொடர்புகளைப் படிப்பது ஒரு நிறுவனத்தின் தனிமைப்படுத்தப்பட்ட சோதனை அல்ல, ஒரு தொழில் நடைமுறை என்பதைக் குறிக்கிறது. இந்தக் கண்டுபிடிப்பு, வழங்குநரை மாற்றுவது அடிப்படை தனியுரிமை கேள்வியைத் தீர்க்கும் என்ற எந்த அனுமானத்தையும் சிக்கலாக்குகிறது.

மேம்பாட்டின் மாயையின் பின்னணியில் உள்ள உழைப்பு

AI மாதிரிகள் ஏன் தொடர்ந்து சிறந்து வருகின்றன என்பதற்கான ஒரு பிரபலமான விளக்கத்தையும் இந்த அறிக்கை சவால் செய்கிறது. வழக்கமான கணக்கு இணைய உரையின் மகத்தான அளவிலான ஸ்கிராப்பிங், நல்ல ஊதியம் பெறும் பொறியியல் மற்றும் ஆராய்ச்சி திறமை, மற்றும் அடுத்தடுத்த தலைமுறை திறன்மிக்க கட்டமைப்புகளுக்கு கடன் அளிக்கிறது.

இவை அனைத்தும் முக்கியம், ஆனால் அவை ஒரு அமைதியான, அடிக்கடி கவனிக்கப்படாத ஒன்றை விட்டுவிடுகின்றன: உண்மையான ChatGPT பதில்களை மீண்டும் மீண்டும், அளவில் படித்து மதிப்பிட ஊதியம் பெறும் வெளி ஒப்பந்ததாரர்கள். அந்த மனித உழைப்பு தயாரிப்புக்குள் ஒரு அர்த்தமுள்ள உள்ளீடு, மேலும் இது முன்னணி அமைப்புகள் எவ்வாறு முன்னேறுகின்றன என்பதற்கான பொது விவரிப்புக்கு பெரும்பாலும் வெளியே உள்ளது.

பயனர்கள் எடுக்க வேண்டியவை

  • ChatGPT ஒரு ரகசிய சேனல் அல்ல. வினவல்கள் மாதிரி மேம்பாட்டில் பணிபுரியும் மனித ஒப்பந்ததாரர்களால் படிக்கப்படலாம்.
  • பயனர் பெயர்களை அகற்றுவது சூழலை அகற்றாது. ஒரு பயனர் வழங்கும் விவரங்கள் தாமாகவே அடையாளம் காணக்கூடியதாக இருக்கலாம்.
  • OpenAI-இன் சொந்த ஒப்புதலின்படி திருத்தம் குறைபாடுடையது — முக்கியமான தகவல்கள் இன்னும் மதிப்பாய்வாளர்களை அடையலாம்.
  • இந்த நடைமுறை ஒரு நிறுவனத்திற்கு அப்பால் நீண்டுள்ளது, Anthropic இதேபோன்ற மனித மதிப்பாய்வை உறுதிப்படுத்துகிறது.
  • பாதுகாப்பு தொடர்பான அரட்டை மதிப்பாய்வு மற்றும் தரம் தொடர்பான வினவல் மதிப்பாய்வு தனித்தனி திட்டங்கள், மேலும் பிந்தையது வழக்கமான உரையாடல்களை அடைகிறது.

இவை எதுவும் தானாகவே இந்த நடைமுறையை நியாயமற்றதாக்காது. நூற்றுக்கணக்கான மில்லியன் மக்கள் தீவிரமான கேள்விகளுக்காக நம்பியிருக்கும் ஒரு அமைப்பை மேம்படுத்துவதற்கு ஏதோ ஒரு வடிவ கருத்து தேவைப்படுகிறது, மேலும் மனித தீர்ப்பு கிடைக்கும் மிகச் சிறந்த கருவிகளில் ஒன்றாகவே உள்ளது. கேள்வி என்னவென்றால், அந்த சமநிலை பயனர்கள் உண்மையில் எடைபோடக்கூடிய வகையில் வெளிப்படுத்தப்படுகிறதா என்பதே.

இப்போது, பதில் இல்லை என்று தோன்றுகிறது. ஒரு ஒப்புதல், ஒரு மருத்துவ கேள்வி, அல்லது ஒரு தொழில் நெருக்கடியை ஒரு அரட்டைப் பெட்டியில் தட்டச்சு செய்யும் ஒருவருக்கு, ஒரு மதிப்பாய்வு வரிசையில் ஒரு ஒப்பந்ததாரர் அதைப் படிக்கக்கூடும் என்று சொல்லப்படுவதில்லை. அந்த இடைவெளியை மூடுவது — தெளிவான அறிவிப்பு, வலுவான அடையாளம் நீக்கம், அல்லது மிகக் கடுமையான வடிகட்டுதல் மூலம் — இப்போது தொழில்துறை எதிர்கொள்ளும் சோதனை, மேலும் அனுப்பும் பொத்தானை அழுத்தும் முன் பயனர்கள் எவ்வளவு அறிய அனுமதிக்கப்படுகிறார்கள் என்பதன் மூலம் இது மதிப்பிடப்படும்.

இந்தக் கட்டுரை 404 மீடியாவின் செய்தியறிக்கையை அடிப்படையாகக் கொண்டது. அசல் கட்டுரையைப் படிக்கவும்.

Originally published on 404media.co