OpenAI ప్రజలు ChatGPT లో టైప్ చేసేది చదవడమే పనిగా ఉన్న ఒక కార్యబలాన్ని సమీకరిస్తోంది. 404 మీడియా నివేదిక ప్రకారం, నిజమైన వినియోగదారుల ప్రాంప్ట్‌ల భారీ ప్రవాహాన్ని పరిశీలించడానికి కంపెనీ వందలాది కాంట్రాక్టర్లను నియమిస్తోంది — ఛాట్‌బాట్ యొక్క 900 మిలియన్లకు పైగా వినియోగదారులు సాధారణంగా తమకూ యంత్రానికీ మధ్యే ఉంటాయని భావించే సంభాషణలు.

ఆ మీడియా సంస్థ పరిశీలించింది ఒకే ఒక లీక్ అయిన మెమో కాదు, పూర్తి పత్రాల జాడ: అంతర్గత సూచన మార్గదర్శకాలు, సమీక్ష బృందాలు ఉపయోగించే Slack ఛానెల్‌లు, నిజమైన ChatGPT ప్రాంప్ట్‌లు, మరియు మోడల్ సమాధానాలను గ్రేడ్ చేయడానికి కాంట్రాక్టర్లు వర్తించే స్కోరింగ్ రూబ్రిక్. ఆ పదార్థంలో చాలా వరకు, ఆ మీడియా సంస్థ "ప్రాజెక్ట్ లిల్లీ" అని పేర్కొనే అంతర్గత బ్యానర్ కింద ఉంది, మరియు అది AI అభివృద్ధిలో లాంచ్ బ్లాగ్ పోస్ట్‌లలో అరుదుగా కనిపించే ఒక వైపును వెలుగులోకి తెస్తుంది.

ప్రాంప్ట్ సమీక్ష పైప్‌లైన్ లోపల

ఈ బృందాల ఉద్దేశం కాగితంపై సూటిగా ఉంటుంది. కాంట్రాక్టర్లు నిజమైన వినియోగదారులు సమర్పించిన ప్రాంప్ట్‌లను చదివి, ChatGPT ఇచ్చిన సమాధానాలను రేటు చేసి విమర్శిస్తారు. ఆ ఫీడ్‌బ్యాక్ తిరిగి శిక్షణ ప్రక్రియలోకి వెళుతుంది, తదుపరిసారి సమానమైన అభ్యర్థన వచ్చినప్పుడు మోడల్ ఎలా ప్రవర్తిస్తుందో దాన్ని రూపొందిస్తుంది.

పరిధి ఒంటరి ఒక-లైన్ ప్రశ్నల కంటే విస్తృతం. సమీక్షకులకు వినియోగదారుడు మరియు ఛాట్‌బాట్ మధ్య పూర్తి సంభాషణలు చూపించబడవచ్చు, అంటే మొత్తం మాటల ప్రయాణం — ఫాలో-అప్‌లు, సవరణలు, మార్గమధ్యంలో స్వచ్ఛందంగా ఇచ్చిన వివరాలు — ఒక వ్యక్తి ముందు నుండి వెళ్లవచ్చు. నాణ్యమైన అవుట్‌పుట్ ఏది అనే దానికి సూచన మార్గదర్శకాలు కఠినమైన ప్రమాణాన్ని నిర్దేశిస్తాయి; వినియోగదారుడి అసలు ఉద్దేశాన్ని అర్థం చేసుకుని, ఖచ్చితమైన మరియు ఉపయోగకరమైన సహాయం అందించి, తగిన స్థాయి ఆత్మీయతతో స్పష్టంగా, సహజంగా చదవగలిగే సమాధానాన్ని అద్భుతమైన సమాధానంగా వర్ణిస్తాయి.

పరిమాణమే ఇక్కడ ముఖ్యం. నిరంతర ప్రాంప్ట్ ప్రవాహంలో పనిచేసే వందలాది సమీక్షకులు అంటే నిజమైన సంభాషణలు పెద్ద ఎత్తున వినియోగించబడుతున్నాయి, అప్పుడప్పుడు తనిఖీ కోసం నమూనాలు తీసుకోవడం కాదు. రోజువారీ భారీ ప్రశ్నల ప్రవాహాన్ని నిర్వహించే ఉత్పత్తిని కలిగి ఉన్న కంపెనీకి, ఆ మానవ పొర ఒకసారి జరిపే ఆడిట్ కాకుండా మెరుగుదల చక్రంలో శాశ్వత భాగమవుతుంది.

వందల మిలియన్ల మందికి గోప్యతా అంధ మచ్చ

OpenAI సమీక్షకులకు వినియోగదారు పేర్లను ఇవ్వదు, మరియు ప్రాంప్ట్‌లు మనుషుల కళ్లకు చేరే ముందు వ్యక్తిగత వివరాలను తొలగించడానికి తాము కృషి చేస్తామని కంపెనీ చెబుతుంది. కానీ ఆ ఫిల్టరింగ్ నుండి సున్నితమైన సమాచారం ఇప్పటికీ తప్పించుకుని చదివే వ్యక్తుల వరకు చేరగలదని కంపెనీ అంగీకరించింది.

Inside ‘Project Lily’: The Humans Reading Your ChatGPT Chats
Image: Spumoni Cooperative for 404 Media.

ఆ భేదం ఆచరణలో అత్యంత ముఖ్యం. ఖాతా స్థాయిలో అనామకత్వం అనేది సారాంశంలో అనామకత్వం కాదు. ఒక ప్రాంప్ట్ నిర్ధారణ, విడాకులు, అప్పు, కార్యాలయ ఘర్షణ, లేదా ఒక వ్యక్తిగత భయాన్ని వివరిస్తే, గుర్తించే విలువ ఆ కంటెంట్‌లోనే ఉంటుంది, దానికి జోడించిన హ్యాండిల్‌లో కాదు.

మరియు ప్రజలు తీసుకొచ్చేది సరిగ్గా అదే కంటెంట్. ChatGPT ఒక మానసిక చికిత్సకుడి మంచం, ఒక వృత్తిపరమైన సహాయకుడు, కొన్ని సందర్భాల్లో ఒక డిజిటల్ తోడు అయింది. వినియోగదారులు తమ ఆరోగ్యం, సంబంధాలు, డబ్బు, ఆందోళనల గురించి అత్యంత వ్యక్తిగత వివరాలను సాధారణంగా అప్పగిస్తారు — తరచుగా ఆ పరస్పర చర్య గోప్యంగా, తక్షణమైనదిగా, ఎవరూ గమనించనిదిగా అనిపించడం వల్లనే.

"వారు ఊహించి ఉండరు అని నేను అనుకోను"

అవగాహనకూ వాస్తవికతకూ మధ్య ఉన్న అంతరమే ఈ కథ యొక్క కేంద్రం. ChatGPT వినియోగదారులు తమ సంభాషణలను మనుషులు చదువుతూ ఉండవచ్చని అర్థం చేసుకున్నారని తాను భావిస్తున్నారా అని అడిగినప్పుడు, ప్రాంప్ట్‌లతో పనిచేసే ఒక వ్యక్తి నేరుగా సమాధానమిచ్చాడు. లేదు అన్నాడు, ఎక్కడో ఒక కాంట్రాక్టర్ ఆ సంభాషణలను విశ్లేషిస్తున్నాడని వినియోగదారులు ఊహించరని జోడించాడు.

ఆ ఆశ అప్పటికప్పుడు సమంజసంగా ఉంటుంది. చాట్ విండోతో పరస్పర చర్య చేసే చాలామందికి, నాణ్యత మెరుగుదల కార్యక్రమంలో భాగంగా ఒక వ్యక్తి తర్వాత తమ మాటలను చూసి వెళ్లవచ్చని సూచించే ఎటువంటి కనిపించే సంకేతం ఉండదు. మోడల్ ట్యూనింగ్ కోసం ప్రాంప్ట్‌లను చదవడం అనేది కొత్త ఫీచర్ లేదా భద్రతా విధాన నవీకరణలా ప్రచారం చేయబడదు.

సైకోఫెన్సీ, మానవీకరణ, మరియు నిజమైన హాని

అంతర్గత పత్రాలు సమీక్షకులు ఏమి సరిదిద్దాలని అడగబడుతున్నారో కూడా వెల్లడిస్తాయి. నివేదిక ప్రకారం, ChatGPT తనను తాను మానవీకరించుకోవడం నుండి — భావాలు లేదా శాశ్వత అంతర్గత జీవితం ఉన్న వ్యక్తిలా తనను చూపించుకోవడం నుండి — దూరంగా మళ్లించడానికి, మరియు దాని సైకోఫెన్సీని, అంటే వినియోగదారులను ఎదిరించకుండా మెచ్చుకోవడం, ఒప్పుకోవడం అనే ప్రతిచర్య ధోరణిని తగ్గించడానికి కాంట్రాక్టర్లు శిక్షణ పొందుతారు.

అవి పైపైన కనిపించే విచిత్రాలు కావు. OpenAI యొక్క 4o మోడల్‌లో అతిగా ఉన్న సైకోఫెన్సీ, అనేక మంది ఆత్మహత్యలకు దోహదపడిన అంశంగా కోర్టు కేసుల్లో ప్రస్తావించబడింది. ఒక వ్యక్తి చెప్పేది ఏదైనా సరే దాన్ని ధృవీకరించేలా ఒక వ్యవస్థ ట్యూన్ చేయబడితే, దాని పరిణామాలు కొద్దిగా చిరాకు కలిగించే ఛాట్‌బాట్ సమాధానాన్ని చాలా దాటి వెళ్లవచ్చు. మానవ సమీక్ష పొర, కొంతవరకు, ఆ వైఫల్య విధానాన్ని మొద్దుబార్చే ప్రయత్నం.

భద్రతా సమీక్షతో సమానం కాదు

ఈ పనిని OpenAI బహిరంగంగా వివరించిన భద్రతా చర్యల నుండి వేరు చేయడం విలువైనది. ఇతర ప్రజలకు హాని చేయాలని ప్లాన్ చేస్తున్నట్లు కనిపించే వినియోగదారులను కంపెనీ గుర్తించినప్పుడు చాట్‌లను సమీక్షించడం వాటిలో ఉంటుంది — ఇది ఒక సన్నిహిత, సంక్షోభ-కేంద్రిత జోక్యం.

Screenshot of the ChatGPT settings page.
Screenshot of the ChatGPT settings page.

కాంట్రాక్టర్లు నిర్వహించే ప్రాంప్ట్ సమీక్ష పూర్తిగా వేరే విధి, ఇది అత్యవసర గుర్తింపు కాకుండా రోజువారీ సమాధాన నాణ్యతను లక్ష్యంగా చేసుకుంటుంది. అందుకే అది ఎన్నో సాధారణ సంభాషణలను తాకుతుంది. కష్టమైన సందేశాన్ని రూపొందించడంలో సహాయం అడిగే లేదా వ్యక్తిగత నిర్ణయాన్ని ఆలోచించే వినియోగదారుడు సంక్షోభంలో లేడు, పరిశీలన ఉంటుందని ఆశించడానికి కారణం లేదు, అయినా వారి exchange సమీక్ష క్యూలో పడవచ్చు.

Anthropic కూడా ఇదే పద్ధతిని ధృవీకరిస్తుంది

ఈ విధానంలో OpenAI ఒంటరిది కాదు. తన మోడల్‌లను మెరుగుపరచడానికి మానవ సమీక్షను కూడా ఉపయోగిస్తామని Anthropic 404 మీడియాకు ధృవీకరించింది, ఇది నిజమైన వినియోగదారుల పరస్పర చర్యలను చదవడం ఒక కంపెనీ ఒంటరి ప్రయోగం కాదు, పరిశ్రమ పద్ధతి అని సూచిస్తుంది. ఈ ఆవిష్కరణ ప్రొవైడర్‌ను మార్చడం అంతర్లీన గోప్యతా ప్రశ్నను పరిష్కరిస్తుందనే ఏ ఊహనైనా క్లిష్టతరం చేస్తుంది.

మెరుగుదల భ్రమ వెనుక శ్రమ

AI మోడల్‌లు ఎందుకు మెరుగవుతూనే ఉంటాయనే ప్రసిద్ధ వివరణను కూడా ఈ నివేదిక సవాలు చేస్తుంది. సాధారణ కథనం ఇంటర్నెట్ టెక్స్ట్ యొక్క విస్తార స్క్రాపింగ్, మంచి వేతనం పొందే ఇంజినీరింగ్ మరియు పరిశోధన ప్రతిభ, మరియు వరుస తరాల సామర్థ్యవంతమైన ఆర్కిటెక్చర్‌లకు ఘనత ఇస్తుంది.

అవన్నీ ముఖ్యమే, కానీ అవి మరింత నిశ్శబ్దంగా, తరచుగా విస్మరించబడే ఒక విషయాన్ని వదిలేస్తాయి: నిజమైన ChatGPT సమాధానాలను పదేపదే, పెద్ద ఎత్తున చదివి రేటు చేయడానికి చెల్లించబడే బయటి కాంట్రాక్టర్లు. ఆ మానవ శ్రమ ఉత్పత్తిలో అర్థవంతమైన ఇన్‌పుట్, మరియు ఫ్రాంటియర్ వ్యవస్థలు ఎలా ముందుకు సాగుతాయనే ప్రజా కథనం నుండి అది చాలావరకు బయటే ఉంటుంది.

వినియోగదారులు గ్రహించవలసినది

  • ChatGPT గోప్యతా ఛానెల్ కాదు. మోడల్ మెరుగుదలపై పనిచేసే మానవ కాంట్రాక్టర్లు ప్రాంప్ట్‌లను చదవవచ్చు.
  • వినియోగదారు పేర్లను తొలగించడం సందర్భాన్ని తొలగించదు. వినియోగదారు స్వచ్ఛందంగా ఇచ్చే వివరాలు తమంతట తామే గుర్తించదగినవి కావచ్చు.
  • OpenAI స్వయంగా అంగీకరించినట్లు రిడాక్షన్ పరిపూర్ణం కాదు — సున్నితమైన సమాచారం ఇప్పటికీ సమీక్షకులకు చేరవచ్చు.
  • ఈ పద్ధతి ఒక కంపెనీకి పరిమితం కాదు; Anthropic కూడా ఇలాంటి మానవ సమీక్షను ధృవీకరించింది.
  • భద్రతకు సంబంధించిన చాట్ సమీక్ష మరియు నాణ్యతకు సంబంధించిన ప్రాంప్ట్ సమీక్ష వేర్వేరు కార్యక్రమాలు, మరియు రెండోది సాధారణ సంభాషణలను చేరుతుంది.

ఇవేవీ ఈ పద్ధతిని స్వయంచాలకంగా అక్రమం చేయవు. వందల మిలియన్ల మంది తీవ్రమైన ప్రశ్నల కోసం ఆధారపడే వ్యవస్థను మెరుగుపరచడానికి ఏదో ఒక రూపంలో ఫీడ్‌బ్యాక్ అవసరం, మరియు మానవ తీర్పు అందుబాటులో ఉన్న అత్యంత ప్రభావవంతమైన సాధనాల్లో ఒకటిగా కొనసాగుతుంది. ప్రశ్న ఏమిటంటే, ఈ రాజీ వినియోగదారులు నిజంగా తూకం వేయగలిగే విధంగా వెల్లడించబడుతోందా అనేది.

ప్రస్తుతం, సమాధానం లేదు అనిపిస్తుంది. ఒక confession, వైద్య ప్రశ్న, లేదా కెరీర్ సంక్షోభాన్ని చాట్ బాక్స్‌లో టైప్ చేసే వ్యక్తికి, సమీక్ష క్యూలో ఉన్న ఒక కాంట్రాక్టర్ దాన్ని చదవవచ్చని చెప్పబడదు. ఆ అంతరాన్ని మూసివేయడం — స్పష్టమైన నోటీసు, బలమైన డీ-ఐడెంటిఫికేషన్, లేదా మరింత కఠినమైన ఫిల్టరింగ్ ద్వారా — ఇప్పుడు పరిశ్రమ ఎదుర్కొంటున్న పరీక్ష, మరియు పంపే ముందు వినియోగదారులకు ఎంత తెలుసుకోనివ్వబడుతుందనే దాని ద్వారా అది అంచనా వేయబడుతుంది.

ఈ వ్యాసం 404 మీడియా నివేదిక ఆధారంగా రూపొందించబడింది. అసలు వ్యాసాన్ని చదవండి.

Originally published on 404media.co