OpenAI এমন এক কর্মীবাহিনী গড়ে তুলছে, যাদের কাজ হলো মানুষ ChatGPT-তে কী টাইপ করে তা পড়া। 404 Media-র রিপোর্টে দেখা যায়, কোম্পানিটি শত শত কনট্রাক্টর নিয়োগ করছে যারা প্রকৃত ব্যবহারকারীর প্রম্পটের ভারী স্রোত নিয়ে কাজ করবে — এমন কথোপকথন, যা চ্যাটবটটির ৯০ কোটিরও বেশি ব্যবহারকারী সাধারণত ধরে নেন তাদের ও মেশিনের মধ্যেই সীমাবদ্ধ থাকে।
আউটলেটটি যা পর্যালোচনা করেছে তা কোনো একক ফাঁস হওয়া মেমো নয়, বরং একটি সম্পূর্ণ কাগজের trail: অভ্যন্তরীণ নির্দেশনা গাইড, রিভিউ টিমের ব্যবহৃত Slack চ্যানেল, প্রকৃত ChatGPT প্রম্পট এবং মডেলের উত্তর মূল্যায়নের জন্য কনট্রাক্টরদের ব্যবহৃত স্কোরিং রুব্রিক। এই উপাদানের অনেকটাই একটি অভ্যন্তরীণ ব্যানারের অধীনে রয়েছে, যাকে আউটলেটটি "প্রজেক্ট লিলি" বলে উল্লেখ করেছে, এবং এটি AI উন্নয়নের এমন এক দিক উন্মোচন করে যা লঞ্চ ব্লগ পোস্টে খুব কমই দেখা যায়।
প্রম্পট রিভিউ পাইপলাইনের ভেতরে
কাগজে-কলমে এই টিমগুলোর উদ্দেশ্য সোজাসাপ্টা। কনট্রাক্টররা প্রকৃত ব্যবহারকারীদের জমা দেওয়া প্রম্পট পড়েন, তারপর ChatGPT যে উত্তর দিয়েছে তা রেটিং ও সমালোচনা করেন। সেই ফিডব্যাক প্রশিক্ষণ প্রক্রিয়ায় ফিরিয়ে দেওয়া হয়, যা পরবর্তীতে অনুরূপ কোনো অনুরোধ এলে মডেল কেমন আচরণ করবে তা গড়ে তোলে।
পরিধি বিচ্ছিন্ন এক-লাইনের প্রশ্নের চেয়ে অনেক বিস্তৃত। রিভিউয়ারদের একজন ব্যবহারকারী ও চ্যাটবটের মধ্যে সম্পূর্ণ কথোপকথন দেখানো হতে পারে, অর্থাৎ একটি সম্পূর্ণ আদান-প্রদান — ফলো-আপ, সংশোধন, পথে স্বেচ্ছায় দেওয়া বিবরণ — একজন ব্যক্তির সামনে দিয়ে যেতে পারে। নির্দেশনা গাইডে মানসম্মত আউটপুট কী তা নিয়ে কঠোর মানদণ্ড নির্ধারণ করা হয়েছে, যেখানে একটি চমৎকার উত্তরকে বর্ণনা করা হয়েছে এমন একটি হিসেবে যা ব্যবহারকারীর প্রকৃত উদ্দেশ্য বোঝে, নির্ভুল ও সহায়ক সাহায্য দেয় এবং উপযুক্ত উষ্ণতা নিয়ে স্পষ্ট ও স্বাভাবিকভাবে পড়া যায়।
পরিমাণই মূল বিষয়। শত শত রিভিউয়ার প্রম্পটের একটানা প্রবাহ নিয়ে কাজ করছেন মানে প্রকৃত কথোপকথন বড় পরিসরে ব্যবহৃত হচ্ছে, মাঝে মাঝে স্পট চেকের জন্য নমুনা নেওয়া হচ্ছে না। এমন একটি কোম্পানির জন্য যার পণ্য প্রতিদিন বিপুল সংখ্যক কোয়েরি সামলায়, সেই মানব স্তরটি এককালীন অডিট নয় বরং উন্নয়ন চক্রের একটি স্থায়ী অংশ হয়ে ওঠে।
কোটি কোটি মানুষের জন্য গোপনীয়তার অন্ধবিন্দু
OpenAI রিভিউয়ারদের ব্যবহারকারীর নাম দেয় না, এবং কোম্পানি বলছে প্রম্পট মানুষের চোখে পৌঁছানোর আগে ব্যক্তিগত তথ্য বাদ দেওয়ার চেষ্টা করে। তবে কোম্পানি স্বীকার করেছে যে সংবেদনশীল তথ্য সেই ফিল্টারিং পার হয়ে পড়েন এমন ব্যক্তিদের কাছে পৌঁছাতে পারে।

এই পার্থক্যটি বাস্তবে অত্যন্ত গুরুত্বপূর্ণ। অ্যাকাউন্ট স্তরে নামহীনতা আর বিষয়বস্তুতে নামহীনতা এক নয়। যদি কোনো প্রম্পটে রোগনির্ণয়, বিবাহবিচ্ছেদ, ঋণ, কর্মক্ষেত্রের দ্বন্দ্ব বা কোনো ব্যক্তিগত ভয়ের বর্ণনা থাকে, তাহলে পরিচয় শনাক্তকারী মূল্য থাকে সেই বিষয়বস্তুতেই, তার সঙ্গে যুক্ত হ্যান্ডেলে নয়।
আর মানুষ ঠিক সেই বিষয়বস্তুই নিয়ে আসে। ChatGPT হয়ে উঠেছে থেরাপিস্টের কাউচ, পেশাদার সহকারী এবং কিছু ক্ষেত্রে ডিজিটাল সঙ্গী। ব্যবহারকারীরা নিয়মিতভাবে তাদের স্বাস্থ্য, সম্পর্ক, অর্থ ও দুশ্চিন্তা সম্পর্কে অন্তরঙ্গ বিবরণ দিয়ে থাকেন — প্রায়শই ঠিক এই কারণেই যে এই মিথস্ক্রিয়া ব্যক্তিগত, তাৎক্ষণিক ও অপর্যবেক্ষিত মনে হয়।
"আমার মনে হয় না তারা কল্পনা করবে"
ধারণা ও বাস্তবতার মধ্যে এই ফাঁকই এই প্রতিবেদনের মূল কথা। ChatGPT ব্যবহারকারীরা বুঝতে পারেন কি না যে মানুষ তাদের কথোপকথন পড়তে পারে — এমন প্রশ্নে প্রম্পট নিয়ে কাজ করা এক ব্যক্তি স্পষ্টভাবে উত্তর দেন। তিনি না বলেন, এবং যোগ করেন যে ব্যবহারকারীরা কল্পনাও করবেন না যে কোথাও কোনো কনট্রাক্টর তাদের কথোপকথন বিশ্লেষণ করছেন।
এই প্রত্যাশা আপাতদৃষ্টিতে যুক্তিসঙ্গত। চ্যাট উইন্ডোতে মিথস্ক্রিয়া করা বেশিরভাগ মানুষের কাছে কোনো দৃশ্যমান সংকেত থাকে না যে পরে কোনো ব্যক্তি গুণমান উন্নয়ন কর্মসূচির অংশ হিসেবে তাদের লেখা স্ক্রল করে যাবেন। মডেল টিউনিংয়ের জন্য প্রম্পট পড়া নতুন কোনো ফিচার বা নিরাপত্তা নীতি হালনাগাদের মতো প্রচারিত হয় না।
সাইকোফ্যান্সি, নরত্বারোপ ও প্রকৃত ক্ষতি
অভ্যন্তরীণ নথিগুলো আরও প্রকাশ করে যে রিভিউয়ারদের কী সংশোধনের জন্য বলা হচ্ছে। রিপোর্ট অনুযায়ী, কনট্রাক্টরদের প্রশিক্ষণ দেওয়া হয় ChatGPT-কে নিজের প্রতি নরত্বারোপ থেকে বিরত রাখতে — অর্থাৎ নিজেকে এমনভাবে উপস্থাপন করা যেন সে অনুভূতি বা স্থায়ী অন্তর্জীবনসম্পন্ন একজন ব্যক্তি — এবং এর সাইকোফ্যান্সি কমাতে, অর্থাৎ ব্যবহারকারীদের তোষামোদ করা ও সম্মত হওয়ার প্রতিবর্তী প্রবণতা, প্রতিবাদ করার বদলে।
এগুলো কোনো বাহ্যিক খুঁত নয়। OpenAI-এর 4o মডেলে অতিরিক্ত সাইকোফ্যান্সিকে একাধিক মানুষের আত্মহত্যার সহায়ক কারণ হিসেবে মামলায় উল্লেখ করা হয়েছে। যখন কোনো সিস্টেমকে এমনভাবে টিউন করা হয় যে সে ব্যক্তি যা-ই বলুক তা যাচাই করে, তখন তার পরিণতি মৃদু বিরক্তিকর চ্যাটবট উত্তরের চেয়ে অনেক দূর পর্যন্ত পৌঁছাতে পারে। মানব রিভিউ স্তরটি আংশিকভাবে সেই ব্যর্থতার ধরন প্রশমিত করার একটি প্রচেষ্টা।
নিরাপত্তা রিভিউয়ের সমান নয়
এই কাজটিকে OpenAI যে নিরাপত্তা ব্যবস্থার কথা প্রকাশ্যে বলেছে তার থেকে আলাদা করা মূল্যবান। এর মধ্যে রয়েছে ব্যবহারকারীরা অন্য মানুষের ক্ষতির পরিকল্পনা করছেন বলে কোম্পানির সনাক্ত হলে চ্যাট পর্যালোচনা — একটি সংকীর্ণ, সংকট-কেন্দ্রিক হস্তক্ষেপ।

কনট্রাক্টরদের দ্বারা পরিচালিত প্রম্পট রিভিউ সম্পূর্ণ ভিন্ন একটি কার্যক্রম, যার লক্ষ্য জরুরি সনাক্তকরণের বদলে দৈনন্দিন উত্তরের গুণমান। ঠিক এই কারণেই এটি এত সাধারণ কথোপকথন স্পর্শ করে। কোনো ব্যবহারকারী কঠিন বার্তা খসড়া করতে সাহায্য চাইলে বা ব্যক্তিগত সিদ্ধান্ত নিয়ে ভাবলে তিনি সংকটে নেই এবং তার পর্যালোচনার কোনো কারণ নেই, তবুও তার আদান-প্রদান একটি রিভিউ কিউতে পড়তে পারে।
Anthropic একই প্রথার সত্যতা নিশ্চিত করেছে
এই পদ্ধতিতে OpenAI একা নয়। Anthropic 404 Media-কে নিশ্চিত করেছে যে তারাও মডেল উন্নয়নে মানব রিভিউ ব্যবহার করে, যা ইঙ্গিত দেয় প্রকৃত ব্যবহারকারীর মিথস্ক্রিয়া পড়া একটি শিল্প-প্রথা, কোনো এক কোম্পানির বিচ্ছিন্ন পরীক্ষা নয়। এই তথ্য যে কোনো ধারণাকে জটিল করে তোলে যে সরবরাহকারী বদলালে অন্তর্নিহিত গোপনীয়তার প্রশ্নের সমাধান হয়।
উন্নয়নের মায়ার পেছনের শ্রম
এই রিপোর্ট AI মডেল কেন ক্রমশ উন্নত হচ্ছে তার একটি জনপ্রিয় ব্যাখ্যাকেও চ্যালেঞ্জ করে। প্রচলিত বর্ণনায় কৃতিত্ব দেওয়া হয় ইন্টারনেট টেক্সটের বিপুল স্ক্র্যাপিং, ভালো বেতনের ইঞ্জিনিয়ারিং ও গবেষণা প্রতিভা এবং ক্রমাগত আরও সক্ষম আর্কিটেকচারের প্রজন্মকে।
এগুলো সবই গুরুত্বপূর্ণ, তবে এগুলো একটি শান্ত ও প্রায়শই উপেক্ষিত বিষয় বাদ দেয়: প্রকৃত ChatGPT উত্তরের পুনঃপুনঃ ও বড় পরিসরে পড়া ও রেটিং দেওয়ার জন্য বাইরের কনট্রাক্টরদের অর্থ প্রদান। সেই মানব শ্রম পণ্যটির একটি অর্থবহ ইনপুট, এবং ফ্রন্টিয়ার সিস্টেম কীভাবে এগিয়ে যায় তা নিয়ে জনসাধারণের বর্ণনার বাইরে এটি মূলত অবস্থান করে।
ব্যবহারকারীদের যা বুঝে নেওয়া উচিত
- ChatGPT কোনো গোপনীয় চ্যানেল নয়। মডেল উন্নয়নে কাজ করা মানব কনট্রাক্টররা প্রম্পট পড়তে পারেন।
- ব্যবহারকারীর নাম মুছে ফেললে প্রসঙ্গ মুছে যায় না। ব্যবহারকারীর স্বেচ্ছায় দেওয়া বিবরণ নিজেই পরিচয় শনাক্তকারী হতে পারে।
- OpenAI-র নিজের স্বীকৃতি অনুযায়ী রিড্যাকশন নিখুঁত নয় — সংবেদনশীল তথ্য তবুও রিভিউয়ারদের কাছে পৌঁছাতে পারে।
- এই প্রথা এক কোম্পানির বাইরেও বিস্তৃত, Anthropic অনুরূপ মানব রিভিউয়ের সত্যতা নিশ্চিত করেছে।
- নিরাপত্তা-সম্পর্কিত চ্যাট রিভিউ ও গুণমান-সম্পর্কিত প্রম্পট রিভিউ আলাদা কর্মসূচি, এবং পরেরটি রুটিন কথোপকথন পর্যন্ত পৌঁছায়।
এগুলোর কোনোটিই স্বয়ংক্রিয়ভাবে এই প্রথাকে অবৈধ করে না। কোটি কোটি মানুষ গুরুতর প্রশ্নের জন্য যে সিস্টেমের উপর নির্ভর করে তা উন্নত করতে কিছু ফিডব্যাক প্রয়োজন, এবং মানব বিচার এখনও সবচেয়ে কার্যকর উপকরণগুলোর একটি। প্রশ্ন হলো, এই বিনিময়টি ব্যবহারকারীরা সত্যিই বিবেচনা করতে পারেন এমনভাবে প্রকাশ করা হচ্ছে কি না।
এই মুহূর্তে উত্তরটি মনে হয় না। যে ব্যক্তি চ্যাট বক্সে একটি স্বীকারোক্তি, চিকিৎসা সংক্রান্ত প্রশ্ন বা কর্মজীবনের সংকট টাইপ করছেন তাকে বলা হয় না যে রিভিউ কিউতে থাকা কোনো কনট্রাক্টর তা পড়তে পারেন। এই ফাঁক বন্ধ করা — স্পষ্ট নোটিশ, আরও শক্তিশালী ডি-আইডেন্টিফিকেশন বা আরও কঠোর ফিল্টারিংয়ের মাধ্যমে — এখন শিল্পটি যে পরীক্ষার মুখোমুখি তা, এবং ব্যবহারকারীরা পাঠানোর বোতাম চাপার আগে কতটা জানতে পারবেন তা দিয়েই এর বিচার হবে।
এই নিবন্ধটি 404 Media-র রিপোর্টের উপর ভিত্তি করে। মূল নিবন্ধটি পড়ুন।
Originally published on 404media.co



