படிப்பவர்களுக்கல்ல, சாட்போட்டுகளுக்காக உருவாக்கப்பட்டதாகத் தோன்றும் ஒரு இணையதளம்

404 Media-வின் ஒரு அறிக்கை, பொது வலையில் உருவாகிக் கொண்டிருக்கும் ஒரு புதிய வகை செல்வாக்கு நடவடிக்கையை விவரிக்கிறது: மனித வாசகர்களை நேரடியாக நம்பவைக்காமல், அவர்கள் கேள்விகளுக்கு விடை அளிக்க அதிகமாக பயன்படுத்தப்படும் அமைப்புகளை வடிவமைக்கவே உருவாக்கப்பட்டதுபோல் தோன்றும் ஒரு செயற்கை திங்க் டாங்க். அந்த செய்தித்தளம் கூறுவதாவது, இஸ்ரேல் நிதியளிப்பில், அமெரிக்க விளம்பர நிறுவனம் Piro Inc. இயக்கும் Hanover Institute for Public Policy, ஒரு மாதத்துக்கும் குறைவான காலத்தில் 100-க்கும் மேற்பட்ட கட்டுரைகளை வெளியிட்டுள்ளது; அவற்றின் தெளிவான நோக்கம் AI சாட்போட் பதில்களை இஸ்ரேலுக்கு சாதகமான திசையில் தள்ளுவதாகும்.

இந்தக் கூற்றின் முக்கியத்துவம் ஒரு இணையதளம் அல்லது ஒரு மோதல் என்பதைக் கடந்து செல்கிறது. இது துல்லியமானதாக இருந்தால், அது ஒரு உருவெடுக்கும் தகவல்-தந்திரத்தைக் குறிக்கிறது: பெரிய மொழி மாதிரிகளும் AI தேடல் அமைப்புகளும் இப்போது தகவல் சங்கிலியில் மிக முக்கியமானவையாகி விட்டதால், அவற்றை பாதிப்பதே தனித்துவமான ஒரு தகவல் தொடர்பு இலக்காக மாறுகிறது என்ற எளிய கருதுகோளின் மீது அமைந்த தந்திரம்.

இது பாரம்பரிய search engine optimization-இலிருந்து வேறுபடும், இரண்டும் ஓரளவு ஒன்றோடொன்று重叠 இருந்தாலும் கூட. வழக்கமான SEO, மக்கள் கிளிக் செய்யும்படி இணையப்பக்கங்களை தேடல் தரவரிசையில் மேலே தள்ள முயல்கிறது. இந்த புதிய அணுகுமுறை, AI அமைப்புகள் பதில்கள் உருவாக்கும்போது உறிஞ்சி, சுருக்கி, அல்லது மேற்கோள் காட்டக்கூடிய பொருளால் வலைவை நிரப்ப முயல்கிறது. அந்த சூழலில், இலக்கு பார்வையாளர்கள் ஓரளவு இயந்திரம் வாசிக்கக்கூடிய உட்கட்டமைப்பாக உள்ளனர்.

கேள்வி தலைப்புகள், மூல ஆதாரங்களைச் சுமக்கும் பாணி, மற்றும் byline-கள் இல்லை

404 Media-வின் படி, Hanover Institute இஸ்ரேல், பாலஸ்தீன், மற்றும் யூதவிரோதம் குறித்த கட்டுரைகளை தொடர்ச்சியாக வெளியிடுகிறது, பெரும்பாலும் சில நாட்களுக்கு ஒருமுறை சுமார் ஒரு டஜன். அந்த கட்டுரைகள் அடையாளம் காணக்கூடிய ஒரு கட்டமைப்பை பகிர்ந்து கொள்கின்றன என்று கூறப்படுகிறது. அவற்றின் தலைப்புகள் கேள்விகளாக வடிவமைக்கப்பட்டுள்ளன. அவற்றில் வரைபடங்கள் உள்ளன. அவை உண்மையான மூலங்களை மேற்கோள் காட்டுகின்றன, ஆனால் அவற்றுக்கான இணைப்புகளை வழங்கவில்லை. மேலும் அவற்றில் byline-கள் இல்லை.

பெயரிடப்பட்ட ஆசிரியர்கள் இல்லாததற்கான தளத்தின் சொந்த விளக்கம் என்னவெனில், நிறுவன வெளியீட்டாளர்கள் பெரும்பாலும் அடையாளம் தெரியாத அல்லது கூட்டு ஆசிரியக் குறிப்பைப் பயன்படுத்துவார்கள்; மேலும் வாசகர்கள் எழுதியவரின் அடையாளத்தை விட மேற்கோள் காட்டப்பட்ட பொருளையே மதிப்பிட வேண்டும். பொறுப்பான பதிவாளர் ஒவ்வொரு பக்கத்தின் அடியிலும், மேலும் US Department of Justice-க்கு செய்யப்பட்ட தாக்கல்களிலும் வெளியிடப்பட்டுள்ளதாகவும் அது கூறுகிறது.

இந்த பாதுகாப்பு குறிப்பிடத்தக்கது, ஏனெனில் அது கொள்கை வெளியீடுகள் மற்றும் ஆராய்ச்சி நிறுவனங்களின் வெளிப்புற நடைமுறைகளை ஏற்றுக்கொள்கிறது. ஆனால் 404 Media-வின் அறிக்கை, அந்த உள்ளடக்கம் பல நேரங்களில் ஆழமான ஆசிரியச் சோதனையை தாங்குவதற்குப் பதிலாக, அமைப்பு-சிக்னல்களை திருப்திப்படுத்த உருவாக்கப்பட்டதுபோல் படிக்கப்படுவதாகச் சொல்கிறது. செய்தித்தளம் மேற்கோள் காட்டிய ஒரு எடுத்துக்காட்டில், அந்த உரை தொழில்நுட்பச் சொற்கள் நிரம்பிய, புரிந்து கொள்ள கடினமான மொழிக்குள் விலகி, மனித வாசகர்களுக்கான அதன் செல்வாக்கு வலிமையை குறைக்கிறது என்று விவரிக்கப்படுகிறது.

அந்த பொருந்தாமைதான் இந்தக் கதையின் மையம். ஒருவருக்குப் பொருத்தமற்றதாக அல்லது நம்பமுடியாததாகத் தோன்றும் உள்ளடக்கம், அதில் சரியான தலைப்பு விசைச் சொற்கள், framing கருவிகள், மற்றும் AI அமைப்புகள் அல்லது retrieval pipelines எடுத்துக்கொள்ளக்கூடிய மேற்கோள் வடிவங்கள் இருந்தால், இயந்திர-மைய செல்வாக்கு தந்திரத்தில் இன்னும் பயனுள்ளதாக இருக்க முடியும்.

உள்ளடக்கம் இயந்திரத்தால் உருவாக்கப்பட்டது என்பதற்கான ஆதாரம்

404 Media, Pangram எனும் AI கண்டறிதல் கருவியுடன் சோதித்த மூன்று Hanover Institute கட்டுரைகள், bibliographic sections தவிர முழுவதும் AI எழுத்தாகக் கண்டறியப்பட்டதாக தெரிவித்தது. தளத்தின் படங்களும் AI-யால் உருவாக்கப்பட்டவை என்றும் அந்த அறிக்கை கூறுகிறது.

AI கண்டறிதல் கருவிகள் எழுத்துரிமையின் முழுமையான நீதிபதிகள் அல்ல; இதுபோன்ற கூற்றுகள் விவாதிக்கப்படும் போதெல்லாம் அது முக்கியமானது. ஆனால் இந்த வழக்கில், கண்டறிதல் முடிவு கட்டுரையில் விவரிக்கப்பட்ட பிற சிக்னல்களுடன் சேர்ந்துள்ளது: உயர்ந்த வெளியீட்டு வேகம், சூத்திரமயமான கட்டமைப்பு, அசாதாரணமான உரைநடை, மற்றும் இயந்திர அணுகலுக்காகத் தயாரிக்கப்பட்டது போலத் தோன்றும் உட்கட்டமைப்பு. இவை அனைத்தையும் சேர்த்து பார்க்கும் போது, தளம் பெரும் அளவில் ஒரு செயற்கை வெளியீட்டு அமைப்பாக இயங்குகிறது என்ற முடிவை ஆதரிக்கின்றன.

முக்கியமானது வெறும் கட்டுரைகள் எழுத AI பயன்படுத்தப்பட்டது என்பதல்ல. அது ஏற்கனவே இணையத்தில் பொதுவானதே. அதைவிட முக்கியமானது உற்பத்திக்குப் பின்னுள்ள நோக்கம்: தொழிலாளர் செலவைக் குறைப்பது மட்டும் அல்ல, AI அமைப்புகள் பொதுப் பக்கங்களை தொடர்ந்து ஸ்கேன் செய்து, அவற்றை உருவாக்கப்படும் பதில்களுக்கு தகவலாகப் பயன்படுத்தும் ஒரு சூழலுக்கு திட்டமிட்ட வகையில் பொருந்துதல்.

llms.txt-இன் பங்கு மற்றும் சாட்போட் செல்வாக்கு வணிக மாதிரி

404 Media அறிக்கையின் மிக வெளிப்படுத்தும் விவரங்களில் ஒன்று, Hanover தளத்தில் llms.txt என்ற கோப்பு இருப்பதாகும். இது மொழி மாதிரிகள் தள உள்ளடக்கத்தை எளிதாக scrape செய்ய அல்லது புரிந்துகொள்ள உதவ உருவாக்கப்பட்ட வடிவம். தன்னிச்சையாகப் பார்த்தால், அந்த கோப்பு கையாளும் நோக்கத்தை நிரூபிப்பதில்லை. பல வெளியீட்டாளர்களும் டெவலப்பர்களும் AI அமைப்புகளுக்கு உள்ளடக்க அமைப்பைச் சுட்டிக்காட்ட புதிய வழிகளைப் பரிசோதித்து வருகின்றனர்.

ஆனால் அந்த விவரம் மற்றொன்றுடன் சேர்க்கப்படுகிறது: பெயரிடப்பட்ட விநியோகஸ்தரான Piro, தனது சொந்த இணையதளத்தில் சாட்போட் பதில்களை மாற்றும் சேவையை விளம்பரப்படுத்துகிறது. இந்த உண்மைகள் ஒன்றாகப் பார்க்கையில், மனிதர்களுக்கான ஊடகச் சேனல்களை மட்டும் அல்லாது, AI-மூலமாக நடக்கும் தகவல் அமைப்புகளுக்குள் காட்சிப்படுதலையும் வடிவமைக்க ஒரு மூலோபாய முயற்சி நடக்கிறது என்பதைக் காட்டுகிறது.

அதுவே Hanover வழக்கை வெறும் தானியங்கி பிரச்சாரக் கதையாகவிட அதிகமாக்குகிறது. இது LLM செல்வாக்கின் வணிகமயமாக்கலின் கதை. நிறுவனங்கள் சாட்போட் வெளியீடுகளை மாற்றுவதையே குறிக்கோளாகக் கொண்ட சேவைகளை வழங்குகிறார்கள் என்றால், செயற்கை அதிகாரம், இயந்திரம் வாசிக்கக்கூடிய வெளியீடு, மற்றும் உருவாக்கப்பட்ட இடைமுகங்களுக்குள் நடக்கும் கதைப் போட்டி ஆகியவற்றைச் சுற்றி புதிய சந்தை உருவாகிறது.

AI தேடலுக்கு இது ஏன் முக்கியம்

AI மேலோட்டங்கள், சாட்போட் பாணி தேடல், மற்றும் retrieval-augmented assistants அதிகரிக்கும் நிலையில், அந்த கருவிகளின் பின்னுள்ள மூல ஆதார சூழல் ஒரு வளர்ந்து வரும் கொள்கை மற்றும் தளம் சார்ந்த பிரச்சினையாகிறது. இணையத்தில் எப்போதும் பாகுபாடான, குறைந்த தரமான, அல்லது மூலோபாய உள்ளடக்கங்கள் இருந்துள்ளன. AI காலத்தில் மாறுவது சுருக்கப் படலம். பயனர்கள் பல இணைப்புகளை ஒப்பிடுவதற்குப் பதிலாக, இப்போது பலர் அடிப்படை மூலச் சூழலின் பெரும்பகுதியை சுருக்கி விடும் ஒரு ஒருங்கிணைக்கப்பட்ட பதிலைப் பெறுகிறார்கள்.

இந்த abstraction, மூலக் குளத்தில் இருப்பதன் மதிப்பை அதிகரிக்கிறது. அதே சமயம், ஒருங்கிணைந்த உள்ளடக்க இயக்கங்களை இறுதிப் பயனர்களுக்குப் பிடிக்கவும் கடினமாக்குகிறது. ஒரு மாதிரி செயற்கை வெளியீடுகளின் தொகுப்பால் பாதிக்கப்பட்டு சமநிலைபோல் தோன்றும் பதிலை உருவாக்கினால், அந்த வெளியீட்டின் பின்னுள்ள இயந்திர அமைப்பை பயனர் ஒருபோதும் பார்க்காமல் போகலாம்.

அதனால் Hanover வழக்கு AI நிறுவனங்களுக்கும் தேடல் தளங்களுக்கும் எளிதில் புறக்கணிக்க முடியாத கேள்விகளை எழுப்புகிறது. ஆராய்ச்சி நிறுவனங்களைப் போல நடிக்கும் அமைப்புகளின் நம்பகத்தன்மையை அமைப்புகள் எவ்வாறு மதிப்பிட வேண்டும்? உண்மையான மூலங்களை மேற்கோள் காட்டினாலும் அவற்றுக்கு இணைப்பு தராத உள்ளடக்கத்திற்கு எவ்வளவு எடை அளிக்க வேண்டும்? உண்மையான நிறுவன வெளியீட்டுக்கும் இயந்திரத்தால் உருவாக்கப்பட்ட narrative laundering-க்கும் இடையில் அமைப்புகள் எப்படி வேறுபடுத்த வேண்டும்?

இவை விளிம்பு பிரச்சினைகள் அல்ல. இவை platform integrity, geopolitics, மற்றும் AI விநியோகத்தின் பொருளாதாரம் ஆகியவற்றின் சந்திப்பில் உள்ளன. பயனர்கள் உருவாக்கப்பட்ட சுருக்கங்களையே அதிகம் நம்பும் அளவிற்கு, அவை இலக்காக மாறுவதும் அதிகமாகிறது.

செயற்கை ஊடகத்தின் அடுத்த கட்டம் குறித்த எச்சரிக்கை

பெரிய பாடம் என்னவெனில், AI-யால் உருவாக்கப்பட்ட உள்ளடக்கம் இனி இணையத்தை வேறுபாடின்றி நிரப்புவதிலேயே இல்லை. அது கீழ்நிலை AI பயன்பாட்டிற்காக மூலோபாயமாக வடிவமைக்கப்படுகிறது. இது ஒரு மீள்சுழற்சி தகவல் சூழலை உருவாக்குகிறது; இதில் மாதிரிகள், தங்களைப் பாதிக்கவே உருவாக்கப்பட்ட உள்ளடக்கத்திலிருந்தே மேலும் கற்றுக்கொள்ளவோ அல்லது மீட்டெடுக்கவோ தொடங்கலாம்.

நடைமுறையில், Hanover Institute கதை, ஆன்லைன் கதை-கட்டுப்பாட்டிற்கான போராட்டம் AI retrieval மற்றும் synthesis அடுக்குகளுக்குள் நகர்கிறது என்பதைக் காட்டுகிறது. செல்வாக்கு நடவடிக்கைகள் இனி சமூக ஊடக feeds அல்லது தேடல் தரவரிசைகளில் மட்டும் வெல்ல வேண்டியதில்லை. சாட்போட்டுகள் நம்பத்தகுந்த நடுநிலை பதில்களை உருவாக்கும் உரை அடித்தளத்தையும் அவை விதைக்க முயலலாம்.

இது ஒரு குறிப்பிடத்தக்க மாற்றம்; கொள்கை நிர்ணயர்கள், ஆய்வாளர்கள், மற்றும் தள இயக்குநர்கள் இதை மிக கவனமாக எடுத்துக் கொள்ள வேண்டிய ஒன்று. பிரச்சினை வெறும் இணையத்தில் உள்ள போலியான உரை அல்ல. அது AI-யால் உருவாக்கப்பட்ட பதில்களில் பயனர்கள் வைக்கும் நம்பிக்கையை பயன்படுத்திக்கொள்ளும் machine-optimized வெளியீட்டு உத்திகளின் தோற்றம். செயற்கை திங்க் டாங்க் இன்று ஒரு குறுகிய எடுத்துக்காட்டு போல இருக்கலாம். ஆனால் அது நீண்ட காலம் அப்படியே இருக்காது என்பது சாத்தியம் குறைவு.

இந்தக் கட்டுரை 404 Media-வின் அறிக்கையினை அடிப்படையாகக் கொண்டது. மூலக் கட்டுரையைப் படிக்கவும்.

Originally published on 404media.co