அரசாங்க அழுத்தமும் மாடல் பாதுகாப்பின் எல்லைகளும்
Fable 5 மாடலை வெளியிடுவதைக் குறித்து அமெரிக்க அதிகாரிகளுக்கும் Anthropic-க்கும் இடையே ஏற்பட்டுள்ள சர்ச்சை, frontier AI கொள்கையில் ஒரு அடிப்படை பதற்றத்தை வெளிப்படுத்துகிறது: பரவலான வெளியீட்டுக்கு முன் மிகுந்த திறன் கொண்ட அமைப்புகள் பயனுள்ளதாகவே hack செய்ய முடியாதவையாக இருக்க வேண்டும் என்று அரசாங்கங்கள் விரும்பலாம், ஆனால் தொழில்நுட்பம் அந்தத் தரத்தை ஆதரிக்கக் கூடியதாகத் தெரியவில்லை.
மூலப் பொருளின் படி, நிர்வாக அதிகாரிகள் Anthropic மீது சமீபத்தில் வெளியிடப்பட்ட Trump cyber executive order-ஐ புறக்கணித்ததாக குற்றம் சாட்டுகிறார்கள்; காரணம், அரசாங்க clearinghouse ஒன்று அதைப் பரிசீலிக்க காத்திருக்காமல் நிறுவனம் Fable 5-ஐ வெளியிட்டதாகும். மாடல் வெளியிடப்பட்ட போது oversight framework இன்னும் முழுமையாக அமைக்கப்படவில்லை என்று அறிக்கை கூறுகிறது.
இந்த விமர்சனம் நடைமுறைத் தளத்திலேயே முடிவடைவதில்லை. மூலத்தில் மேற்கோள் காட்டப்பட்ட ஒரு அதிகாரி, jailbreak நிகழலாம் என்பதை Anthropic அறிந்திருந்தும் முன்னேறியதாகக் கூறுகிறார். குறிப்பிட்ட jailbreak-இன் இருப்பும் அதன் கடுமையும் மூல உரையில் உறுதிப்படுத்தப்படவில்லை; இருப்பினும், அந்தக் குற்றச்சாட்டு policy expectations மற்றும் large language model நடத்தை ஆகியவற்றின் நிஜங்களுக்கிடையிலான அதிகரிக்கும் மோதலை சுட்டிக்காட்டுகிறது.
மைய தொழில்நுட்பப் பிரச்சினை
இந்த சர்ச்சை Anthropic-இன் முடிவுகளைப் பற்றியது மட்டுமல்ல; அரசாங்கத்தின் AI புரிதல் பற்றியும் அதே அளவுக்கு பேசுகிறது என்று மூலம் வாதிடுகிறது. காரணம் நேரடியானது: advanced language models-உடன் நெருக்கமாகப் பணிபுரிபவர்கள் பொதுவாக prompt injection மற்றும் jailbreaks-ஐ முழுமையாக தீர்க்கப்பட்ட சிக்கல்களாக அல்ல, தொடர்ச்சியான அபாயங்களாகவே கருதுகிறார்கள்.
Prompt injection ஒருபோதும் முழுமையாகத் தீராதிருக்கலாம் என்று OpenAI எச்சரித்துள்ளதாக கட்டுரை குறிப்பிடுகிறது. இது முக்கியமானது, ஏனெனில் “unhackable” frontier models என்ற கோரிக்கை, தற்போதைய architectures மற்றும் deployment methods-உடன் நடைமுறையில் அடைய முடியாத ஒரு தரத்தை நிர்ணயிக்கிறது. எனவே நிஜமான கேள்வி ஒரு சக்திவாய்ந்த மாடல் ஒருபோதும் முழுமையாக secure ஆகுமா என்பதல்ல; மாறாக தோல்விகள் எவ்வளவு கடுமையானவை, countermeasures எவ்வளவு விரைவாக செயல்படுத்தப்படுகின்றன, மற்றும் எந்த use cases-க்கு வலுவான containment தேவைப்படுகிறது என்பதே.
Frontier models-க்கு ஏன் stakes அதிகம்
மாடல்கள் அறிவியல், தொழில்நுட்பம், அல்லது உயிரியல் சார்ந்த பணிகளில் உதவக்கூடியவையாக இருக்கும் போது policy tension இன்னும் கூர்மையாகிறது. அந்தப் பகுதிகளில் உள்ள safety protocols மீறப்பட்டால் jailbreak உயிர்-மரணக் கேள்வியாக மாறலாம் என்று Anthropic CEO Dario Amodei 2023-ல் கூறியதாக மூலம் நினைவூட்டுகிறது.
அதனால்தான் அதிகாரிகள் oversight மற்றும் release discipline மீது கடுமையாக அழுத்தம் கொடுக்கலாம் என்பது புரிகிறது. மேலும் jailbreak கவலைகளை சாதாரண இணையத் தொல்லையாக industry புறக்கணிக்க முடியாது என்பதையும் இது காட்டுகிறது. frontier நிலையில் தோல்விகள் dual-use knowledge, தவறான பயன்பாடு, அல்லது voluntary governance frameworks மீதான நம்பிக்கையின் சிதைவு ஆகியவற்றுக்கு விளைவுகளை ஏற்படுத்தலாம்.
இது security test மட்டுமல்ல; governance test கூட
Commerce Department அதிகாரிகளும் Anthropic ஊழியர்களும் பேச்சுவார்த்தையில் உள்ளதாகவும், CIA மற்றும் science adviser Michael Kratsios ஆகியோர் இணைந்து கூடுதல் சந்திப்புகள் திட்டமிடப்பட்டுள்ளதாகவும் அறிக்கை கூறுகிறது. மேலும் 100-க்கும் மேற்பட்ட security experts மற்றும் tech executives Fable 5-க்கு export controls கோரி ஒரு open letter-இல் கையெழுத்திட்டதாகவும் அது சொல்கிறது.
இந்த விவரங்களை ஒன்றாகப் பார்க்கும்போது, விவாதம் ஒரு மாடல் வெளியீட்டை மட்டும் பற்றியது அல்ல என்பது தெளிவாகிறது. acceptable risk-ஐ யார் வரையறுக்க வேண்டும், formal institutions உருவாகும் முன் voluntary oversight எப்படி செயல்பட வேண்டும், மற்றும் அமைப்பின் மீதான நம்பிக்கையை குலைக்காமல் AI நிறுவனங்கள் அரசுகளைக் காட்டிலும் வேகமாக நகர முடியுமா என்பதையும் அது பற்றியது.
- Planned review mechanism-ஐ காத்திருக்காமல் Anthropic Fable 5-ஐ வெளியிட்டதாக US officials கூறுகிறார்கள்.
- சர்ச்சை jailbreak risk மற்றும் அரசாங்க oversight சுற்றி மையமாகிறது.
- உண்மையில் unhackable LLMs-ஐ கோருவது தொழில்நுட்ப ரீதியாக நடைமுறையிலற்றதாக இருக்கலாம் என்று மூலம் வாதிடுகிறது.
பெரிய பாடம் கடினமானது, ஆனால் பயனுள்ளது. Frontier AI security, safe-or-unsafe என்ற இருவகை எல்லைக்குள் ஒன்றுபடாமல் இருக்கலாம். அதற்குப் பதிலாக, layered mitigation, கட்டுப்படுத்தப்பட்ட deployment choices, monitoring, மற்றும் release-க்குப் பிந்தைய response ஆகியவற்றின் கலவையாகவே தொடர வாய்ப்புள்ளது. இது விளக்குவதற்கு கடினமான governance model ஆக இருந்தாலும், மூலத்தில் விவரிக்கப்பட்ட தொழில்நுட்பத்துடன் அது சிறப்பாக பொருந்துகிறது.
கொள்கை வடிவமைப்பாளர்கள் இயல்பிலேயே முழு பாதுகாப்பை எதிர்க்கும் அமைப்புகளிடம் முழுமையான பாதுகாப்பைக் கேட்கத் தொடர்ந்தால், இப்படியான மோதல்கள் அதிகரிக்கும். AI governance-இன் அடுத்த கட்டம், இரு தரப்பும் இயலாத தரங்களை நீக்கி, அமுல்படுத்தக்கூடிய, தொழில்நுட்ப ரீதியாக உறுதியான தரங்களை ஏற்க முடியுமா என்பதையே சார்ந்திருக்கலாம்.
இந்தக் கட்டுரை The Decoder வெளியிட்ட செய்தியினை அடிப்படையாகக் கொண்டது. மூலக் கட்டுரையைப் படிக்கவும்.
Originally published on the-decoder.com
