தொடக்கத்திற்குப் பிறகு சில நாட்களிலேயே Anthropic அணுகலை நிறுத்தியது
Anthropic, தனது Fable 5 மற்றும் Mythos 5 மாடல்களை அறிமுகப்படுத்திய சில நாட்களிலேயே அவற்றுக்கான அணுகலை நிறுத்தியது. இந்த திடீர் மாற்றம், முன்னணி AI வெளியீடுகள் தேசிய பாதுகாப்பு கவலைகளுடன் எவ்வளவு விரைவாக மோதக்கூடும் என்பதை காட்டுகிறது. நிறுவனத்தின் கூற்றுப்படி, உடனடி தூண்டுதல் வெள்ளிக்கிழமை மாலை வழங்கப்பட்ட U.S. Commerce Department உத்தரவே; அதனால் புதிய மாடல்களுக்கு ஏற்றுமதி கட்டுப்பாடுகள் விதிக்கப்பட்டு, அமெரிக்காவிற்கு வெளியே பயன்பாடு கட்டுப்படுத்தப்பட்டது.
அரசின் உத்தரவுடன் விரைவாக இணங்குவதற்கான ஒரே வழி அதுவே என்பதால், அனைத்து வாடிக்கையாளர்களுக்கும் இரு மாடல்களையும் முடக்கியதாக நிறுவனம் கூறியது. Anthropic-இன் பிற மாடல்களுக்கு பாதிப்பு இல்லை. இந்த நடவடிக்கையின் வேகம் முக்கியமானது: இது மெதுவான பிராந்திய கட்டுப்பாடு அல்லது தற்காலிக rate limit அல்ல; சட்ட மற்றும் தொழில்நுட்ப விளைவுகளை Anthropic ஆராயும் போது, அதன் இரு புதிய அமைப்புகளையும் முழுமையாக நிறுத்தியது.
இடையீடு ஏன் ஏற்பட்டது
Ars Technica மேற்கோள் காட்டிய செய்திப்படி, cyber, chemistry, biology தொடர்பான prompts-இல் broad classifier-based safeguards-ஐ மீறக்கூடிய jailbreak குறித்த கோரிக்கைகள் காரணமாக நிர்வாக அதிகாரிகள் கவலைப்பட்டனர். அந்த விளக்கத்தின் படி, மாடல்கள் பரவலாக கிடைப்பதற்கு முன்பு, தேசிய பாதுகாப்பு அமைப்பை அந்த வகை அச்சுறுத்தலுக்கு எதிராக வலுப்படுத்த ஒரு இடைநிறுத்தம் வேண்டும் என்று அரசு கருதியது.
Anthropic இந்த பிரச்சினையின் தீவிரத்தைக் குறித்து பொது வெளியில் எதிர்ப்பு தெரிவித்தது. அரசு, சாத்தியமான narrow, non-universal jailbreak குறித்து வாய்மொழி ஆதாரங்களை வழங்கியதாக நிறுவனம் கூறியது. மேலும், தாம் பார்த்த ஆதாரங்கள் ஒரு குறிப்பிட்ட codebase review சூழலில் மாடல்கள் ஒப்பீட்டளவில் சிறிய மற்றும் எளிய software vulnerabilities-ஐ கண்டறிந்ததைக் காட்டுவதாகவும் Anthropic தெரிவித்தது.
அந்த வேறுபாடு முக்கியமானது. அடிப்படை கவலை safety controls-ன் பொது முறிவாக இல்லாமல், ஒரு குறுகிய exploit path ஆக இருந்தால், கொள்கை விளைவுகள் முற்றிலும் வேறுபடும். ஒரு வரையறுக்கப்பட்ட jailbreak, மாடலை patch செய்யலாம், கண்காணிக்கலாம் அல்லது தற்காலிகமாக கட்டுப்படுத்தலாம் என்பதைக் குறிக்கும். பரவலான தோல்வி இருந்தால், தொழில்துறை முழுவதும் recall-போன்ற தலையீட்டுக்கு வலுவான காரணம் கிடைக்கும்.
AI ஒழுங்குமுறைக்கான புதிய அழுத்தப் புள்ளி
இந்த shutdown, முன்னேறிய மாடல் வெளியீடுகளை அரசுகள் எவ்வாறு கையாளலாம் என்பதில் உருவாகும் பெரிய மாற்றத்தின் நடுவில் வருகிறது. Frontier AI labs கடந்த ஆண்டில் கடுமையான கண்காணிப்புக்குத் தயாராகி வருகின்றன, ஆனால் பொதுச் சாட்சியத்தில் பெரும்பாலான கவனம் தன்னார்வமான testing, disclosure, மற்றும் வெளியீட்டுக்குப் பிந்தைய monitoring மீதுதான் இருந்தது. இந்த நிகழ்வு இன்னும் வலுவான ஒரு விருப்பத்தைச் சுட்டுகிறது: launch-க்குப் பிறகு perceived misuse risk அல்லது பாதுகாப்பு குறைபாடுகளின் அடிப்படையில் நேரடி அரசுத் தலையீடு.
இந்த அளவுகோலை முழுத் துறையிலும் பயன்படுத்தினால் புதிய frontier-model rollout-கள் நடைமுறையில் உறைந்து போகலாம் என்று Anthropic வாதிட்டது. அது வெறும் retoric அல்ல. அளவில் already deployed ஆகும் ஒரு model-ஐ முடக்க, ஒரே ஒரு reported jailbreak கூட போதுமான காரணமாக மாறினால், ஒவ்வொரு பெரிய வெளியீடும் உடனடி regulatory exposure-ஐ எதிர்கொள்ள வேண்டியிருக்கும். அப்போது launch என்பது மதிப்பாய்வின் முடிவாக இல்லாமல், அதிக நிச்சயமற்ற oversight கட்டத்தின் தொடக்கமாக மாறும்.
ஒரு போட்டி பரிமாணமும் உள்ளது. மென்பொருள் பலவீனங்கள் குறித்த பகுப்பாய்வில் இதே போன்ற திறன்கள் பிற publicly available systems-இலும் உள்ளன என்று Anthropic கூறியது. அது உண்மை என்றால், ஒழுங்குபடுத்துநர்கள் குறிப்பிட்ட model-க்கு, குறிப்பிட்ட exploit method-க்கு, அல்லது சந்தையில் ஏற்கனவே உள்ள பரந்த dual-use திறன்களின் வகைக்கு பதிலளிக்கிறார்களா என்பதே முக்கியக் கேள்வியாகிறது. இவை ஒன்றே அல்ல, மேலும் எதிர்கால enforcement எவ்வளவு ஒரே மாதிரியாகத் தோன்றும் என்பதைப் பதிலே தீர்மானிக்கும்.
Anthropic-ஐத் தாண்டி இந்த நிகழ்வு ஏன் முக்கியம்
டெவலப்பர்கள் மற்றும் enterprise வாங்குநர்களுக்காக, முன்னணி மாடல்களுக்கான அணுகல் சாதாரண product planning-க்கு அப்பாற்பட்ட காரணங்களால் மறைந்து போகலாம் என்பதை இந்த நிகழ்வு நினைவூட்டுகிறது. புதிய model family-யை அடிப்படையாகக் கொண்டு tools, workflows, அல்லது internal systems உருவாக்கும் நிறுவனங்கள், vendor தேர்வில் regulatory continuity-யையும் கணக்கில் எடுக்க வேண்டியிருக்கலாம். ஒரு model-ன் benchmark performance மட்டுமே இனி risk variable அல்ல. Export status, deployment geography, மற்றும் அரசுத் திசைகளுக்கு provider எவ்வாறு பதிலளிக்க முடியும் என்பதும் சமமாக முக்கியமாகலாம்.
கொள்கை வகுப்பாளர்களுக்கு, சாதாரண coding மற்றும் research சூழல்களில் பயனுள்ளதாயினும் security risks எனவும் வடிவமைக்கக்கூடிய systems-ஐ நிர்வகிப்பதின் சிரமத்தை இந்த வழக்கு வெளிப்படுத்துகிறது. Frontier AI increasingly பல திறன்களை ஒரே model-இல் சுருக்குகிறது. அதனால் வரையறைகள் இடுவது கடினமாகிறது: bugs-க்காக software review செய்யும் model defensive security work-ஐ ஆதரிக்கலாம், ஆனால் அதே செயல்பாடு அதைச் சுற்றியுள்ள safeguards மீறப்பட்டால் கவலையைக் கிளப்பும்.
அடுத்ததாக என்ன நடக்கிறதோ, அது ஒரு precedent-ஐ உருவாக்கலாம். அறிக்கையில் மேற்கோள் காட்டப்பட்ட நிர்வாக ஆதாரங்கள், தேவையான hardening சில வாரங்களில் முடிவடையலாம் என்று தெரிவித்தன. இலக்கு வைத்து செய்யப்பட்ட fixes-க்குப் பிறகு அணுகல் திரும்பினால், இந்த நிகழ்வு கடுமையான ஆனால் தற்காலிக தலையீடாக நினைவில் கொள்ளப்படலாம். நம்பகமான jailbreak தோன்றும்போதெல்லாம் புதிய வெளியீடுகளை நிறுத்தும் template ஆக இது மாறினால், Washington மற்றும் முன்னணி AI systems உருவாக்கும் நிறுவனங்களுக்கிடையிலான உறவில் இது மிக முக்கியமான மாற்றமாக இருக்கும்.
இந்தக் கட்டுரை Ars Technica-வின் செய்தியின்மீது அடிப்படையாக உள்ளது. மூலக் கட்டுரையைப் படிக்கவும்.
Originally published on arstechnica.com

