ప్రభుత్వ ఒత్తిడి, మోడల్ భద్రత పరిమితులు

Fable 5 మోడల్ విడుదలపై అమెరికా అధికారులు మరియు Anthropic మధ్య జరిగిన వివాదం frontier AI విధానంలో ఒక మౌలిక ఉద్వేగాన్ని వెలికితీస్తోంది: విస్తృత విడుదలకు ముందు అత్యంత శక్తివంతమైన వ్యవస్థలు ప్రభావవంతంగా unhackable గా ఉండాలని ప్రభుత్వాలు కోరవచ్చు, కానీ ఆ ప్రమాణాన్ని సాంకేతికత మద్దతు ఇవ్వడం లేదు.

మూల సమాచారం ప్రకారం, తాజా Trump cyber executive order‌ను Anthropic పట్టించుకోలేదని పరిపాలన అధికారులు ఆరోపిస్తున్నారు, ఎందుకంటే ప్రభుత్వం ఏర్పాటు చేసిన clearinghouse సమీక్ష కోసం వేచి చూడకుండా Fable 5‌ను విడుదల చేసింది. మోడల్ విడుదలైన సమయంలో oversight framework ఇంకా పూర్తిగా ఏర్పాటుకాలేదని నివేదిక చెబుతోంది.

ఈ విమర్శ ప్రక్రియకే పరిమితం కాదు. మూలంలో ఉటంకించిన ఒక అధికారి, jailbreak జరగవచ్చని Anthropic‌కు తెలుసని, అయినా ముందుకు వెళ్లిందని అంటున్నారు. సంబంధిత నిర్దిష్ట jailbreak ఉనికి మరియు తీవ్రత మూల పాఠ్యంలో నిర్ధారించబడలేదు, కానీ ఈ ఆరోపణ policy expectations మరియు large language model ప్రవర్తన వాస్తవాల మధ్య పెరుగుతున్న ఘర్షణను సూచిస్తోంది.

మూల సాంకేతిక సమస్య

ఈ వివాదం Anthropic తీసుకున్న నిర్ణయాల గురించేగాక, ప్రభుత్వానికి AI గురించి ఉన్న అవగాహన గురించీ చాలా చెబుతోందని మూలం వాదిస్తోంది. కారణం స్పష్టమే: advanced language models‌తో దగ్గరగా పనిచేసేవారు సాధారణంగా prompt injection మరియు jailbreaks‌ను పూర్తిగా పరిష్కరమైన సమస్యలుగా కాక, నిరంతర ప్రమాదాలుగా భావిస్తారు.

prompt injection పూర్తిగా పరిష్కారంకాకపోవచ్చని OpenAI హెచ్చరించిందని వ్యాసం చెబుతోంది. ఇది ముఖ్యమైనది, ఎందుకంటే “unhackable” frontier models‌ను కోరడం ప్రస్తుత architectures మరియు deployment methods‌తో ఆచరణలో సాధ్యం కాకపోయే ప్రమాణాన్ని ఏర్పరుస్తుంది. అందువల్ల వాస్తవ ప్రశ్న ఒక శక్తివంతమైన మోడల్ ఎప్పుడైనా సంపూర్ణంగా secure అవుతుందా అన్నది కాదు; బదులుగా వైఫల్యాలు ఎంత తీవ్రమైనవి, countermeasures ఎంత వేగంగా అమలవుతున్నాయి, మరియు ఏ use cases‌కు మరింత కఠినమైన containment అవసరమో అన్నదే.

Frontier models‌కు stakes ఎందుకు ఎక్కువ

మోడళ్లు science, technology, లేదా biology సంబంధిత పనుల్లో సహాయపడగలిగినప్పుడు policy tension మరింత తీవ్రమవుతుంది. ఆ రంగాల చుట్టూ ఉన్న safety protocols దాటితే jailbreak జీవనమరణ సమస్యగా మారవచ్చని Anthropic CEO Dario Amodei 2023లో చెప్పినట్లు మూలం గుర్తుచేస్తోంది.

అందుకే అధికారులు oversight మరియు release discipline‌పై ఇంత గట్టిగా ఒత్తిడి తెస్తున్నారో అర్థమవుతుంది. అలాగే jailbreak ఆందోళనలను సాధారణ ఇంటర్నెట్ అల్లరి అని industry కొట్టిపారేయలేనని కూడా ఇది చూపిస్తోంది. frontier దశలో జరిగే వైఫల్యాలు dual-use knowledge, misuse, లేదా స్వచ్ఛంద governance frameworks‌పై విశ్వాసం తగ్గిపోవడం వంటి ప్రభావాలను కలిగించవచ్చు.

ఇది security test మాత్రమే కాదు, governance test కూడా

Commerce Department అధికారులు మరియు Anthropic ఉద్యోగులు చర్చల్లో ఉన్నారని, CIA మరియు science adviser Michael Kratsios పాల్గొనే మరిన్ని సమావేశాలు ప్రణాళికలో ఉన్నాయని నివేదిక చెబుతోంది. అలాగే Fable 5‌పై export controls కోరుతూ 100 మందికి పైగా security experts మరియు tech executives ఒక open letter‌పై సంతకం చేశారని కూడా అది పేర్కొంటుంది.

ఈ వివరాలను కలిపి చూస్తే, ఈ వాదన ఒక మోడల్ విడుదల గురించిమాత్రమే కాదు. acceptable risk‌ను ఎవరు నిర్వచించాలి, formal institutions ఏర్పడే ముందు voluntary oversight ఎలా పనిచేయాలి, మరియు నమ్మకాన్ని చెడగొట్టకుండా AI కంపెనీలు ప్రభుత్వాల కంటే వేగంగా ముందుకు సాగగలవా అన్నదీ ఇందులో భాగం.

  • planned review mechanism కోసం వేచి చూడకుండా Anthropic Fable 5‌ను విడుదల చేసిందని US officials అంటున్నారు.
  • ఈ వివాదం jailbreak risk మరియు government oversight చుట్టూ తిరుగుతోంది.
  • నిజంగా unhackable LLMs‌ను కోరడం సాంకేతికంగా అవాస్తవమైన అవసరం కావచ్చని మూలం వాదిస్తోంది.

మొత్తం పాఠం అసౌకర్యంగా ఉన్నా ఉపయోగకరం. Frontier AI security ఒక safe-or-unsafe అనే ద్వైమానిక స్థితికి చేరకపోవచ్చు. దాని బదులు layered mitigation, పరిమిత deployment choices, monitoring, మరియు విడుదల అనంతర ప్రతిస్పందనల సమాహారంగానే ఉండే అవకాశం ఎక్కువ. ఇది చెప్పడానికి కష్టం అయిన governance model, కానీ మూలంలో వివరించిన సాంకేతికతకు అదే ఎక్కువగా సరిపోతుంది.

నీతినిర్ణేతలు సహజంగానే సంపూర్ణ భద్రతను ప్రతిఘటించే వ్యవస్థల నుంచి సంపూర్ణ భద్రతనే కోరుతూ ఉంటే, ఇలాంటి ఘర్షణలు మరింత సాధారణమవుతాయి. AI governance- యొక్క తదుపరి దశ, అసాధ్యమైన ప్రమాణాల స్థానంలో అమలు చేయగల, సాంకేతికంగా బలమైన ప్రమాణాలను తీసుకురాగలమా అన్నదానిపై ఆధారపడి ఉండవచ్చు.

ఈ వ్యాసం The Decoder నివేదిక ఆధారంగా ఉంది. మూల వ్యాసాన్ని చదవండి.

Originally published on the-decoder.com