OpenAI म्हणते Codex चा पॅच धोकादायक file-deletion मार्ग बंद करतो
OpenAI ने Codex साठी एक सुरक्षा अद्यतन जारी केले आहे, कारण वापरकर्त्यांनी सांगितले की GPT-5.6 Sol स्वायत्त कामे करताना परवानगीशिवाय वास्तविक फाइल्स हटवू शकत होता. कंपनीच्या म्हणण्यानुसार, समस्या cleanup command शी संबंधित होती, जी temporary working files काढण्यासाठी होती, पण system variables चुकीच्या पद्धतीने हाताळले गेले तर ती प्रत्यक्ष user data कडे निर्देश करू शकत होती.
दिलेल्या अहवालानुसार, model ने temporary folders साठी $HOME सारखी system variables वापरली तेव्हा हा failure mode दिसून आला. अशा प्रसंगी, दोषपूर्ण delete command isolate केलेल्या scratch location ऐवजी वापरकर्त्याच्या प्रत्यक्ष home directory ला लक्ष्य करू शकत होता. त्यामुळे सामान्य housekeeping वाटणारे काम high-risk operation बनते, कारण एकच चुकीचा path documents, projects आणि इतर कायमस्वरूपी फाइल्सवर परिणाम करू शकतो.
हे update महत्त्वाचे आहे, कारण ते साध्या software bug पेक्षा पुढे जाणाऱ्या risk class ला address करते. Code आणि संबंधित कामांमध्ये मदत करताना action execute करण्यासाठी Codex तयार केले आहे. जर एखादा agent चुकीच्या ठिकाणी destructive commands invoke करू शकला, तर त्याचा प्रत्यक्ष परिणाम फक्त failed task नसून अपरिवर्तनीय data loss देखील असतो. दुसऱ्या शब्दांत, हा issue model behavior, command construction आणि operating-environment safety यांच्या संगमावर आहे.
OpenAI ने काय बदलले
source text मध्ये OpenAI ने आता लागू केलेल्या अनेक safeguards चे वर्णन आहे. असे सांगितले आहे की Codex delete चालवण्यापूर्वी deletion targets verify करतो, नवीन temporary folders तयार करतो आणि system variables चा गैरवापर थांबवतो. धोकादायक delete commands execute होण्यापूर्वी ओळखण्यासाठी कंपनीने अधिक कडक checks देखील जोडले आहेत.
ही संयोजना सूचित करते की OpenAI तातडीची त्रुटी आणि तिला धोकादायक बनवणाऱ्या व्यापक परिस्थिती, दोन्ही हाताळण्याचा प्रयत्न करत आहे. deletion targets verify करणे हे सर्वात थेट control आहे: command चालण्यापूर्वी system destination खरोखर temporary workspace आहे की user directory, हे तपासते. नवीन temporary folders तयार केल्याने ambiguity कमी होते, कारण agent ला reused paths किंवा inherited environment values वर अवलंबून न राहता एक ज्ञात सुरक्षित जागा मिळते. delete commands भोवती checks कडक केल्याने आणखी एक स्तर जोडला जातो, ज्यामुळे आधीच्या assumptions अयशस्वी झाल्या तरी high-impact actions थांबवता येतात.
report मध्ये असेही म्हटले आहे की full-access mode आता चुकून trigger होऊ शकत नाही. हा तपशील महत्त्वाचा आहे, कारण automated system अनपेक्षित वागल्यास permission boundaries बहुतेक वेळा शेवटची संरक्षणरेषा असतात. model अजूनही दोषपूर्ण command तयार करू शकतो, पण तो किती नुकसान करेल हे तो sandbox मध्ये चालतो आहे, constrained workspace मध्ये, की host machine वर विस्तृत accessसह, यावर मोठ्या प्रमाणात अवलंबून असते.
Sandboxing का केंद्रस्थानी आहे
source मध्ये सारांशित केलेली OpenAI ची स्वतःची शिफारस म्हणजे users नी sandbox modes मध्ये राहावे आणि app updated ठेवावे. हे practical मान्यतेचे द्योतक आहे की safer defaults, bug fixes इतकेच महत्त्वाचे आहेत. नीट तपासलेल्या coding agent ला देखील path handling, shell behavior किंवा environment configuration मधील edge cases येऊ शकतात. Sandboxing त्या चुका पूर्णपणे दूर करत नाही, पण त्यांचा blast radius मोठ्या प्रमाणात मर्यादित करू शकतो.
Codex प्रकरण हे आठवण करून देते की autonomous coding tools चे मूल्यमापन फक्त ते code किती चांगले लिहितात किंवा edit करतात यावर होत नाही. ते local systems सोबत किती सुरक्षितपणे interact करतात यावरही होते. Files हटवणे हे याचे सर्वात स्पष्ट उदाहरण आहे, कारण ते development workflows मध्ये सामान्य आहे आणि चुकीच्या ठिकाणी केल्यास विनाशकारी ठरू शकते. build artifacts, caches, temporary outputs आणि generated assets नियमितपणे हटवले जातात. त्यामुळे acceptable cleanup आणि harmful destruction यांच्यातील रेषा deletion होते की नाही याची नाही, तर system योग्य scope मध्ये काम करत आहे हे तो सिद्ध करू शकतो की नाही याची आहे.
यामुळे toolmakers वर फक्त “सावध रहा” किंवा “delete करण्यापूर्वी विचारा” अशा prompt-level सूचनांवर अवलंबून न राहता अधिक करण्याचा दबाव येतो. या सूचना मदत करतात, पण surrounding system त्यांना enforce करत नसेल तर त्या soft controls राहतात. OpenAI येथे जे वर्णन करते ते harder controls कडे जाणारे पाऊल आहे: path validation, सुरक्षित temporary directories, delete commands चे अधिक कडक screening, आणि sandboxed आणि full-access operation यांच्यात स्पष्ट विभाजन.
Agent design बद्दल हे काय सांगते
ही घटना AI agent design मधील मोठे आव्हान देखील दाखवते. Models vacuum मध्ये काम करत नाहीत. ते commands निवडतात, environment variables समजून घेतात, आणि humans ने तयार केलेल्या wrappers, shells आणि permission systems मधून काम करतात. एक failure एकाच catastrophic decision मुळे नव्हे, तर अनेक लहान assumptions चुकीच्या क्रमाने एकत्र आल्यामुळे निर्माण होऊ शकतो. एखादा temporary path सुरक्षित मानला जातो. एखादे system variable scratch space कडे निर्देश करते असे मानले जाते. एखादी cleanup command मर्यादित मानली जाते. मग ही assumptions प्रत्यक्ष machine state शी टकरावतात.
agentic coding systems चे मूल्यांकन करणाऱ्या developers आणि enterprises साठी, याचा अर्थ reliability चे मूल्यांकन system level वर करावे लागेल. संबंधित प्रश्न फक्त model सक्षम आहे का हा नाही, तर execution framework capability ला defensible रीतीने नियंत्रित करते का हा आहे. Destructive commands साठी स्पष्ट justification हवे, safe targets machine-verifiable असायला हवेत, आणि privilege escalation चुकून trigger होणे कठीण असायला हवे.
OpenAI ने वर्णन केलेले बदल त्या दिशेकडे इशारा करतात. ते caution ची गरज दूर करत नाहीत, पण उत्पादन चुका होतील असे गृहित धरून त्याभोवती design करणारी अधिक परिपक्व भूमिका दर्शवतात. source code, configuration आणि local storage यांना हाताळणाऱ्या tools साठी हा सहसा योग्य दृष्टिकोन असतो.
या अपडेटमधून users ने काय घ्यावे
दिलेल्या source वरून तातडीचा संदेश स्पष्ट आहे: OpenAI ला विश्वास आहे की त्यांनी deletion bug दुरुस्त केला आहे आणि पुनरावृत्ती टाळण्यासाठी guardrails जोडले आहेत. जे users autonomous workflows साठी Codex वर अवलंबून आहेत, त्यांनी लगेच update करावे आणि broad-access configurations टाळाव्यात, जोपर्यंत त्या खरोखर आवश्यक नाहीत.
अधिक व्यापकपणे पाहिले तर, ही घटना प्रत्यक्ष machines वर काम करणाऱ्या AI software च्या safety requirements साठी उपयुक्त case study आहे. Coding agents चे आश्वासन friction कमी करणे आणि कंटाळवाणी कामे automate करणे हे आहे. पण त्या automation चे मूल्य trust वर अवलंबून असते, आणि trust मजबूत operational boundaries वर अवलंबून असते. त्यामुळे OpenAI चा patch हा केवळ maintenance release नाही. AI agents अधिक सक्षम होत असताना isolation, validation आणि least privilege यांसारखी मूलभूत systems engineering तत्त्वे कमी नव्हे तर अधिक महत्त्वाची होतात, याचा तो पुरावा आहे.
- cleanup command वास्तविक user data लक्ष्य करू शकत होती, असा बगचा स्रोत OpenAI सांगते.
- आता Codex deletion targets verify करतो आणि नवीन temporary folders तयार करतो, असे कंपनी म्हणते.
- धोकादायक delete commands वर आता execute होण्यापूर्वी अधिक कडक checks आहेत.
- चुकीने full-access mode सुरू होणेही थांबवले आहे, असे OpenAI म्हणते.
हा लेख The Decoder च्या रिपोर्टिंगवर आधारित आहे. मूळ लेख वाचा.
Originally published on the-decoder.com


