Anthropic Claude Code ला अधिक स्वायत्त वापराच्या दिशेने नेत आहे
Anthropic 14 ऑगस्टपासून बहुतेक paid users साठी Auto Mode ही default setting करून Claude Code सोबत developers कसे काम करतात ते बदलत आहे. source material नुसार हा बदल Pro, Max, आणि Team plans वर लागू होईल, तर Enterprise customers ना अजूनही स्वतंत्रपणे opt in करावे लागेल. प्रत्यक्षात, याचा अर्थ असा की Claude Code आता प्रत्येक individual step साठी human approval ची वाट न पाहता अधिक वेळा काम करेल, आणि फक्त तेव्हाच थांबेल जेव्हा त्याचे safety system एखादी कृती धोकादायक किंवा परत न करता येणारी वाटते.
हे केवळ एक product tweak नाही. हे एका प्रमुख AI कंपनीने coding assistants कसे वापरले पाहिजेत याबद्दलचे विधान आहे: फक्त autocomplete tools किंवा chat interfaces म्हणून नव्हे, तर मर्यादित supervision मध्ये extended development work करू शकणारे semi-autonomous agents म्हणून. Anthropic हा बदल oversight कमी करण्याऐवजी safety improvement म्हणून मांडत आहे, आणि त्याचा युक्तिवाद आहे की त्याचा classifier manual approvals एकेक करून करण्यापेक्षा risky commands अधिक सातत्याने ओळखू शकतो.
Anthropic म्हणते Auto Mode का अधिक सुरक्षित आहे
कंपनीचा दावा source text मध्ये दिलेल्या काही reported test results वर आधारलेला आहे. 1,053 paid testers असलेल्या controlled study मध्ये human reviewers ने dangerous commands पैकी 13.6 percent पकडले, तर Auto Mode ने 89 percent पकडले. Anthropic ने असेही सांगितले की internal red-teaming मध्ये Auto Mode किमान manual approvals इतके सुरक्षित आणि अनेकदा त्याहून चांगले काम करत असल्याचे दिसले. Auto Mode वापरणाऱ्या teams ने सुमारे 25 percent अधिक pull requests तयार केल्या, म्हणजे autonomy ची पातळी वाढली की output देखील वाढतो, असे कंपनीने जोडले.
वर्णन केलेली mechanism संकल्पनेत सरळ आहे. प्रत्येक टप्प्यावर परवानगी मागण्याऐवजी, Claude Code सतत काम करतो आणि एखादी कृती कधी थांबवून confirmation घ्यायची हे ठरवण्यासाठी classifier वर अवलंबून असतो. एखादी कृती धोकादायक किंवा अपरिवर्तनीय वाटली तर system हस्तक्षेप करण्यासाठी तयार केले आहे. Anthropic म्हणते की classifier स्वतः user साठी token charges वाढवत नाही, मात्र विस्तृत workflow मुळे दीर्घ, अधिक उत्पादनक्षम coding sessions शक्य होऊन एकूण वापर वाढू शकतो.
हे महत्त्वाचे आहे, कारण approval fatigue हा agentic software tools मधील खरा प्रश्न आहे. जर वापरकर्त्यांना जवळपास प्रत्येक command approve करायला सांगितले, तर अनेक जण सवयीने click through करतील किंवा safeguards पूर्णपणे बंद करतील. Anthropic चे मत आहे की blanket approval prompts पेक्षा selective intervention अधिक वास्तववादी आहे, आणि model-assisted filter पुनरावृत्ती असलेल्या review परिस्थितींमध्ये मानवी vigilance पेक्षा चांगले कार्य करू शकतो.
Prompt injection अजूनही मुख्य चिंता आहे
source material मधील एक महत्त्वाचा दावा असा आहे की Auto Mode prompt injection attacks पासून बचावातही मदत करेल. अशा attacks code, files, किंवा काम करताना agent ला भेटणाऱ्या इतर साहित्यामध्ये अंतर्भूत केलेल्या सूचनांद्वारे AI agent ला manipulate करण्याचा प्रयत्न करतात. agentic coding environment मध्ये हा धोका passive chatbot पेक्षा अधिक गंभीर आहे, कारण system कडे commands, repositories, processes, आणि काही प्रसंगी sensitive data यांचा प्रवेश असू शकतो.
Anthropic ने Trajectory Labs च्या एका independent audit चा संदर्भ दिला, ज्यात 72 attack scenarios होते आणि प्रत्येक 10 वेळा चालवण्यात आला. source नुसार, त्या 720 प्रयत्नांपैकी एकही Claude च्या current models विरुद्ध Auto Mode मध्ये यशस्वी झाला नाही. source ने OpenAI च्या GPT-5.6 Sol in Codex Auto-Review mode साठी दिलेल्या benchmark शीही तुलना केली, जिथे 5.83 percent प्रयत्न कथितपणे यशस्वी झाले. दिलेल्या मजकुरापलीकडे methodology Developments Today पडताळू शकत नाही, पण ही तुलना दाखवते की vendors आता coding quality बरोबरच agent safety वरही किती आक्रमकपणे स्पर्धा करत आहेत.

Anthropic ने stakes स्पष्ट करण्यासाठी internal examples देखील दिली. कंपनीने सांगितले की Auto Mode ने Claude ला confidential data public page वर upload करण्यापासून रोखले, आणि एका दीर्घ session दरम्यान सुमारे 2,000 processes थांबवले जे अन्यथा चालू असलेल्या GPU training jobs मध्ये अडथळा आणले असते. ही उदाहरणे सूचित करतात की कंपनी हे system प्रत्यक्ष development आणि infrastructure environments मध्ये तपासत आहे, जिथे चुका security, uptime, आणि महागड्या compute workloads वर परिणाम करू शकतात.
अधिक output, पण developers ची बदलती भूमिका
Productivity चा दावा महत्त्वाचा आहे, कारण तो software work मधील व्यापक बदलाकडे निर्देश करतो. Auto Mode वापरणाऱ्या teams जर अधिक pull requests तयार करत असतील, तर developer ची भूमिका देखील बदलते. source text स्पष्टपणे नमूद करते की भूमिका active line-by-line coding पासून दूर जाऊन AI-generated output चे supervision, review, आणि validation याकडे अधिक सरकत आहे.
यामुळे human judgment ची गरज संपत नाही. Anthropic स्वतःच इशारा देते की classifier risk कमी करतो, पण तो पूर्णपणे नाहीसा करत नाही. production infrastructure मधील high-stakes changes साठी वापरकर्त्यांनी Claude ची actions स्वतः तपासावीत, अशी शिफारस कंपनी अजूनही करते. हा caveat महत्त्वाचा आहे. Auto Mode साठी सर्वात मजबूत दावा routine development workflows मध्ये असू शकतो, जिथे विलंबाचा खर्च जास्त असतो आणि एखाद्या एकट्या कृतीचा धोका तुलनेने मर्यादित असतो. कमजोर दावा अशा environments साठी आहे जिथे एक चुकीचा command data उघड करू शकतो, production systems बिघडवू शकतो, किंवा अपरिवर्तनीय operational damage निर्माण करू शकतो.
त्या दृष्टीने, Anthropic ची घोषणा ही product rollout आणि behavioral nudge दोन्ही आहे. Auto Mode default करून कंपनी coding agents ना जास्त वेळ स्वयंचलितपणे चालू द्यावे ही कल्पना सामान्य करत आहे. Defaults महत्त्वाचे असतात. अनेक वापरकर्त्यांनी जे अधिक autonomous setting सक्रिय केले नसते, त्यांना आता हे tool च्या कामकाजाचे मानक स्वरूप वाटेल.
AI coding market साठी याचा अर्थ काय
हा बदल coding assistant market च्या प्रौढ टप्प्याचेही प्रतिबिंब आहे. स्पर्धा आता फक्त कोण सर्वोत्तम snippet लिहितो किंवा सर्वात स्वच्छ refactor समजावतो यावर नाही. आता autonomy सुरक्षितपणे कोण व्यवस्थापित करू शकतो यावर increasingly लक्ष आहे: कधी कृती करायची, कधी थांबायचे, आणि execution दरम्यान भेटणाऱ्या malicious किंवा unintended सूचनांना कसे प्रतिकार करायचे.
Anthropic असा अंदाज लावत आहे की operational judgment चा हा स्तर core differentiator बनेल. हा अंदाज बरोबर ठरला तर AI coding tools चा पुढील टप्पा prompt वरून किती वेळा code तयार करतात यापेक्षा, messy real-world repositories मध्ये नुकसान न करता किती विश्वासार्हपणे काम करू शकतात यावर अधिक मोजला जाईल. Auto Mode default होणे हे उद्योग त्या दिशेने पुढे जात असल्याचे ठोस लक्षण आहे.
हा लेख The Decoder च्या रिपोर्टिंगवर आधारित आहे. मूळ लेख वाचा.
Originally published on the-decoder.com


