शेअर केलेल्या Claude लिंक शोधता येण्याजोग्या झाल्याचे वृत्त

Anthropic च्या Claude chatbot वापरून तयार केलेल्या शेअर केलेल्या संभाषणांचा सार्वजनिक search engine results मध्ये दिसत असल्याचा दावा The Decoder च्या 27 जुलैच्या अहवालात करण्यात आला; या अहवालात Reddit वरील वापरकर्त्यांच्या निष्कर्षांचा आणि दिसणाऱ्या search behavior चा संदर्भ देण्यात आला. समस्या Claude च्या link-sharing फीचरभोवती केंद्रित होती, जे वापरकर्त्यांना संभाषणासाठी public URL तयार करू देते. ही पृष्ठे आधीच लिंक असलेल्या कोणालाही उपलब्ध होती, पण reported problem अधिक व्यापक होती: search engines ने ती थोड्या काळासाठी index केली, त्यामुळे मूळ वापरकर्ता आणि भेट देणारा यांच्यात थेट शेअर न करता देखील ती शोधता येऊ लागली.

हा फरक महत्त्वाचा आहे. Public link एक गोष्ट आहे; search indexing दुसरी. जेव्हा एखादी सामग्री searchable होते, तेव्हा तिचा व्यावहारिक प्रेक्षक मर्यादित intended recipients च्या गटातून बदलून ordinary search operators वापरणाऱ्या जवळपास कोणालाही उपलब्ध होऊ शकतो. The Decoder ने सांगितले की Claude share pages साठी केलेल्या एका साध्या query ने अनेक results दाखवले आणि ही exposure chats पुरती मर्यादित न राहता user-created artifacts पर्यंत गेली, ज्यात त्याच ecosystem द्वारे प्रकाशित documents आणि apps समाविष्ट होते.

रिपोर्टने apparent कारण म्हणून shared pages वर noindex tag नसणे असे सांगितले. हे instruction सामान्यतः search engines ला एखादे पान search results मध्ये समाविष्ट करू नये असे सांगण्यासाठी वापरले जाते. लेखात Anthropic कडून कोणताही formal technical postmortem सादर करण्यात आलेला नाही, त्यामुळे ही व्याख्या कंपनीकडून पुष्टी झालेली root-cause statement नसून reported one आहे. तरीही, मुळ चिंता स्पष्ट आहे: link द्वारे पोहोचता येणारी म्हणून ठेवलेली पृष्ठे, किमान काही काळासाठी, search द्वारेही सापडण्याजोगी झाली.

वापरकर्त्यांनी नक्की काय उघड केले असे सांगितले गेले

या घटनेतील सर्वात महत्त्वाचा भाग म्हणजे फक्त chat pages सापडल्या एवढाच नाही, तर वापरकर्त्यांनी त्यात काय सोडून दिले होते असे सांगितले गेले ते. The Decoder ने सांगितले की काही सार्वजनिकरीत्या उपलब्ध chats मध्ये legal queries आणि crypto keys होत्या. अशा घटना index केलेल्या links च्या छोट्या भागाचे प्रतिनिधित्व करत असल्या, तरी त्या AI sharing tools मधील मूलभूत धोका दाखवतात: वापरकर्ते संभाषणात्मक प्रणालींना बहुतेक वेळा अर्ध-खासगी workspaces मानतात, आणि मग “share” कृती मुख्य product interface च्या बाहेर गेल्यावर माहिती किती व्यापकपणे पसरू शकते याचे undervalue करतात.

The Decoder च्या अहवालातील update ने scope आणखी वाढवून सांगितले की फक्त conversation transcripts नव्हे, तर artifacts देखील उघडे पडले. याचा अर्थ धोका text prompts आणि answers पुरता मर्यादित नव्हता. Documents आणि app-like outputs मध्ये structured information, internal notes, credentials, prototypes, किंवा business logic असू शकते. जर ती index झाली, तर वापरकर्त्याने share toggle क्लिक करताना जे लक्षात घेतले त्यापेक्षा अधिक माहिती उघडी पडू शकते.

महत्त्वाचे म्हणजे, हा प्रसंग shared chats या चौकटीत मांडला गेला; म्हणजेच हे बाहेरील attacker कडून breached private conversations म्हणून वर्णन केले गेले नाही. रिपोर्टनुसार shared pages index झाल्यामुळे त्या वापरकर्त्यांना अपेक्षित होते त्यापेक्षा खूप सोप्या पद्धतीने सापडू लागल्या. त्यामुळे privacy problem संपत नाही. प्रत्यक्षात अनेक वापरकर्ते “share with link” ला मर्यादित वितरण असे समजतात, जरी लिंक तांत्रिकदृष्ट्या public असली तरी. Search visibility ही अस्पष्टता प्रत्यक्ष exposure channel मध्ये बदलते.

Anthropic ची reported प्रतिक्रिया

The Decoder नुसार, Anthropic ने झटपट प्रतिसाद दिला. वापरकर्त्यांनी मुद्द्याकडे लक्ष वेधल्यानंतर Google results लवकरच गायब झाल्याचे नोंदवले गेले. मात्र Bing आणि Brave Search वर ती पृष्ठे अधिक काळ दिसत राहिल्याचेही अहवालात नमूद केले आहे. हे एक सामान्य इंटरनेट वास्तव दाखवते: indexing काढून टाकणे किंवा रोखणे नेहमीच सर्व search platforms वर एकाच वेळी होत नाही. वेगवेगळे crawlers वेगवेगळ्या वेळापत्रकांनुसार content शोधतात, cache करतात आणि refresh करतात, त्यामुळे एक fix नवीन exposure जलद कमी करू शकतो, पण काही काळासाठी अवशेष दिसत राहू शकतात.

लेखाने Claude मधील management path देखील दिला: Settings, मग Privacy, मग Shared Chats. हे महत्त्वाचे आहे कारण यावरून वापरकर्त्यांना आधीच शेअर केलेल्या सामग्रीचे review आणि व्यवस्थापन करण्याची काही क्षमता आहे, हे सूचित होते. AI टूलमध्ये link sharing वापरणाऱ्या कोणालाही हा प्रसंग आठवण करून देतो की access settings ही एकदाच केलेली निवड नसून, नियमित देखभाल कार्य मानली पाहिजे.

अहवालात असेही नमूद केले की OpenAI ने मागील वर्षी अशीच चूक केली होती आणि नंतर तो फीचर काढून टाकला. ही तुलना संबंधित आहे कारण ती दर्शवते की समस्या एका कंपनीपुरती मर्यादित नाही. AI कंपन्या chat interfaces बरोबरच collaboration आणि publishing features अधिकाधिक सादर करत आहेत, आणि ही फीचर्स private workspace वर्तन आणि web-native वितरण यांच्या मधल्या अस्वस्थ सीमारेषेवर उभी आहेत. जर उत्पाद डिझाइनमध्ये ती सीमारेषा स्पष्ट केली नाही, तर वापरकर्ते आपल्या गृहितकांनी ती पोकळी भरून काढतील.

AI कंपन्यांसाठी व्यापक product-design इशारा

व्यावहारिक धडा फक्त एका indexing घटनेबद्दल नाही. तो या बद्दल आहे की AI tools साध्या chat windows मधून काम साठवणे, संघटित करणे आणि वितरित करणे अशा platforms मध्ये कसे रूपांतरित होत आहेत. एखादे product वापरकर्त्याला conversation प्रकाशित करायला, generated document share करायला, किंवा स्थिर URL वर artifact expose करायला परवानगी देताच, ते open web च्या norms आणि risks वारशाने स्वीकारू लागते. Search engines पृष्ठे शोधू शकतात. इतर वापरकर्ते links repost करू शकतात. Sensitive details copies, previews, किंवा caches मध्ये टिकून राहू शकतात.

याचा अर्थ privacy controls वास्तववादी user behavior लक्षात घेऊन डिझाइन केली पाहिजेत, आदर्श गृहितकांवर नव्हे. interface ने consequence पेक्षा convenience वर भर दिल्यास, तांत्रिकदृष्ट्या public पान देखील कार्यात्मकदृष्ट्या private समजले जाऊ शकते. “या URL असलेल्या कोणालाही उपलब्ध” आणि “web वर शोधणाऱ्या कोणालाही सापडणारे” यातील फरक वापरकर्ते नेहमीच ओळखतील असे नाही, तरी त्या अर्थपूर्णदृष्ट्या वेगळ्या अवस्था आहेत.

Claude प्रसंग, reported स्वरूपात, AI products अतिशय वेगाने sensitive material साठवू शकतात, हेही दाखवतो. लोक हे systems कायदेशीर प्रश्नांवर विचार करण्यासाठी, internal documents draft करण्यासाठी, code वर काम करण्यासाठी, आणि product ideas तपासण्यासाठी नेहमी वापरतात. assistant जितका अधिक सक्षम होतो, तितका वापरकर्ते त्यात मूल्यवान किंवा संवेदनशील संदर्भ ठेवण्याची शक्यता वाढते. त्यामुळे sharing controls मधील कोणतीही ambiguity अधिक महाग ठरते.

सध्या, मर्यादित तथ्ये अशी आहेत: वापरकर्त्यांनी कथितरित्या search engines मध्ये shared Claude chats आणि artifacts शोधले; लक्ष वाढल्यानंतर Google visibility लवकर कमी झाली; आणि Claude च्या privacy settings मधून shared items review करता येतात. व्यापक implication दुर्लक्ष करणे कठीण आहे. AI products मध्ये, एखादे feature तांत्रिकदृष्ट्या काय करते आणि वापरकर्ता ते काय करते असे समजतो, यातील दरी स्वतःच एक core safety issue बनत चालली आहे.

हा लेख The Decoder च्या रिपोर्टिंगवर आधारित आहे. मूळ लेख वाचा.

Originally published on the-decoder.com