OpenAI 为敏感场景推出受限模式

OpenAI 宣布推出一项名为 Lockdown Mode 的新 ChatGPT 功能,这是一种更受约束的运行模式,面向担心提示注入攻击及相关数据外泄风险的个人和组织。该功能被定位为一个更窄、更可防御的 ChatGPT 版本,适用于损失代价特别高的场景。

这项功能背后的逻辑很直接。现代 AI 系统之所以更有用,是因为它们可以浏览网页、检查文件、检索外部信息、生成代码,或者跨连接工具执行动作。但这些能力同样扩大了攻击面。如果恶意指令被嵌入到网页内容、文档或模型遇到的其他材料中,它就可能影响系统行为。Lockdown Mode 正是 OpenAI 针对这一权衡给出的答案:牺牲部分能力,以换取更紧的隔离。

Lockdown Mode 关闭了什么

根据提供的原始材料,Lockdown Mode 会禁用若干与更高暴露风险相关的功能。在该模式下,ChatGPT 不能浏览网页、不能在回复中显示图片、不能执行 Deep Research、不能作为带有 Canvas 代码生成器的代理网络运行,也不能下载文件。用户仍然可以上传图片,系统也仍然可以生成图片,但整体模式很清晰:那些把模型带出基础聊天边界的功能被收紧了。

这一点很重要,因为提示注入并不等同于传统钓鱼邮件或恶意下载。在 AI 工作流中,危险指令可能隐藏在模型被要求读取的内容里。如果助手还被允许获取信息、对外部材料进行推理,或代表用户采取行动,那么坏指令带来的后果就会更严重。限制这些路径的模式,即使会降低便利性,也能降低风险。

由代理时代塑造的安全功能

Lockdown Mode 之所以值得注意,是因为它反映了 AI 公司对产品安全的更广泛思路转变。最早围绕消费级聊天机器人的争论集中在幻觉、偏见和有害输出上。随着模型获得工具使用能力和半代理式行为,威胁模型也随之扩大。问题不再只是模型说了什么,而是模型能访问什么、会被诱导去做什么,以及用户在工作流中放入了多少敏感上下文。

从这个意义上说,Lockdown Mode 与其说是一个小众功能,不如说是在承认通用型 AI 正进入需要强调隔离的专业和运营场景。律师、高管、分析师、研究人员以及其他高信任用户,越来越希望在不让敏感材料暴露于可避免风险的情况下使用 AI 帮助。更安全的模式不会消除这些担忧,但它为组织提供了一个更清晰的方式来设定边界。

能力与控制之间的权衡

显然,这也有代价。ChatGPT 最具吸引力的用途越来越依赖 Lockdown Mode 所限制的那些功能。浏览、深度研究、文件处理和代理式操作,正是把聊天机器人变成工作流工具的原因。关闭这些能力,可能会让产品更像一个隔离的助手,而不是连接型助手。对许多用户来说,这会过于受限。

OpenAI 似乎也意识到了这一点。提供的材料明确表示,这项功能并不面向所有人。这个定位很重要。Lockdown Mode 不是一种普遍默认设置,也不是在危险出现时自动触发的紧急按钮。它是一种可选的运行姿态,适合那些宁愿接受较窄功能,也不愿承担更自主系统所带来风险的用户。

这次发布为何重要

Lockdown Mode 的推出表明,AI 厂商正在开始按安全姿态而不仅仅是能力和价格来细分产品。这很可能成为一种反复出现的模式。随着助手获得更多数据和更多工具,用户将需要更清晰的选项,来决定在任何特定任务中愿意赋予多少自主权。

OpenAI 的举动也强调了企业和专业 AI 采用中的一个更现实的事实:便利并不是唯一指标。在某些场景下,最好的产品不是功能最多的产品,而是在保持可预测约束的同时能做足够多事情的产品。Lockdown Mode 就是这一原则的产品化表达,也很可能预示着 AI 界面设计下一步的发展方向。

  • Lockdown Mode 面向更高敏感度的 ChatGPT 使用场景。
  • 它会禁用浏览、Deep Research、部分代理功能和文件下载。
  • 这一功能表明,安全姿态正在成为 AI 产品的核心差异化因素。

本文依据 Gizmodo 的报道。阅读原文

Originally published on gizmodo.com