OpenAI刚刚给全球数亿用户用的ChatGPT,上了一把新“锁”。
但妙就妙在,锁匠自己承认:这锁,可能防不住小偷。
一把名为“Lockdown Mode”的锁,它锁住了什么?
ChatGPT的“提示注入”(Prompt Injection)攻击,是这个AI时代最让人头疼的漏洞之一。
简单说,就是有人把恶意指令,藏在你让AI读取的网页或文件里。AI在执行你的命令时,可能偷偷执行了别人的命令,比如把你的敏感数据发给第三方。这就像数字世界的“特洛伊木马”。
为了应对,OpenAI祭出了大招:Lockdown Mode。开启后,ChatGPT会进入一种“只读”的保守状态。实时联网浏览功能?关了,你只能看它预先缓存的内容。从网上找图展示?关了,但你自己让它画图没问题。深度研究模式、智能体模式?统统关掉。
“Lockdown Mode is not intended for everyone,” OpenAI says. “It is designed for people and organizations that handle sensitive data and want stricter protection from data exfiltration risks related to prompt injection.”
说白了,这不是给普通聊天用户准备的。这是给那些怕商业机密、隐私数据通过AI泄露的企业和专业人士的“安全屋”。模式正在向ChatGPT Business账户和符合条件的个人账户推出。
最强的盾,OpenAI自己戳了个洞
如果故事到这里,这就是一个“AI公司重拳出击解决安全问题”的标准好消息。但OpenAI难得的坦诚,让事情变得更有意思了。
他们紧接着就补了一刀:就算你开了Lockdown Mode,ChatGPT可能依然脆弱。
恶意指令“could still appear in cached web content or in an uploaded file, and could still affect the behavior or accuracy of a response.” —— 它可能存在于缓存的内容里,或者你上传的文件里,依然能影响回答。
换句话说,这个“安全屋”并不是绝对密封的。 它把最危险的门窗(实时浏览)焊死了,但病毒可能通过老式通风口(缓存)或者你亲自带进来的包裹(上传文件)潜入。
OpenAI的目标也很务实:不是杜绝风险,而是“reduce the likelihood that sensitive data gets shared”——降低敏感数据被传出去的可能性。从“绝对安全”到“降低概率”,这种表述上的转变,暴露了当前AI安全防御的真实处境。
这是进步,还是无奈的妥协?
个人觉得,这事儿得分两面看。
乐观地看,这是AI安全治理一次标志性的“产品化”尝试。 以前安全是后台的模型层问题,现在OpenAI把它做成了一个前端用户可感知、可开关的功能开关。这本身是种进步,把黑盒的安全部分透明化、可控化了。
但更现实的拷问是:这像不像一种“防御性收缩”?
为了防住一个顽固漏洞,不惜阉割掉产品最吸引人的“联网”和“深度研究”能力。这好比因为怕中毒,就决定从此只吃罐头食品。安全是安全了,但风味和营养也大打折扣。
有意思的是,它再次把AI安全的根本矛盾摆上台面:能力与风险的权衡。 你想要AI帮你联网查最新资料、处理复杂文件,就得接受它可能被“污染”的风险。Lockdown Mode提供了一个极端保守的选择:我只要“罐头”。
对普通人意味着什么?
说实话,短期内,这个功能对绝大多数用户影响甚微。我们聊天、写文案、问问题,用不着开启“安全屋”模式。
但它是一个强烈的信号:那些最敏感、最高价值的应用场景,正在被AI安全问题严重制约。 企业想用AI处理合同、分析财务数据,第一个问题就是“安全吗?” Lockdown Mode就像是OpenAI交出的一份考卷:我提供了选项,但我也诚实地告诉你,满分我做不到。
这可能会催生一个新市场:围绕企业级AI的安全增强服务。或者,让本地化部署、数据不出域的私有模型,获得更强的竞争理由。
当“锁”也需要被质疑
OpenAI的这次更新,像是一则关于当前AI技术现状的隐喻。我们在狂奔突进,用能力惊艳世界,然后一次次回头,试图给狂奔的野马套上更结实的缰绳。
这次,他们造了一副看起来很坚固的缰绳,然后坦白说:马可能还是会脱缰,但我们尽力了。
当最强的盾,也无法完全抵挡矛的时候,我们该依赖什么?
【锐评】:在AI时代,最坚固的防御,有时恰恰源于对自身脆弱的坦诚。
参考链接:
https://techcrunch.com/2026/06/06/openai-unveils-lockdown-mode-to-protect-sensitive-data-from-prompt-injection-attacks/