上周末,一场由 Reddit 用户发现的数据暴露事件将 Anthropic 的 AI 助手 Claude 推上风口浪尖。用户通过谷歌搜索指令 `site:claude.ai/share` 即可找到大量被共享的 Claude 对话记录和 Artifacts(用户在 Claude 内构建的交互式迷你应用与文档)。据 404 Media 和 Futurism 等媒体报道,这些可公开搜索的内容中包含 医疗报告、临床试验患者姓名、公司内部文件、小学儿童姓名与电话号码,甚至还有由 Claude 生成的色情内容。
问题的根源在于 Claude 的“共享聊天”功能。该功能允许用户生成一个链接,任何拥有该链接的人都能查看对话或项目。Claude 界面虽提示“拥有链接者均可查看”,但这一设计本意是让用户与朋友、同事或小群体分享,而非面向整个互联网。然而,一旦用户将链接发布到论坛、社交媒体等搜索引擎可抓取的公开平台,这些内容便可能被谷歌等搜索引擎索引。
Anthropic 在回应中似乎将责任归咎于用户。公司发言人 Amie Rotherham 解释称,共享链接只有在被发布到搜索引擎可见的地方(如论坛或社交媒体帖子)时才会出现在搜索结果中;若通过私密方式发送,则不会进入搜索索引。她强调:“我们给予用户控制是否公开分享对话的权限,并且遵循隐私原则,不向谷歌等搜索引擎提交聊天目录或站点地图。这些链接不可猜测或发现,除非用户自己选择分享。”
谷歌发言人 Ned Adriance 则指出,谷歌或其他搜索引擎无法控制网页是否被公开,这些页面已被多个搜索引擎索引。他表示谷歌为网站所有者提供了明确的控制选项来决定页面是否可被爬取或索引,并始终尊重这些指令。
这并非首次出现类似问题。去年,Forbes 曾报道数百个 Claude 对话被搜索引擎索引,当时谷歌估计索引了不到 600 条对话。同样在去年,404 Media 报道一名研究人员抓取了约 10 万条被设置为公开共享的 ChatGPT 对话。此次暴露的规模尚未得到独立确认,但多名用户通过相同的谷歌搜索方法找到了共享对话。
截至周一,TechCrunch 的测试搜索已不再返回结果,表明问题已被修复。但在此之前,Futurism 发现的内容包括详细的真实患者医疗报告、包含患者姓名的临床试验结果、标有“仅限内部使用”的公司文档、包含小学生姓名和电话号码的文件,以及员工评论中涉及的个人信息。暴露的 Artifacts 还包含代码、工作笔记以及由聊天机器人生成的色情内容。
值得注意的是,Fortune 报道称,至少有一个标注为“由 Anthropic 共享”的聊天记录显示 Claude 生成了露骨内容,这违反了 Anthropic 自身禁止生成色情内容的政策。Anthropic 的使用政策明确禁止 Claude 生成性露骨内容,而通过重复或创造性提示让聊天机器人违反其准则的做法,在大多数主要 AI 模型中时有发生。目前尚不清楚该内容是如何生成的,Anthropic 尚未就此具体案例回应 TechCrunch 的置评请求。
此次事件再次凸显了 AI 聊天工具共享功能在隐私保护上的脆弱性。对于用户而言,Anthropic 建议通过“设置 - 隐私 - 共享聊天”路径检查哪些对话被设置了公开链接。对于 AI 产业投资者来说,数据安全合规正成为评估 AI 公司风险与责任的关键维度,类似事件可能影响用户信任与监管关注。