上週末,一場由 Reddit 使用者發現的資料暴露事件將 Anthropic 的 AI 助手 Claude 推上風口浪尖。使用者通過谷歌搜尋指令 `site:claude.ai/share` 即可找到大量被共享的 Claude 對話記錄和 Artifacts(使用者在 Claude 內構建的互動式迷你應用與文件)。據 404 MediaFuturism 等媒體報道,這些可公開搜尋的內容中包含 醫療報告、臨床試驗患者姓名、公司內部檔案、小學兒童姓名與電話號碼,甚至還有由 Claude 生成的色情內容。

問題的根源在於 Claude 的“共享聊天”功能。該功能允許使用者生成一個連結,任何擁有該連結的人都能檢視對話或專案。Claude 介面雖提示“擁有連結者均可檢視”,但這一設計本意是讓使用者與朋友、同事或小群體分享,而非面向整個網際網路。然而,一旦使用者將連結釋出到論壇、社交媒體等搜尋引擎可抓取的公開平台,這些內容便可能被谷歌等搜尋引擎索引。

Anthropic 在回應中似乎將責任歸咎於使用者。公司發言人 Amie Rotherham 解釋稱,共享連結只有在被髮布到搜尋引擎可見的地方(如論壇或社交媒體帖子)時才會出現在搜尋結果中;若通過私密方式傳送,則不會進入搜尋索引。她強調:“我們給予使用者控制是否公開分享對話的許可權,並且遵循隱私原則,不向谷歌等搜尋引擎提交聊天目錄或站點地圖。這些連結不可猜測或發現,除非使用者自己選擇分享。”

谷歌發言人 Ned Adriance 則指出,谷歌或其他搜尋引擎無法控制網頁是否被公開,這些頁面已被多個搜尋引擎索引。他表示谷歌為網站所有者提供了明確的控制選項來決定頁面是否可被爬取或索引,並始終尊重這些指令。

這並非首次出現類似問題。去年,Forbes 曾報道數百個 Claude 對話被搜尋引擎索引,當時谷歌估計索引了不到 600 條對話。同樣在去年,404 Media 報道一名研究人員抓取了約 10 萬條被設定為公開共享的 ChatGPT 對話。此次暴露的規模尚未得到獨立確認,但多名使用者通過相同的谷歌搜尋方法找到了共享對話。

截至週一,TechCrunch 的測試搜尋已不再返回結果,表明問題已被修復。但在此之前,Futurism 發現的內容包括詳細的真實患者醫療報告、包含患者姓名的臨床試驗結果、標有“僅限內部使用”的公司文件、包含小學生姓名和電話號碼的檔案,以及員工評論中涉及的個人資訊。暴露的 Artifacts 還包含程式碼、工作筆記以及由聊天機器人生成的色情內容。

值得注意的是,Fortune 報道稱,至少有一個標註為“由 Anthropic 共享”的聊天記錄顯示 Claude 生成了露骨內容,這違反了 Anthropic 自身禁止生成色情內容的政策。Anthropic 的使用政策明確禁止 Claude 生成性露骨內容,而通過重複或創造性提示讓聊天機器人違反其準則的做法,在大多數主要 AI 模型中時有發生。目前尚不清楚該內容是如何生成的,Anthropic 尚未就此具體案例回應 TechCrunch 的置評請求。

此次事件再次凸顯了 AI 聊天工具共享功能在隱私保護上的脆弱性。對於使用者而言,Anthropic 建議通過“設定 - 隱私 - 共享聊天”路徑檢查哪些對話被設定了公開連結。對於 AI 產業投資者來說,資料安全合規正成為評估 AI 公司風險與責任的關鍵維度,類似事件可能影響使用者信任與監管關注。