警示:共用的 Claude 對話與產物被 Google 索引,暴露敏感資料
目錄
你可能想知道的事
Claude 的「共用對話」功能產生的連結會被搜尋引擎公開搜尋到嗎?
在公開被索引的 Claude 對話與產物中發現了哪些類型的敏感資料?
主要議題
在最近的一個週末,許多在 Claude 中建立的對話與產物被發現可透過 Google 搜尋到,Reddit 使用者示範像是 site:claude.ai/share 這類查詢回傳了大量的共用連結。這些共用項目——可能包含互動迷你應用、文件以及整段對話記錄——據報導包含各種敏感內容。報導指出出現了醫療紀錄、公司內部文件,以及像是兒童姓名和電話號碼等個人識別資訊。
這次外洩似乎與 Claude 的「共用對話」功能有關,該功能會產生一個 URL,任何擁有該連結的人都可檢視對話或專案。Claude 介面本身以「Anyone with the link can view」這句話提醒使用者,這暗示該連結原本是要故意分發給特定人士或小群體,而非讓更廣泛的網路能夠發現。類似服務(例如 Google 文件)提供基於連結的共用功能,只要連結保持私密,這些文件通常不會出現在公開搜尋引擎索引中。
Anthropic 回應稱,只有當連結被張貼在搜尋引擎可存取的位置(例如公開論壇或社交媒體)時,這些共用連結才會被索引。該公司強調使用者仍然掌握分享控制,並表示不會向搜尋引擎提供會讓共用連結預設可被搜尋的對話目錄或網站地圖。依 Anthropic 的說法,這些連結不可被猜測,除非有人將它們發布在爬蟲可以到達的位置,否則仍然不可發現。他們也指出,當使用者透過共用讓內容公開可存取時,第三方的封存或索引是可能的——這與公開張貼的網頁內容可能被外部服務處理的情況一致。
最初關於此問題的警示出現在 Reddit,並被 404 Media 與 TechCrunch 等媒體報導。當 TechCrunch 稍後嘗試相同的搜尋方法時,結果未再出現,顯示該索引問題已部分或完全修復。先前 Futurism 和 Fortune 等媒體在移除前報導了令人震驚的暴露範例:詳細的醫療報告、含患者姓名的臨床試驗資料、列出兒童聯絡資訊的文件、公司內部文件、工程筆記,以及其他私密資料。在至少一個被報導的案例中,一則公開共用的對話顯示 Claude 生成了情色內容——這類輸出是 Anthropic 使用規則所禁止的。
在共用對話中出現被禁止的內容,引發兩個相關問題:模型是否違反政策生成了該內容,以及該內容如何被公開曝光。AI 系統有時會在持續或巧妙構造的提示下被誘導產生明示指導方針之外的內容;然而,現有報導並未清楚說明這些公開範例中明確內容的生成方式,且 Anthropic 尚未公開確認該具體事件的細節。
搜尋引擎本身並不決定哪些頁面應該公開;它們索引的是網路上存在的內容。Google 發言人重申,網站擁有者可控制頁面是否可被爬取或索引,搜尋服務會遵從網站的指示。歷史上類似事件曾發生過:在前一年 Google 曾索引過數百則 Claude 對話,之後那些頁面從搜尋結果中消失,安全研究人員也已展示在連結公開可得時,能夠抓取大量公開共用的聊天對話。
想要檢查是否不小心將對話設為公開可存取的使用者,可以透過 Claude 的設定來查看與管理共用連結。使用者可前往 Settings > Privacy > Shared Chats 來查看哪些對話有公開連結,並在需要時撤銷存取。這一步驟是防止意外外洩的實際第一道防線。
這項關鍵洞見顯著影響對責任的理解:雖然平台設計會影響意外外洩的風險,但使用者行為——特別是在可被爬行的公開位置張貼共用連結——是決定那些連結是否會被索引的主要因素。因此產品設計與使用者教育皆相當重要,以減少未來事件的發生。
關鍵洞見表
| 面向 | 說明 |
|---|---|
| 根本原因 | 在可被網路爬蟲搜尋的位置張貼或以其他方式暴露後,共用的 Claude 連結變得可被發現。 |
| 被暴露資料類型 | 據報包括醫療報告、臨床試驗細節、公司內部檔案、未成年人的聯絡資訊、程式碼以及其他私人筆記。 |
| 平台回應 | Anthropic 表示除非公開分享,否則連結不可被發現,並強調使用者可控制;他們聲稱未向搜尋引擎提供網站地圖以分享連結。 |
| 搜尋引擎角色 | 搜尋引擎會索引公開可得的頁面;網站擁有者可使用爬行指示來防止索引。 |
| 使用者行動 | 使用者應檢查 Settings > Privacy > Shared Chats,以撤銷或管理公開連結。 |
後續...
展望未來,平台、研究人員與使用者都應持續關注數個領域。產品設計者應考慮在連結產生與共用預設上增加更多護欄——例如更清楚的警示、公開連結的自動到期,或在將內容設為公開可存取前要求明確確認。加強遙測與監控能有助於更早發現不尋常的索引模式,促使更快速的修復。
在政策與治理面,對於處理使用者分享之 AI 輸出的清晰最佳實務,將有助於組織減少敏感內容意外外洩。這包括針對公開張貼連結的永久性與可被發現性的強化使用者教育,以及在共享內容被索引時的撤銷與通知標準機制。
從技術角度來看,加強對站點層級爬行控制的支援、自動為暫時或私有資源加上 meta 標籤,以及更容易的公開存取撤銷介面,都能降低同類事件重複發生的可能性。最後,針對安全的預設設定、能降低生成被禁止內容風險的提示安全措施,以及在可共用產物中自動偵測敏感資訊的研究,也將有助於減輕傷害。
總之,防止未來的外洩需要結合更好的平台預設、更強的使用者控制與教育、主動監測,以及在安全 AI 內容生成與共用實務上的持續研究。