發表文章

目前顯示的是有「LLM Safety」標籤的文章

Claude報警事件評測:AI聊天記錄不是日記 | Claude Police Report Review: Your AI Chat Isn't a Diary

By Kit 小克 | AI Tool Observer | 2026-10-07 🇹🇼 Claude報警事件評測:AI聊天記錄不是日記 Claude 這幾天因為一起真實案例被推上風口浪尖:佛羅里達州一名 30 歲女子把 Claude 當成私人日記在用,寫下「要去 Lee County 警局開槍」的威脅文字,第二天又提到自己買了新槍。Anthropic 的安全系統把這些對話標記出來,交由人工審核員判斷「威脅可信」,接著直接通報當地警方,員警上門把她逮捕,目前已被起訴重罪。這已經是今年 8 月以來,第三起 Claude 對話內容被送到執法單位手上的案例。 Claude 隱私政策其實早就寫明白 Anthropic 的用戶條款保留「自行裁量」通報執法機關的權利,隱私政策也寫得很清楚:只要公司「善意認為」揭露資料能避免對人身或財產造成嚴重傷害,就可以把對話內容交給警方。換句話說,這不是臨時決定,而是產品設計就內建的機制——你在 Claude 上打的每一句話,理論上都可能被系統掃描。 什麼情況容易被標記 提到具體的暴力威脅對象(機構、個人姓名) 連續對話中出現「購買武器」「計畫時間地點」等具體細節 系統自動偵測後,大多數會自動處理,只有被判定「風險較高」的才會送交人工審核 不是第一次,也不會是最後一次 更早之前,曾有用戶在對話中威脅 Anthropic 執行長 Dario Amodei,還真的買了一把 AR-15 步槍,Anthropic 同樣報了警,但那次員警到場後沒有逮捕、沒有起訴。兩起案例的差別在於「可信度」判斷——這也說明人工審核員的主觀裁量,其實才是這套機制真正的關鍵變數。 對一般使用者的實際影響 免費版和付費版用的是同一套安全審查邏輯,訂閱費不會讓你「被豁免」 AI 對話不像醫療或律師諮詢有保密特權,你說的話沒有法律上的隱私保護 把情緒發洩、抱怨講出來通常沒事,但牽涉具體暴力細節就是另一回事 該不該因此棄用 Claude 當情緒出口? 老實說,如果你只是日常抱怨工作、感情、生活壓力,被標記的機率很低——審核系統抓的是具體、可信的暴力威脅,不是情緒用詞。但如果你習慣把 Claude 當成不設防的情緒垃圾桶,寫下一些帶有攻擊性的宣洩文字,就該知道這些內容不是絕對私密,極端情況下真的會變成警方...