想把一段紀錄貼給 ChatGPT 或 Claude 幫忙整理,卻卡在「這裡面有個資」——這大概是最常見、也最容易將就過去的一道牆。這個工具只做一件事:把文字裡有固定格式的個資找出來遮掉,而且針對台灣的格式做過特化——身分證字號會實際驗算檢查碼、手機認得 09 開頭、健保卡認得 12 碼。全程在你的瀏覽器內比對,文字不會離開這台電腦。
- 人名與機構名——中文無格式可辨識,只有你填進去的才會被遮
- 靠上下文就能還原身分的描述——「住在某某里的獨居老人」「本院唯一的某某科醫師」,沒有任何格式比對抓得到
- 罕見或自訂格式的編號——除非你填了病歷號格式
- 被拆開或夾雜空白的個資——例如「A1 2345 6789」不會被視為身分證
常見使用場景
想請 ChatGPT 或 Claude 幫忙整理、摘要、翻譯一段紀錄,但裡面有身分證號和電話。先貼進這裡洗過,再貼給 AI,格式化個資就不會跟著送出去。
要把真實案例放進投影片或講義,需要先移除可辨識資訊。用「類型標籤」模式遮蔽,讀者仍看得出原本那裡是什麼,不影響案例的可讀性。
圖片上的資料用姊妹工具 圖片去識別化 塗黑,純文字的部分就用這裡——兩個工具合起來才是完整的一套。
要把系統 log、錯誤訊息或匯出的資料貼給廠商或論壇求助,先過一遍這裡,避免把 Email 和電話一起送出去。
常見問題
不會,而且刻意不用。用 AI 模型做去識別化必須把原文傳到對方的伺服器,等於為了保護隱私而先洩漏隱私。這個工具改用格式比對在你的瀏覽器內執行,貼上的文字不會離開你的電腦、不會被記錄,關掉分頁就什麼都不剩。你可以斷網使用來驗證這一點。
因為中文人名沒有固定格式。身分證、手機、Email 都有嚴謹格式可辨識,但「王小明」在字元層次上和任何三個中文字沒有分別。所以做法是:你自己填要遮的名字做全文取代,工具另外用常見姓氏列出候選讓你確認。任何宣稱能全自動遮中文人名的工具都必然有漏網或誤遮,而漏一個名字的代價很高。
身分證最後一碼是檢查碼,可用加權公式驗算。本工具只遮通過驗算的號碼,格式像但驗算不過的(例如產品編號 A123456780)不會動它,改列進候選讓你判斷,藉此避免誤遮正常內容。但要注意:隨機字串仍有約 1/10 機率湊巧通過檢查碼,所以它只能濾掉約九成誤判,不是萬無一失。
本工具只能移除它認得的格式化個資,不能保證符合任何法規的去識別化標準。人名、機構名、罕見編號、以及靠上下文就能還原身分的描述都抓不到。建議:先用工具洗掉格式化個資,再自己讀過一遍檢查上下文,並遵循所屬機構對外部服務的規定。工具是減少疏漏的輔助,不是免責的保證。