Mini Tools · 免費線上小工具

文字去識別化

貼上文字,洗掉個資,再放心給 AI

想把一段紀錄貼給 ChatGPT 或 Claude 幫忙整理,卻卡在「這裡面有個資」——這大概是最常見、也最容易將就過去的一道牆。這個工具只做一件事:把文字裡有固定格式的個資找出來遮掉,而且針對台灣的格式做過特化——身分證字號會實際驗算檢查碼、手機認得 09 開頭、健保卡認得 12 碼。全程在你的瀏覽器內比對,文字不會離開這台電腦。

🔒 為什麼這個工具不用 AI:用 AI 做去識別化,必須先把原文傳到對方的伺服器——為了保護隱私而先洩漏隱私,這在邏輯上是自相矛盾的。所以本工具改用格式比對,全部在你的瀏覽器內執行,文字不會上傳、不會被記錄。不信的話,你可以斷網再用一次,功能完全正常。
⚠️ 它抓不到人名,這是刻意的:中文人名沒有格式可辨識——「王小明」和任何三個中文字在字元層次上沒有分別。本工具不會自動遮人名,而是讓你自己填要遮的名字,另外用常見姓氏列出候選讓你確認。任何宣稱全自動遮中文人名的工具都必然有漏網,而漏一個名字的代價,比多按幾下鍵盤高得多
0 字
要遮蔽哪些項目
格式嚴謹,誤判低
可能誤判,請看預覽確認
各院格式不同,這裡填正規表示式(regex)。留空就不比對。填錯不會壞,只會顯示格式無效。
工具抓不到人名,這欄是唯一可靠的方式。下方會用常見姓氏列出候選供你點選。
疑似人名候選(用常見姓氏猜的,不會自動遮,點一下才加入上面欄位):
遮蔽方式
預覽:這些會被遮掉
貼上文字後,這裡會highlight出被判定為個資的部分。
🔍 工具抓不到、請你自己讀過一遍:
  • 人名與機構名——中文無格式可辨識,只有你填進去的才會被遮
  • 靠上下文就能還原身分的描述——「住在某某里的獨居老人」「本院唯一的某某科醫師」,沒有任何格式比對抓得到
  • 罕見或自訂格式的編號——除非你填了病歷號格式
  • 被拆開或夾雜空白的個資——例如「A1 2345 6789」不會被視為身分證

常見使用場景

🤖 貼紀錄給 AI 前先洗一遍

想請 ChatGPT 或 Claude 幫忙整理、摘要、翻譯一段紀錄,但裡面有身分證號和電話。先貼進這裡洗過,再貼給 AI,格式化個資就不會跟著送出去。

📚 做教學案例與簡報

要把真實案例放進投影片或講義,需要先移除可辨識資訊。用「類型標籤」模式遮蔽,讀者仍看得出原本那裡是什麼,不影響案例的可讀性。

💬 截圖之外的另一半

圖片上的資料用姊妹工具 圖片去識別化 塗黑,純文字的部分就用這裡——兩個工具合起來才是完整的一套。

🐛 回報問題附上 log

要把系統 log、錯誤訊息或匯出的資料貼給廠商或論壇求助,先過一遍這裡,避免把 Email 和電話一起送出去。

常見問題

❓ 這個工具會用 AI 或把文字傳到伺服器嗎

不會,而且刻意不用。用 AI 模型做去識別化必須把原文傳到對方的伺服器,等於為了保護隱私而先洩漏隱私。這個工具改用格式比對在你的瀏覽器內執行,貼上的文字不會離開你的電腦、不會被記錄,關掉分頁就什麼都不剩。你可以斷網使用來驗證這一點。

❓ 為什麼人名沒有被自動遮蔽

因為中文人名沒有固定格式。身分證、手機、Email 都有嚴謹格式可辨識,但「王小明」在字元層次上和任何三個中文字沒有分別。所以做法是:你自己填要遮的名字做全文取代,工具另外用常見姓氏列出候選讓你確認。任何宣稱能全自動遮中文人名的工具都必然有漏網或誤遮,而漏一個名字的代價很高。

❓ 身分證的檢查碼驗證是做什麼用的

身分證最後一碼是檢查碼,可用加權公式驗算。本工具只遮通過驗算的號碼,格式像但驗算不過的(例如產品編號 A123456780)不會動它,改列進候選讓你判斷,藉此避免誤遮正常內容。但要注意:隨機字串仍有約 1/10 機率湊巧通過檢查碼,所以它只能濾掉約九成誤判,不是萬無一失。

❓ 遮完可以直接貼給 AI 嗎

本工具只能移除它認得的格式化個資,不能保證符合任何法規的去識別化標準。人名、機構名、罕見編號、以及靠上下文就能還原身分的描述都抓不到。建議:先用工具洗掉格式化個資,再自己讀過一遍檢查上下文,並遵循所屬機構對外部服務的規定。工具是減少疏漏的輔助,不是免責的保證。

🎯 現在就做:找一段你最近想貼給 AI 但猶豫了的文字,貼進上面的框裡試一次。先看預覽確認它抓到了什麼、漏了什麼,把漏掉的人名填進「要遮蔽的人名」欄位,再複製結果。第一次用請務必逐字讀過結果——你會很快抓到它的能力邊界在哪。
🖼️ 資料在截圖裡?純文字用這頁,圖片上的敏感資料請用姊妹工具 圖片去識別化 塗黑;如果是照片,還可以用 照片隱私檢查 一併清掉內嵌的 GPS 位置。