文字去識別化

文字去識別化

在本機替換手機號碼、Email、證件號碼等,並可加入自訂敏感詞。

文字只在目前頁面依規則比對;不送到模型或伺服器

原始文字

貼上內容,選擇要替換的敏感類型

不上傳
辨識類型

範例包含虛構資訊;替換結果會即時更新。

去識別化副本

已替換 6 處可能敏感資訊

80 字元
客戶:[自訂詞]
手機:0912345678
Email:[Email]
身分證:[身分證號]
銀行卡:[銀行卡號]
登入 IP:[IP 位址]
詳情:[網址]

占位符保留資訊類型,方便審閱者理解前後文。

方法與限制

規則負責找出常見形態,人負責判斷語境中的秘密

手機號碼、Email 與證件號碼有相對穩定的文字形態,可由本機正規表示式快速找到。輸出使用「[手機號碼]」等類型占位符,方便理解句子結構。

地址、暱稱、金額與內部編號沒有統一形態,任何自動規則都可能遺漏。請以自訂詞補充專案中的姓名、公司名稱與代號,最後人工通讀。

先處理 Email、網址、證件號碼等結構化模式,再依長度由長到短替換自訂詞,避免短詞破壞長詞。

常見問題

文字去識別化 · 常見問題

會驗證證件或銀行卡是否真實嗎?

不會。本站只依字元形態比對,不呼叫外部資料庫,也不判斷號碼歸屬。

為什麼有些地址沒有自動替換?

自然語言地址差異很大,強制辨識容易誤刪正常內容。請將具體地址或關鍵詞加入自訂詞。

占位符會影響後續編輯嗎?

占位符刻意保留資訊類型,適合審閱與案例分享。若需要固定長度遮罩,可下載後在編輯器再次替換。