全部在你的瀏覽器裡跑,沒有任何資料上傳

chart-scrub

繁體中文臨床文字的規則式去識別化。左邊貼文字,右邊看遮罩結果。
Rule-based de-identification for Traditional Chinese clinical text — everything runs client-side.

這頁只示範規則引擎。 完整版還有「同一個病人跨次就診固定代號」的假名化管線與殘留檢查,那部分需要本機資料庫, 請看 GitHub repo
你貼進去的文字不會離開這個分頁。沒有上傳、沒有記錄、沒有追蹤, 整頁載入完成後就算把網路斷掉也照樣能用,不信可以自己試。

輸入 Input

遮罩後 Masked

遮完還活著的數字串(對應 CLI 的 mask --audit

規則沒認出來的數字串會列在這裡,附上形狀猜測——猜測只供你裁決,工具不自己決定什麼是安全的。 如果某個形狀在你的病歷裡固定是識別碼(例如裸的 8 位病歷號),把它寫進下面的自訂規則再遮一次。

目前沒有存活的數字串。

自訂規則(對應 CLI 的 --rules my-hospital.json)——你們醫院自己的識別碼形狀,跑在內建規則之前

它會遮什麼

每家醫院會遇到的識別碼不一樣——取消勾選就停用那條規則,結果即時更新。 CLI 對應 --skip 參數。

它遮不掉什麼(請務必看完)

最重要的一條在最前面,而且它不是可以靠加規則解決的:

所以正確的用法是:把它當第一道網子,不是當保證。 輸出仍然要有人看過再送出去,而「這個故事會不會被認出來」那一關, 只有寫的人自己判斷得了。