AI 資安指南:哪些資料不該提供給人工智慧?

AI 資安指南:哪些資料不該提供給人工智慧?
內容表

嚴格控管輸入的資料,是使用消費級語言模型的基本原則。資訊一旦送進公開提供的 AI 工具,就會離開使用者的本機環境。將機密資料輸入 AI,可能導致資料外洩、商業機密曝光,或違反個人資料保護法規。因此,與 AI 的每一次互動,都應比照公開發布資訊來審慎對待。

哪些資料不能貼給 AI?

使用公開提供的 AI 模型時,應避免輸入以下類別的資料:

  • 個人資料——自己、客戶或員工的姓名、地址、身分證字號、電話號碼及電子郵件地址;
  • 醫療紀錄——病史、檢驗結果及診斷資料;這類資訊受到個人資料保護法等嚴格規範,在適用情況下也可能涉及 HIPAA;
  • 企業機密資訊——尚未公開的財務報告、行銷策略、客戶名單,以及併購或裁員計畫;
  • 營業秘密——軟體原始碼、生產配方、獨有演算法及企業內部技術文件;
  • 密碼與憑證——API 金鑰、登入資訊、授權權杖、支付卡資料及各類加密金鑰;
  • 受著作權保護的材料——未取得適當授權的完整書籍、付費學術文章或劇本;
  • 違法內容——宣揚暴力、仇恨的材料,或教導他人從事違法行為的內容。

輸入 AI 的資料會經歷什麼處理?

傳送給雲端服務供應商的資料,可能經過多個階段的處理與分析;產生回答並不是這些資訊生命週期的終點。

模型訓練

輸入一般消費級生成式 AI 工具的資料,經常可能被用於後續模型訓練。這表示輸入內容可能影響神經網路的權重,理論上也可能在日後生成的內容中,以某種形式出現在其他使用者的回答裡。

人工審查與內容審核

除了自動處理,AI 系統也設有安全過濾機制。如果演算法判定某個提問可疑,例如可能違反服務條款,對話就可能被標記並送交人工審查。為了改善內容審核機制,服務供應商的員工或外部審查人員(資料標註員)因此可能直接查看輸入的內容。

資料儲存與備份

AI 供應商會將對話紀錄存放在伺服器上,以維持服務、排除故障,並保留後續對話所需的脈絡。要注意的是,使用者在介面上刪除聊天紀錄,通常不代表資訊會立即從伺服器移除。資料可能在供應商的備份系統中保留一段時間;若雲端基礎設施遭到成功入侵,機密資訊曝光的風險也會隨之增加。

個人帳號與企業帳號:保護程度有何不同?

AI 的資料安全保護程度,會因訂閱方案和部署方式而有顯著差異。

免費及付費的一般個人帳號:許多熱門服務預設可能將使用者提交的資訊用於模型訓練。因此,只要在對話中提供機密資料,就有資料失去控管的風險。

企業與組織環境:例如 Enterprise 帳號,或透過 Microsoft Azure、AWS、Google Cloud 等供應商的 API,在企業專用雲端環境中部署的服務,通常提供較嚴格的保護。供應商可能承諾符合 ISO 27001、SOC 2 及適用的個資保護法規等要求,並在 SLA/DPA 等合約文件中載明,不會使用客戶資料訓練公開的基礎模型。在這類環境中,輸入資料的限制可能較有彈性,但仍須建立風險管理政策及存取控制。

哪些內容可以提供給 AI?

雖然需要避開敏感資訊,仍有許多內容適合交由 AI 處理,例如:

  • 公開資料——開放取用的文章、部落格貼文、公開市場報告、法規,以及網站上的公開內容(例如維基百科);
  • 非機密資訊——一般性指示、理論概念問題、文法與拼字規則、數學式或詞義查詢;
  • 已匿名化的文件片段——公文範本、契約範本,或已徹底移除特殊變數、金鑰、客戶名稱與內部架構資訊的程式碼片段;
  • 自己的創作內容——不含敏感商業資訊的電子郵件草稿、社群貼文、簡報大綱或文章;
  • 開放資料集——用於練習資料分析與格式整理的合成資料,或公開資料庫中的統計資料。

傳送給 AI 前,如何有效匿名化訊息與資料?

將機密文件傳送給語言模型前,應先妥善整理,移除敏感資訊。這樣才能在處理文字的同時,降低機密資料曝光的風險。

移除識別資訊與代碼化

代碼化是以虛構代稱取代敏感資料。例如,將「陳大明」改成「[客戶_1]」,或將「宏達公司」改成「[機構_A]」。如此一來,語言模型仍能理解文件的結構、語法與脈絡,同時降低辨識原始當事人的可能性。

敏感資訊遮蔽技巧

遮蔽是直接隱藏關鍵字串,通常以特殊符號取代部分內容,例如將卡號寫成「4532 **** **** ****」。另一種有效方法是將資料概括化:不提供精確數值,例如月薪新臺幣 55,000 元,而改用區間,例如「月薪約新臺幣 50,000 至 60,000 元」,以降低重新識別的風險。

流程自動化:DLP 與 RegEx 工具

手動清除長篇文字中的敏感資訊,容易有所遺漏。專業環境可運用以正規表示式(RegEx)為基礎的程式,或 DLP(資料外洩防護)系統,在提示詞送出前自動掃描,偵測、攔截或替換符合身分證字號、統一編號、電子郵件地址及銀行帳號格式的字串。

如何關閉 AI 使用你的資料訓練模型?

除了審慎選擇輸入內容,也可以透過工具設定降低風險。多數供應商都提供退出資料訓練的選項。

  • ChatGPT(OpenAI)——前往帳號的 Settings,在 Data controls 中關閉 Improve the model for everyone,即可停止將後續輸入的內容用於改善模型。在目前的介面中,關閉此選項不會移除使用者可見的對話紀錄。出於濫用監控及安全目的,OpenAI 仍可能依其資料保留政策,在伺服器上暫時保留相關紀錄;實際期限應以官方最新說明為準。
  • Gemini(Google)——在隱私設定中關閉 Gemini Apps Activity。關閉後,新的對話不會儲存至 Google 帳號,也不會用於模型訓練。不過,這不代表供應商的系統會立即刪除所有紀錄;Google 可能基於服務安全目的,將資料保留最多 72 小時。
  • Claude(Anthropic)——免費及一般消費級版本的資料使用預設設定,可能允許將輸入內容用於改善模型。這與 Anthropic 早期強調不以使用者對話訓練模型的做法有所不同。若要關閉,請前往帳號設定的隱私區,停用 Help improve Claude。

請注意,變更隱私設定及退出模型訓練通常只對之後提交的資料生效。設定變更前已提交的資訊,不一定能透過關閉選項從既有處理流程中移除。

總結

  • 使用消費級 AI 工具時,應將每次輸入視為可能公開的資訊;不要提供個人資料、醫療紀錄、密碼或營業秘密。
  • 提交的資訊可能經過模型訓練、內容審核,以及供應商伺服器上的儲存與備份等處理。
  • 使用模型前,先透過匿名化、敏感字串遮蔽、代碼化或專用 DLP 工具處理資料,有助於降低風險。
  • Enterprise 帳號及企業專用雲端服務通常提供更嚴格的保護,並可透過合約約定不將客戶資料用於公開模型的訓練。
  • 調整隱私設定、退出模型訓練通常只對未來提交的資料生效,無法保證移除先前已提交並進入處理流程的資訊。

發佈留言

發佈留言必須填寫的電子郵件地址不會公開。 必填欄位標示為 *

部落格上的最新資訊

29.09.2026 文案寫作
28.09.2026 文案寫作
26.09.2026 文案寫作
25.09.2026 文案寫作
24.09.2026 文案寫作
23.09.2026 文案寫作
19.09.2026 文案寫作
18.09.2026 內容行銷
17.09.2026 內容行銷

專業的商業文字

免費報價

成為一名文案工作者

職業發展

文案策劃
實戰
課程