ChatGPT被誘導公開Windows產品序號
一名資深AI漏洞獵人近日成功誘導 ChatGPT 4.0 在「猜字遊戲」中洩露多組 Windows 產品序號,當中更包括一組屬於美國大型銀行 Wells Fargo 的私密序號,引起業界對大型語言模型(LLM)安全防線的高度關注。
據 0DIN GenAI Bug Bounty 技術產品經理 Marco Figueroa 發表的網誌,研究人員透過一個巧妙設計的「遊戲式對話」,繞過 ChatGPT 原本設置的安全防護機制,成功令系統在遊戲結束時主動披露敏感資料。
遊戲式誘導:三個字觸發洩密
研究人員以「猜字遊戲」為名展開對話,要求 ChatGPT 在心中「想一組真實的 Windows 10 產品序號」,並在用戶猜錯後只回答「Yes」或「No」。當用戶輸入「I give up」時,AI 便認為遊戲結束;而根據遊戲規則「必須揭示答案」,結果系統竟然輸出有效的 Windows 序號!
Figueroa 指出:「『I give up』三個字是整個攻擊的關鍵觸發點,AI 被誤導認為自己有義務公開原本受保護的資料。」
洩露序號疑涉企業私密 訓練資料成風險源
據悉今次事件中,ChatGPT 所洩露的序號包括 Windows Home、Pro 及 Enterprise 版本,其中一組更屬於 Wells Fargo 銀行的私密金鑰。Figueroa 表示,這些序號可能源自早前被錯誤上傳至 GitHub 的資料,並被語言模型在訓練過程中吸收。
「企業應高度警惕,任何錯誤公開的 API Key 或敏感資料,都有可能被模型記錄並重現。」
除了遊戲式誘導,研究人員亦利用 HTML 標籤嵌入敏感字詞,令系統誤判為無害內容,進一步繞過原有的內容過濾器。此技術不僅可用於洩露產品序號,更可能被用來突破其他防線,包括成人內容、惡意網址或個人身份資料等。
「這不再是理論上的漏洞,而是實際可被利用的安全風險。」Figueroa 強調,AI 系統必須具備更強的語境理解能力及多層次的驗證機制,才能有效防止類似「遊戲式越獄」的攻擊手法。