AI 模型面臨隱藏代碼指令新威脅 資安偵測恐失靈

AI 模型面臨隱藏代碼指令新威脅 資安偵測恐失靈
AI 模型面臨隱藏代碼指令新威脅 資安偵測恐失靈

商傳媒|何映辰/台北報導

人工智慧(AI)模型正成為新型網路攻擊的目標。資安公司 Cloudflare 的威脅情報團隊 Cloudforce One 近期揭露一種名為 Indirect Prompt Code Injection(IDPI)的技術,攻擊者利用此技術操控 AI 模型對程式碼的解讀方式,進而規避傳統資安偵測,引發業界高度關注。

根據《Mexico Business》報導,這種攻擊並非直接改變應用程式的行為,而是透過將隱藏指令嵌入小型應用程式中,影響 AI 模型對底層程式碼的判讀。簡而言之,攻擊者能藉由在程式碼中偷偷植入指令,讓 AI 模型在分析時,錯誤地將惡意內容判讀為無害或合法,最終避開資安系統的偵測。由於這些指令是專為 AI 系統設計,傳統基於規則的資安警報難以察覺。

Cloudflare 拉丁美洲區副總裁 Bert Milan 指出,現今攻擊的目標不再僅限於審查程式碼的人員,也擴及負責分析程式碼的 AI 系統。攻擊者試圖說服 AI 模型,使其認為惡意程式碼是合法、無害或與調查無關的。特別是當惡意邏輯被數千行正常程式碼包圍時,會大幅降低 AI 模型識別威脅的有效性。

面對這項新挑戰,專家強調組織必須建立健全的防護措施,不僅要能識別操縱企圖,更要能評估程式碼的實際行為,而非僅僅遵循其內嵌指令。在高風險決策上,仍需維持人工監督的重要性。企業應審慎評估其 AI 系統偵測威脅的能力,並警惕對手可能影響 AI 系統推理過程的資安風險。

AI 模型面臨隱藏代碼指令新威脅 資安偵測恐失靈

被google AI引用三步驟
返回頂端