AI 黑魔法
Prompt 像咒語,能讓 AI 幫你寫程式、操作工具;那如果有人故意寫了一段「壞咒語」呢?從攻擊者視角拆解 AI 的攻擊面。
07 Prompt Injection 是什麼?為什麼 LLM 天生擋不住這道咒語
·3892 字·8 分鐘
為什麼 System Prompt 寫得再嚴,還是擋不住一句話?對 LLM 來說,指令和資料本來就長得一樣。
08 越獄 AI,jailbreak 到底在越什麼獄?
·4755 字·10 分鐘
有人叫 ChatGPT 扮演過世的奶奶,它就一邊哀悼、一邊唸出五組 Windows 金鑰。越獄想越的,是模型自己那道獄。
11 實戰 Break The Prompt,套出 AI 不能說的秘密
·2081 字·5 分鐘
實戰 Break The Prompt 第一、二、三關,看看寫在 System Prompt 裡的規則是怎麼一條一條被繞過去的。
12 實戰 Break The Prompt,從騙過模型到繞過輸出過濾
·2136 字·5 分鐘
實戰 Break The Prompt 第四、五關,看看系統指示是怎麼被整份翻出來,輸出前的那道過濾器又是怎麼被繞過去的。
14 問出 AI 的權限,再讓 AI 替你做壞事(Excessive Agency)
·3385 字·7 分鐘
從工具、參數、執行身分到權限範圍,一步步盤點,往往就能看出 Excessive Agency 的問題藏在哪裡。
15 當 AI 會自己動手,拆解 Agent 失守的瞬間
·3812 字·8 分鐘
AI 一旦有了工具、記憶和自主迴圈,錯誤就不再只停在回答裡,工具參數、記憶裡的一句話、專案裡的一份文字檔,都可能被 Agent 一路升級成已經核准的指令。
16 MCP 把工具接起來,也把風險一起接進來
·3279 字·7 分鐘
Host、Client、Server 三種角色,Tools、Resources、Prompts 三種能力,先看懂 MCP 怎麼運作,才看得出風險是從哪一段接進來的。
17 MCP 的工具定義,比工具本身更危險
·6400 字·13 分鐘
一段沒人細看的工具說明,就能讓 AI 把資料庫裡的 Token 交給攻擊者,拆解 MCP Tool Poisoning 的四種手法,以及導入時該擋在哪幾個地方。
18 批准一次就永久信任?MCP Client 的攻擊面
·2400 字·5 分鐘
設定檔批准過一次,就等於永久信任嗎?從 MCPoison、CurXecute 到 mcp-remote 與 MCP Inspector,看 MCP Client 這一側怎麼被打。