關於 AI 的說法——嚇人的、好得不像真的——我都真的拿來測。每一篇都附上程式碼和證據,你可以自己重現,或拿去測你自己的系統。
有個說法是:把兩個 LLM 串起來,會悄悄抵銷掉它們的安全性。我拿三個 Claude 模型做了測試。第二個模型看得到前面那個拒絕時,它守住了(0/9);拒絕被拿掉後,它每次都照做(9/9)。安全是在情境裡,不在模型裡。
更多實測陸續會有。想在信箱收到下一篇?到 Substack 訂閱 →