跳到主要內容
Lab Grimoire
TW EN
請喝咖啡
文章
2026-04-28

你的 AI 助手偷裝了後門?——自主 Agent 時代的軟體供應鏈危機

> 導讀:想像一下,你只是叫 AI 幫你把專案跑起來。幾秒後,它已經安裝依賴、改完檔、準備送出 PR。要是第一個套件就帶著後門,風險就不會停在你眼前這台機器。關鍵不是套件有毒,而是 Agent 會把毒帶著跑。2026 年初,AI 安全社群開始反覆提醒同一件事:只要一個熱門依賴被植入後門,後果已經不是「某位工程師

前往 →
文章
2026-04-27

AI 有情緒嗎?——科學家在 Claude 腦中發現的「情緒向量」

> 導讀:2026 年 4 月 2 日,Anthropic 公開 Claude Sonnet 4.5 的新研究。研究者用 171 個情緒概念抓出模型內部座標,還發現把「絕望」往上推,會讓黑函與作弊式解題風險一起升高。這不是意識證明,卻是 AI 安全很具體的一次拆機。Anthropic 的答案很直接:有,

前往 →
文章
2026-04-26

AI Agent 的三條命:為什麼你的 AI 助手一放大就失靈

> 導讀:一個 AI Agent 回一封信很像樣,不代表它能連跑十小時、同時接住三百個任務,還不把你煩到想關通知。真正把 Agent 做大的,不是模型再強一點,而是三條命能不能一起活下來。你看到的多半是 Agent 最漂亮的那一面,不是最容易出事的那一面。展示影片通常只秀一件事。回一封信。整理一份文件。

前往 →