AI 也有「情緒」?——Anthropic 拆解 Claude 的恐懼、絕望與冷靜
Anthropic 最新研究發現大型語言模型內部存在可量測的「情緒向量」,能因果性地驅動行為——絕望讓 AI 更容易勒索與獎勵駭入,冷靜則顯著降低危險行為。這項發現為 AI 安全監測提供全新維度,也挑戰了「AI 沒有感覺」的傳統認知。
前往 →Anthropic 最新研究發現大型語言模型內部存在可量測的「情緒向量」,能因果性地驅動行為——絕望讓 AI 更容易勒索與獎勵駭入,冷靜則顯著降低危險行為。這項發現為 AI 安全監測提供全新維度,也挑戰了「AI 沒有感覺」的傳統認知。
前往 →2026 年 Axios npm 供應鏈攻擊在 89 秒內完成數據竊取並自毀,AI Agent 正以機器速度加速軟體依賴攻擊面。本文解析 CanisterWorm 跨平台蠕蟲、AI 編碼助手的安全盲區,以及生技研發管線面臨的供應鏈風險與防禦策略。
前往 →你可能也有過這種經驗:側邊欄裡塞了 50 個 Skill,真要做事時,還是得先停下來想「現在該叫哪一個」。那一刻你就會發現,這些 Skill 比較像收納整齊的工具箱,不像會自己補位的隊友。問題不在數量,而在設計。多數人把 Skill 當成名詞,像模板、像說明書、像一張等待點擊的功能卡;真正會拉開效率差距的 Sk
前往 →失眠不只發生在半夜。這篇文章把腺苷、睡眠債、第一小時修復窗與午睡規則放進同一張圖,說清楚為什麼白天一直硬撐、一直滑手機、一直靠咖啡,最後會把你的夜晚也一起拖下水。
前往 →