#AI安全
共72篇文章
安全專家開發IronCurtain系統,透過「憲法式」政策控制AI代理人行為,解決當前AI助理亂刪郵件、發送不當訊息等問題。
OpenAI和Anthropic前研究員接連公開表達安全擔憂,新型舉報平台興起。這場AI業界的道德覺醒意味著什麼?
OpenAI員工曾對ChatGPT用戶的暴力言論示警,但公司高層拒絕通報當局。該用戶後來真的在加拿大發動槍擊案,引發AI企業責任邊界的討論。
PRISM by Liabooks
在此刊登您的廣告
[email protected]美國大學生控告ChatGPT造成精神傷害,指控AI讓他相信自己是先知。隨著類似案例增加,AI企業的法律責任邊界在哪?
微軟發布數位內容驗證藍圖,評估60種技術組合對抗AI深偽。但平台商業利益與技術限制,讓這場真假之戰更加複雜。
OpenAI在2024年IRS文件中刪除使命聲明中的「安全地」字眼,反映其從非營利組織向營利企業的根本轉變。分析這一變化的深層意義。
PromptLock勒索軟體宣稱使用AI全自動攻擊,但真相如何?探討AI網路犯罪的現實與炒作之間的界線。
PRISM by Liabooks
在此刊登您的廣告
[email protected]OpenClaw讓用戶打造個人AI助理,但安全漏洞頻傳。從提示注入攻擊到資料外洩,AI代理人的風險管理成為關鍵挑戰。
OpenAI解散負責AI安全監督的對齊團隊,將前負責人任命為「首席未來學家」。此舉引發對AI開發安全性被忽視的擔憂。
Anthropic發布新憲法,試圖解決AI安全與開發競爭的根本矛盾。讓Claude自主判斷的創新做法,能否成為AI治理的新典範?
全球首個純AI社交平台Moltbook上線,160萬個AI機器人自主互動、創造密語、討論如何對抗人類。這是技術突破還是失控的開始?
PRISM by Liabooks
在此刊登您的廣告
[email protected]爆紅AI代理人OpenClaw的技能市場驚現數百個惡意軟體,揭示AI時代全新的網路安全挑戰與風險