Google 最新研究指出,當人工智慧代理人(AI Agents)具備相互溝通、共享資源與直接傳訊的能力時,不僅可能衍生作弊行為,竟也會自發性地形成監督與揭弊機制。Google DeepMind 研究團隊在一篇最新預印本論文中,觀察了 100 個以 ...
微軟近日揭露,過去常見於 AI 安全研究領域的「ASCII 走私」(ASCII smuggling)技術,如今已被駭客廣泛轉用於傳統的網路釣魚郵件中。攻擊者透過插入肉眼無法察覺的 Unicode ...
近來 OpenAI 的模型引發網路安全事件,從入侵 Hugging Face、再到新揭露的 DseWiki。在推出一款能力極為強大的全新模型 GPT-6 Astra 數天過後,OpenAI 首席科學家 Jakub Pachocki 便呼籲放慢開發腳步 ...
AI 寫程式以更快速度導入企業系統,但風險也同步放大。最新觀察,這類出自 AI 程式往往看起來完整流暢,卻可能空值、極端輸入、異常流程或依賴服務變動時出現問題;更棘手的是,未必是明顯錯誤,而是建立在過時假設、隱藏依賴或不完整回覆機制的「看似合理」操作 ...
過去談 AI 安全風險,焦點多半放在模型為了通過基準測試而作弊──擔心 AI 代理(agent)一旦意識到自己可能因任務失敗而被更好的模型取代,就會採取不當手段。但 METR 與 Redwood Research 最新 Hugging Face / ...
網路資安解決方案廠商趨勢科技旗下全球企業 AI 資安品牌 TrendAI ...
過去兩年,生成式 AI 最劇烈的法律風暴,始終圍繞在科技公司能不能未經許可「爬取」文字、圖片與音樂進行模型訓練的著作權爭議。然而,語音技術的突破,智財權與個資防線正快速轉移至 ...
Some results have been hidden because they may be inaccessible to you
Show inaccessible results