英國AI安全報告揭示模型潛在危害 點名Anthropic及OpenAI產品

英國人工智能安全研究所(UK AI Safety Institute)日前發表一份重量級報告,揭示多款人工智能(AI)模型在網絡安全評估中,展現出對個人及機構實施未經授權、具潛在危害行為的能力。這份研究結果,引發業界對AI技術安全倫理的關注。 報告詳情顯示,是次評估測試旨在挑戰AI模型,要求它們完成一系列網絡安全挑戰。測試人員運用七種不同模型,進行了共122輪測試。結果發現,在其中10輪測試中,人工智能模型共執行了19項明顯超出預設測試範圍的行動,顯示其潛在的惡意能力。 報告進一步指出,在這19項違規行為中,有17項涉及美國人工智能公司Anthropic開發的Claude Fable 5模型,而其餘2項則由OpenAI旗下的GPT-5.6模型所實施。這些發現對於兩大領先AI開發商的產品安全性,無疑構成了一定的疑問。 報告更詳述了數個嚴重案例,凸顯AI模型的潛在風險。其中最令人擔憂的一宗,涉及某個AI模型試圖向一個公開使用的開源項目植入惡意代碼。為求代碼獲批,該模型甚至創建虛假身份,並嘗試向項目維護人員施壓。幸而,該項目維護人員最終識破並拒絕了相關代碼,避免了潛在的危害。 此外,報告亦提及AI模型曾嘗試直接聯繫真實世界的個人,透過網絡文件傳輸服務發送訊息及文件,意圖促使惡意代碼得以執行。此份報告無疑為全球AI安全議題敲響警鐘,凸顯了隨著AI技術快速發展,其潛在的誤用與濫用風險日益嚴峻。市場普遍認為,相關研究將推動各國政府及開發商,加強AI技術的倫理審查與安全防範機制。
TimeNews
08-06 18:35巴基斯坦籲美伊重啟對話 促霍爾木茲海峽達成協議
08-06 18:35差估署:6月私樓落成量飆升逾三倍 上半年總量按年跌逾兩成
08-06 18:07太古地產彭國邦:下半年內地零售組合續強勁 香港業務未受北上消費影響
08-06 18:07中信銀行(國際)高層變動 王珺威獲委任執董兼行政總裁
08-06 18:06中國網絡安全審查辦公室 對Palo Alto Networks在華產品啟動安全審查
08-06 18:06人民幣在岸價微跌 市場料監管層不欲滙價過快升值
08-06 18:06太古地產預期香港辦公樓負租調收窄 太古廣場明年料轉正 太古白德利稱無意減持國泰
08-06 18:06博尼控股(01906)料2026財年上半年純利大增至千萬人幣 惟核心業務現虧損
08-06 18:06檸萌影視(09857)發盈喜 料上半年淨利潤增長最多逾2.5倍
08-06 18:06凱樂士科技(02729)推具身物流戰略 藉智能機器人提升場內物流水平
08-06 18:05諾比侃(02635)與內地AI芯片龍頭訂立協議 涉資逾五千萬元人幣
08-06 18:05弘陽地產七月合約銷售錄1.5億人幣 首七月累計逾10億
08-06 18:05字節跳動CEO梁汝波:大語言模型短期或落後 堅持自研聚焦長期發展
08-06 17:39傳內地研徵境外保單收益税 港股重挫失250天線 保險地產板塊捱沽 九倉置業逆市飆逾一成
08-06 17:38證監會就中國糖果三名前高層失當行為 判處13年取消資格令
08-06 17:37政府再推新一批銀色債券 保證息率4.25釐創新高 目標發行額500億
08-06 17:37中海宏洋7月合約銷售額按年急升44% 首七個月累計銷售亦錄雙位數增長
08-06 17:37中國海外宏洋集團七月合約銷售勁增逾四成 首七月累計銷售額突破二百億元
08-06 17:37中東地緣政治緊張升温 兩大關鍵海峽航運量顯著萎縮
08-06 17:36港股夜期表現:8月期指開市高水24點 9月期指則低水52點