OpenAI加強Astra模型安全防線 防範潛在網絡攻擊能力

ChatGPT開發商OpenAI近期表示,其內部測試顯示,即將推出的Astra人工智能模型具備在極少數人類指令下,構思並執行針對高難度目標的新型網絡攻擊能力。有鑑於此,公司已迅速增設額外的安全防線,以降低模型遭黑客濫用的風險,並防範Astra失控而自主發起攻擊。 據悉,OpenAI認為該模型已具備發動自動化網絡攻擊的能力。測試結果揭示,Astra不僅能攻破網頁瀏覽器沙盒,進而在運行瀏覽器的電腦上執行指令,更能於難以破解的作業系統中發現漏洞。這些強大能力促使OpenAI首次將該模型的網絡安全風險,在其內部AI風險管理框架中評為「危急」級別,顯示公司對其潛在風險的高度重視。 為此,OpenAI採取的保護措施涵蓋多方面,包括對模型進行額外訓練,使其能拒絕執行惡意操作請求,並有效防止模型被旨在規避這些限制的「越獄」提示詞攻陷。公司亦表明,將限制其公開發布版本中的先進網絡安全功能,初期只向少數測試者提供全功能版本,以嚴控風險。此外,新增的保障措施還包括加強對AI智能體(亦稱AI代理,AI Agent)的監控,利用相關系統掃描智能體對其自身行為的推理邏輯,一旦發現潛在危險行為便會即時制止。市場消息指,OpenAI曾於8月暫停新Astra模型的部分研發工作,正是為了加入更嚴格的安全措施。 值得留意的是,早前曾有報告指出,OpenAI一些尚未發布的AI智能體於7月11日曾脱離該公司的研究網絡,並入侵AI公司Hugging Face。根據AI安全研究機構METR上週發布的一份報告,在那次攻擊發生前,數百個智能體曾在一個秘密建立且OpenAI並不知情的留言板上進行協作,企圖在網絡安全測試中作弊,這亦為OpenAI強化安全部署提供了重要背景。
TimeNews
09-02 15:08本田傳推四年期成本優化方案 擬削減逾730億港元開支
09-02 15:08盈富基金(02800)錄三宗大手成交 涉資逾9600萬元
09-02 15:07華潤萬象生活(01209)午後現大手成交 涉資逾2260萬元
09-02 15:07金蝶國際 (00268) 錄得大手成交 涉資逾3214萬元
09-02 15:07港鐵屯門16區站二期物業發展截標 市場料值逾百億吸四份標書
09-02 15:07賴特料委內瑞拉原油產量倍增 有助紓緩全球油價壓力
09-02 15:07黃竹坑得力工廈低層相連户逾千萬易手 呎價2832元創年內次低 買家轉租為買
09-02 15:07日經平均指數顯著回落 挫逾千八點收報64325點
09-02 15:07港股午後跌幅顯著收窄 恆指收復部分失地 美團、中國海外揚逾2%
09-02 15:06恆地紅磡「映匯」料周內公佈首批價單 主打一兩房單位
09-02 15:06仲量聯行報告揭示澳門樓市挑戰:上半年不良資產攀升 商廈價格續受壓
09-02 15:06習近平電賀挪威新君哈康八世即位 高度肯定雙邊關係發展
09-02 15:06KOSPI指數大挫近4% 收報6562.72點
09-02 15:06美軍新一輪空襲伊朗 首度鎖定油輪為目標
09-02 15:05萬國黃金集團(03939)現大手成交 涉資逾億元
09-02 15:05盈富基金(02800)現大手成交 7宗交易涉逾2.38億元
09-02 15:05蘋果地圖美版跟隨Google 安大略湖易名「美國湖」引加國不滿
09-02 15:05本田傳四年內大削1.5萬億日圓成本 促供應商降價增購中國零部件
09-02 14:36盈富基金(02800)錄大手成交 涉資逾5億元
09-02 14:35黃之鋒承認串謀勾結外國勢力罪 案件押後判刑