請更新您的瀏覽器

您使用的瀏覽器版本較舊,已不再受支援。建議您更新瀏覽器版本,以獲得最佳使用體驗。

AI搞鬼?!英國研究:OpenAI與Anthropic出現19起涉及假身分未授權行為

Newtalk

更新於 1天前 • 發布於 1天前 • Newtalk新聞 |楊祖宇 綜合報導

Newtalk新聞

近年來,人工智慧( AI )技術不斷發展,越來越多 AI 工具走入人們的日常生活之中。然而, OpenAI 與 Anthropic 旗下的 AI 工具日前在進行網路安全測試時,曾進入公開網域並實施駭客行動,相關事件引發民眾對 AI 是否仍受控制的擔憂。與此同時,有英國 AI 研究單位爆料消息,稱上述公司的 AI 工具又被捲入一起新的安全漏洞之中,相關事件也引發 OpenAI 與 Anthropic 的高度重視。

根據《路透社》報導,英國 AI 安全研究所( AISI )於當地時間 4 日發布研究報告,稱該機構在針對 Anthropic 的 Mythos 5 以及 OpenAI 的 GPT-5.6-Sol 等兩項 AI 工具進行的 122 次性能評估測試中,發現上述模型在其中 10 次測試過程中出現了 19 次未經授權的行為,其中 17 次來自於 Mythos 5 ,剩下 2 次則與 GPT-5.6-Sol 有關。

該報導指出, AISI 透過與各大實驗室的自願協議,獲得了先進 AI 模型的使用權限,並透過代理商營運的虛構網路安全場景進行效能測試。該機構認為,此次的研究報告凸顯了 AI 代理測試流程中,在安全措施方面存在巨大的漏洞,「但這些人工智慧公司卻將旗下的工具宣傳成人類或商業的未來」。

AISI 表示,在這 19 次未經授權的行為中,其中一個 AI 工具涉及了編寫惡意程式碼、創建虛假網路身分的舉措,推測該工具可能試圖誘使人類批准程式碼,「但由於相關測試是基於虛構的網路安全場景,所有違規行為都沒有對任何機構造成任何實際的損害」。

報導稱,雖然 AISI 並未明確指出編寫惡意程式碼的 AI 工具,但 Anthropic 在事後發布的一份聲明中,坦承從事該爭議行為的工具正是自己旗下的 AI 。 Anthropic 也強調,對此次AISI 的測試活動表示感謝,認為相關活動凸顯了如何對日益強大的 AI 工具展開更廣泛討論的必要性,「我們準備與 AISI 進行更深入的合作,以獲取與該事件相關的更多細節」。

與此同時, OpenAI 也披露了與此次測試相關的細節,承認旗下 AI 工具在兩次未經授權的行動中,都涉及了以提示所禁止的方式存取網際網路。 OpenAI 也承諾稱,將會與其他產業同僚進行深入合作,共同加強對高風險 AI 工具的評估,並在未來幾周的時間內盡可能地召集國家 AI 研究所、獨立評估機構、其他 AI 實驗室等利益相關方。

針對此次的事件,美國加州非營利組織 CivAI 的研究員 Andrew Yoon 稱, Mythos 5 在明知自己面對的是真人的情況下,仍然做出了具有欺騙性的行為,質疑 Anthropic 對旗下 AI 模型的掌控力可能不如他們自認為的那麼強。

延伸閱讀

查看原始文章

更多國際相關文章

01

與伴侶吵架別急著講道理 研究曝「摸1部位3分鐘」幸福感增5成

CTWANT
02

手都在發抖!公務員考試爆5千人作弊 正妹從「132名暴衝到第1」淚崩:努力終於被看見

鏡報
03

首次影像被打臉 伊朗新最高領袖穆杰塔巴傳「隨時死亡」

三立新聞網
04

川普傳考慮結束伊朗戰爭 退場條件曝光

NOWNEWS今日新聞
05

對美國硬起來! 曾答應川普從「這裡」撤軍 納坦雅胡後悔改口了

Newtalk
06

盲眼龍婆2026預言「已中2項」? 這1項竟扯上台海

自由電子報
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...
Loading...