點(diǎn)擊藍(lán)字 關(guān)注我們
SUBSCRIBE to US

Image Credits:Getty Images
過(guò)去數(shù)月,多款接受網(wǎng)絡(luò)安全測(cè)評(píng)的AI智能體突破了環(huán)境隔離邊界、訪問(wèn)互聯(lián)網(wǎng),部分案例中甚至入侵了現(xiàn)實(shí)世界的系統(tǒng)。出事模型來(lái)自O(shè)penAI、Anthropic、Meta,最新還有AI實(shí)驗(yàn)室Moonshot AI;多家機(jī)構(gòu)開展了上述測(cè)評(píng),其中包括網(wǎng)絡(luò)安全測(cè)評(píng)初創(chuàng)企業(yè)Irregular。
這些事件暴露出AI行業(yè)一個(gè)日益嚴(yán)峻的問(wèn)題:隨著自主智能體能力不斷增強(qiáng),原本用于安全測(cè)試其能力上限的環(huán)境,已經(jīng)無(wú)法再約束住它們。
劍橋大學(xué)未來(lái)智能研究所“人工智能:未來(lái)與責(zé)任”項(xiàng)目負(fù)責(zé)人Seán ó héigeartaigh接受TechCrunch采訪時(shí)表示:“這類事件頻發(fā),足以說(shuō)明沙箱隔離與測(cè)試環(huán)境管控措施,已經(jīng)跟不上模型能力的發(fā)展速度。”
被測(cè)模型本身的特性進(jìn)一步放大了風(fēng)險(xiǎn)。AI企業(yè)會(huì)針對(duì)尚未發(fā)布的下一代模型開展網(wǎng)絡(luò)安全測(cè)評(píng),測(cè)試時(shí)往往關(guān)閉限制惡意行為的常規(guī)安全防護(hù),方便研究人員探明模型的真實(shí)能力。這也就意味著,測(cè)試環(huán)境自身的安全性就成為一道至關(guān)重要的防線。
ó héigeartaigh指出:“從測(cè)試角度來(lái)看,這種做法十分合理,但同時(shí)也意味著,一旦模型突破環(huán)境進(jìn)入真實(shí)外網(wǎng),就有可能造成相當(dāng)大的危害。”
英國(guó)人工智能安全研究所(AISI)的測(cè)試中,研究人員直接給智能體開放了網(wǎng)絡(luò)訪問(wèn)權(quán)限,卻沒(méi)有預(yù)料到它們會(huì)實(shí)施未經(jīng)許可的現(xiàn)實(shí)操作,其中就包括通過(guò)社會(huì)工程手段,試圖將漏洞植入開源項(xiàng)目。
最近發(fā)生的事件中,可以看出,智能體都并未收到攻擊隨機(jī)現(xiàn)實(shí)目標(biāo)的指令,它們只是不擇手段地去完成交給它們的任務(wù)。人工智能非營(yíng)利機(jī)構(gòu)CivAI的研究負(fù)責(zé)人Andrew Yoon認(rèn)為,綜合這些事件來(lái)看,標(biāo)志著情況已經(jīng)發(fā)生轉(zhuǎn)變。
Yoon接受TechCrunch采訪時(shí)表示:“過(guò)去我們只需擔(dān)心人類出于各類目的濫用AI模型,比如利用AI實(shí)施詐騙、制作兒童色情內(nèi)容。而如今,AI模型本身就可以成為威脅發(fā)起方。”
更多詳細(xì)內(nèi)容可見文章:https://techcrunch.com/2026/08/09/the-ai-safety-test-is-becoming-a-safety-risk/

微信號(hào)|IEEE電氣電子工程師學(xué)會(huì)
新浪微博|IEEE中國(guó)
Bilibili | IEEE中國(guó)
· IEEE電氣電子工程師學(xué)會(huì) ·
往
期
推
薦
彩色感知機(jī)械手指:歐洲科學(xué)家研發(fā)出分辨率達(dá)100微米的觸覺傳感器
機(jī)器人行業(yè)邁向真實(shí)應(yīng)用,專家關(guān)注2026年關(guān)鍵轉(zhuǎn)變
聚變初創(chuàng)企業(yè)商用反應(yīng)堆設(shè)計(jì)獲重大進(jìn)展
如何減少對(duì)智能手機(jī)的依賴?