當(dāng)?shù)貢r(shí)間5月5日,美國商務(wù)部下屬的人工智能標(biāo)準(zhǔn)與創(chuàng)新中心(CAISI)宣布,已與谷歌DeepMind、微軟以及埃隆·馬斯克旗下的xAI達(dá)成協(xié)議,這三家科技巨頭將在新一代人工智能模型正式公開發(fā)布前,提前向美國政府開放模型權(quán)限,以便開展國家安全風(fēng)險(xiǎn)審查。
根據(jù)CAISI發(fā)布的聲明,新協(xié)議允許該中心在人工智能模型投入應(yīng)用前開展評(píng)估,并通過專項(xiàng)研究研判模型能力及潛在安全風(fēng)險(xiǎn)。協(xié)議核心條款要求實(shí)驗(yàn)室在模型公開發(fā)布前,向CAISI開放完整版本,部分測(cè)試對(duì)象甚至是尚未命名的內(nèi)部迭代版本。

CAISI主任克里斯·福爾在聲明中明確表示:“獨(dú)立且嚴(yán)謹(jǐn)?shù)臏y(cè)量科學(xué)對(duì)于理解前沿人工智能及其國家安全影響至關(guān)重要。”他進(jìn)一步指出,“這些擴(kuò)大的行業(yè)合作幫助我們?cè)陉P(guān)鍵時(shí)刻擴(kuò)大公共利益方面的工作。”
值得注意的是,此次合作舉措是在2024年拜登政府與OpenAI、Anthropic達(dá)成相關(guān)協(xié)議的基礎(chǔ)上進(jìn)一步擴(kuò)展而來。加上此次新簽約的三家公司,美國五大主流AI實(shí)驗(yàn)室——OpenAI、Anthropic、谷歌DeepMind、微軟和xAI——已全部納入同一套預(yù)發(fā)布審查框架。
作為美國政府人工智能模型測(cè)試的核心機(jī)構(gòu),CAISI透露目前已完成40余次模型評(píng)估,其中涵蓋多款尚未向公眾開放的尖端AI模型。測(cè)試場(chǎng)景不僅包括常規(guī)版本,也包括實(shí)驗(yàn)室主動(dòng)提供的“減配安全護(hù)欄”版本——目的是探測(cè)模型在約束松動(dòng)時(shí)的行為邊界。
該機(jī)構(gòu)表示,人工智能企業(yè)開發(fā)者常會(huì)提交移除安全防護(hù)機(jī)制的模型版本,供該中心深入排查國家安全層面的潛在風(fēng)險(xiǎn)。部分測(cè)試甚至轉(zhuǎn)入機(jī)密環(huán)境進(jìn)行,以確保評(píng)估的全面性和安全性。
微軟方面表示,公司將與美國政府科學(xué)家合作,以更深入的測(cè)試方式觀察AI系統(tǒng)在極端情境下是否出現(xiàn)預(yù)期外行為,雙方也將共同建立測(cè)試數(shù)據(jù)集與驗(yàn)證流程,強(qiáng)化模型安全性。微軟先前也曾與英國AI安全研究機(jī)構(gòu)簽署類似合作協(xié)議。
據(jù)CNBC報(bào)道,除CAISI周二的聲明外,白宮一直在考慮成立一個(gè)新的AI工作組,該工作組將探索潛在的監(jiān)督程序,包括在模型向公眾發(fā)布之前對(duì)其進(jìn)行審查的計(jì)劃。一位知情人士透露,該工作組將匯聚多位科技公司高管和政府官員,由于細(xì)節(jié)屬于機(jī)密,該人士要求匿名。該工作組可能會(huì)通過行政命令成立。
不過,白宮表示,有關(guān)可能發(fā)布的行政命令的討論純屬猜測(cè),任何政策聲明都將直接來自唐納德·特朗普總統(tǒng)。這一安排也兌現(xiàn)了特朗普政府于2025年7月提出的與科技企業(yè)合作審查AI“國家安全風(fēng)險(xiǎn)”的政策承諾。
近期,美國政府對(duì)高階AI模型可能帶來的安全威脅明顯升溫,尤其Anthropic日前推出新一代AI模型“Mythos”后,其大幅提升黑客攻擊與自動(dòng)化滲透能力,引發(fā)美國政府與企業(yè)界高度關(guān)注。
近幾周,包括Anthropic公司Mythos在內(nèi)的先進(jìn)人工智能系統(tǒng)研發(fā)成果在全球引發(fā)熱議,美國政府官員及美國企業(yè)界普遍擔(dān)憂,這類模型會(huì)極大助長黑客的攻擊能力。據(jù)Anthropic公司稱,Mythos擅長識(shí)別軟件中的弱點(diǎn)和安全漏洞,因此該公司決定將其推廣范圍限制在部分公司,作為一項(xiàng)名為“Glasswing項(xiàng)目”的新網(wǎng)絡(luò)安全計(jì)劃的一部分。
Anthropic公司首席執(zhí)行官達(dá)里奧·阿莫迪在Mythos項(xiàng)目宣布啟動(dòng)幾天后,便在白宮與特朗普政府高級(jí)官員會(huì)面,討論了該項(xiàng)目。
值得一提的是,此前美國國防部已將Anthropic公司列為供應(yīng)鏈風(fēng)險(xiǎn)企業(yè)。美國國防部上周宣布,已與七家人工智能企業(yè)達(dá)成合作協(xié)議,將這些企業(yè)的先進(jìn)AI技術(shù)部署至國防部涉密網(wǎng)絡(luò),意在擴(kuò)充服務(wù)軍方的人工智能服務(wù)商隊(duì)伍。然而,此次國防部合作名單并未納入Anthropic公司。該公司正因軍方對(duì)其AI工具的使用權(quán)限與安全約束問題,和美國國防部陷入糾紛。
CAISI表示,這些協(xié)議支持信息共享,推動(dòng)自愿產(chǎn)品改進(jìn),并確保政府對(duì)人工智能能力和國際人工智能競(jìng)爭(zhēng)狀況的清晰理解。為了全面評(píng)估國家安全相關(guān)能力和風(fēng)險(xiǎn),開發(fā)者經(jīng)常向CAISI提供減少或取消保障措施的模型。
行業(yè)觀察人士指出,這一系列協(xié)議雖然被表述為“自愿合作”,但實(shí)際上已經(jīng)形成了事實(shí)上的強(qiáng)制性預(yù)審查機(jī)制。