上海團隊“另一條道路”拿下AI安全工具全球第三
訂閱已訂閱已收藏
收藏“另一條道路”拿下AI安全工具全球第三
開源架構代替閉源堆疊,上海團隊DoGNAVY智能體1507項測試通過率達90.8%
昨日,加州大學伯克利分校設立的AI網絡安全權威榜單CyberGym公布了最新排名,來自上海的DoGNAVY智能體排名全球第三,僅次於微軟和谷歌開發的智能體,領先於OpenAI、Anthropic等國際頂尖企業。
過去,一個高危漏洞從被發現到形成可用攻擊能力,往往需要專業人員投入數周甚至數月,如今這一過程僅需數小時。今年7月,OpenAI的一款大模型在內部測試時失控,它自主發現漏洞、規劃路徑,成功入侵了人工智能開源平台Hugging Face。當攻擊的門檻和成本一路走低,防御就不能繼續隻依賴專家,而是要靠智能體助力。
DoGNAVY由國內頂尖人工智能研究機構與上海企業達酷諾威組成的上海科研團隊研發,它在1507道題中通過率達到90.8%,隻比第二名少答對了一道題。CyberGym並不是知識問答考試,其測試方式像是要求一個程序員處理完全陌生的軟件項目——面對幾千個文件、上百萬行代碼,隻告訴他“這裡有個安全漏洞”,要求他自行發現並當場演示。
面對1507道無法提前准備的題目,微軟和谷歌採取“拼裝作戰”,調度多款能力各有側重的閉源模型協同參與處理。上海科研團隊選擇了另一條道路,以智譜在6月開源的GLM-5.2為基礎模型,開發出一套完整的技術體系。達酷諾威將長期積累的一線經驗轉化為專業安全能力﹔國內頂尖人工智能研究機構則通過名為AgentDoG的安全架構,提供核心的智能體運行與診斷能力。
上海科研團隊介紹,現有的安全工具只能給出“安全/不安全”的簡單判斷,無法告知風險根源。AgentDoG不僅能精准判斷智能體行為的安全性,還能診斷風險來源、追溯失效模式、解釋決策動因。訓練人工智能安全模型通常很燒錢,需要海量數據和巨大算力。為節省成本,AgentDoG開發團隊換了一種思路:先用一套智能篩選機制,從海量數據中隻挑出最關鍵的千余樣本,再通過數據淨化技術去掉“雜音”。最終,一個參數量僅為通用大模型千分之一的小模型,在復雜風險識別任務中達到了78.4%的准確率,與頂級大模型不相上下。
上海科研團隊還為DoGNAVY構建了嚴格的“沙箱”環境,能保証大模型在隔離環境中執行指定任務,避免重蹈OpenAI大模型失控做“黑客”的覆轍。
DoGNAVY智能體排名全球第三的成績表明,以國內機構的AI研究能力、開源大模型與一線真實攻防經驗,已能形成有效協作,處理最難、最大規模的專業安全任務。未來,這種頂尖安全攻防能力將在全國推廣應用,讓越來越多的國內機構擁有AI安全力量。
(來源:解放日報 記者 俞陶然)
分享讓更多人看到
- 評論
- 關注
































第一時間為您推送權威資訊
報道全球 傳播中國
關注人民網,傳播正能量