
開源軟體是全球經濟的重要支柱。透過讓專家社群得以存取與檢視相關技術,開源軟體可為雲端運算、金融服務、製造、電信、政府與網際網路服務提供堅實的基礎。資安是開源軟體的三大受益領域之一。開放安全人工智慧 (AI) 聯盟 (Open Secure AI Alliance) 承襲 Linux Foundation 的 Akrites 計畫領導成果與 OpenSSF 社群工作,將運用開放技術修復並揭露漏洞。
Open Secure AI Alliance 致力於加強資安
正如開源技術為軟體建立共享基礎,美國及其合作夥伴如今在 AI 安全面臨一項選擇:用於保護基礎設施的防禦能力,究竟該置於少數不透明的系統之中,還是要建立在任何防禦人員都能研究、調整與部署的開放模型、執行框架與工具之上。
全球同時需要封閉與開放的模型。在資安領域,開放模型與開放的 harness 至關重要,因為它們能普及防禦能力、提高防禦人員的透明度、在保護資料的同時支援網路防禦,並透過可客製化、在地化的控制機制,與前沿的封閉模型相輔相成。開源技術可建立大規模分散式、社群驅動且自主掌控的防禦體系,且不存在單點故障。
如同任何強大的技術,開放模型也可能遭到濫用,包括企圖削弱防護機制,或將其能力轉用於網路攻擊。然而,這些風險並非開放系統所獨有,而是所有部署先進 AI 的環境都必須加以管理。
近期發生的 Hugging Face 資安事件帶來明確提醒:資安防禦人員需要開放且前沿的代理型系統進行自我防禦。當封閉 AI 工具無法區分攻擊者與防禦人員,因而阻擋必要的鑑識分析時,Hugging Face 便在其自有基礎設施上執行開放權重 GLM 5.2 模型,分析超過 17,000 項操作並遏止入侵。
這起事件揭示一個現實真相:當防禦人員無法在自有基礎設施上檢視、調整與執行先進 AI 時,在分秒必爭的關鍵時刻,其應變能力會受到限制。企業與國家需要開放且前沿的防禦工具與技術,讓關鍵產業能在多供應商生態系中建構安全系統,並避免單點故障。
這正是開放安全 AI 聯盟的使命:確保各地防禦人員都能擁有值得信賴且可自主掌控的開放前沿工具。
來自雲端運算、資安、企業軟體、開源基金會與 AI 研究領域的領導者,包括 NVIDIA、Adobe、Cadence、Capital One、思科、Cloudera、Cloudflare、Cognition、CrowdStrike、Databricks、戴爾科技集團、DoorDash、Elastic、慧與科技、Hugging Face、IBM、LangChain、Linux Foundation、微軟、NAVER、NetApp、Nous Research、OpenClaw、Palantir、Palo Alto Networks、Red Hat、Reflection AI、Salesforce、SAP、SK Telecom、ServiceNow、西門子、Snowflake、SpaceXAI、新思科技、Thinking Machines Lab 與 TrendAI,皆為開放安全 AI 聯盟的首批合作夥伴。這項行動旨在開發並分享開放技術、方法與工具,以在 AI 時代保障軟體與代理的安全。
有些觀點主張,開放模型本質上較不安全,因為它們可能遭用於網路攻擊,或被修改以移除防護機制。這些風險確實存在,但在封閉系統中同樣不會消失。單純不公開模型權重,也無法阻止意圖堅決的攻擊者尋求或利用強大的 AI。
正確的應對之道,並非拒絕讓防禦人員使用具備強大能力的開放系統,而是結合開放性與完善的防護措施、明確禁止惡意濫用的規範、嚴謹評估及迅速的補救措施。在資安領域,更安全的途徑是讓更多防禦人員具備測試、驗證並強化社會所倚賴系統的能力。
防禦人員需要前沿封閉模型與前沿開放模型協同運作,才能依據任務選擇合適的系統,並確保在安全需求所及之處,均能具備透明度、適應性及主權控制。
開放研究強化資安與 AI 安全
AI 代理不只是一個語言模型,而是由模型、harness 與防護機制所構成的複雜系統。
真正的 AI 安全與保障,仰賴完整的代理堆疊,包括身分、權限、harness、防護機制、記錄與評估,而不只取決於模型權重是開放或封閉。開放式的 harness 與工具,能讓許多防禦人員更容易檢視、測試與改善這些控制機制。
NVIDIA 正為開放安全 AI 聯盟貢獻開放模型、模型權重、資料,以及全新的代理 harness 研究,以加速開發全新資安工具與技術。
全新的開源專案 NVIDIA Labs Object-Oriented Agent (NOOA) 現已於 GitHub 上線,讓代理 harness 更容易運用先進 AI 安全功能。NOOA 研究框架使 harness 與模型更緊密整合,進而更輕鬆地對代理行為進行測試、追蹤、稽核與管控。
在整個聯盟中,貢獻者們正共同為代理打造開放的防禦堆疊,涵蓋身分識別與隔離、安全模型格式、多模型掃描,以及安全的程式設計工作流程。
慧與科技為 SPIFFE / SPIRE 做出貢獻。SPIFFE / SPIRE 建立零信任身分識別框架的標準與方法,可透過加密技術驗證 AI 代理與服務,確保只有獲授權的工作負載能進行通訊並存取企業資源。
Hugging Face 已將 Safetensors 提供給 PyTorch Foundation。Safetensors 是用於儲存 AI 模型權重的安全格式,可提供透明度,並保證不會進行遠端程式碼執行。
IBM 與 Red Hat 的 Lightwell 透過數位簽章修補程式,將安全防護擴展至整個開源供應鏈。
微軟的 MDASH 多模型代理型掃描 harness,可協調專用的 AI 代理來發現、辯證並驗證可被利用的漏洞。
SpaceXAI 已將基於終端機的 AI 程式設計代理 Grok Build 開源,以促進信任、透明度與全新功能,並計畫開放 Grok 系列模型的權重,以支援開發者與研究社群。
呼籲政策制定者與監管機構採取行動
在政策制定者與監管機構致力於解決 AI 安全議題時,至關重要的是必須在 AI 與資安政策中,將開放模型、harness 與安全工具視為防禦資產,而非風險負擔。若一概限制開放前沿 AI 系統,將削弱防禦能力,並可能導致權力、依賴與脆弱性集中於少數封閉式供應商。
企業與政府應投資 AI 防禦所需的共享開放基礎設施,包括資料集、評估框架、攻擊模擬器與紅隊演練工具,就如同過去的世代投資開源軟體那樣。
我們應共同打造的未來
AI 代理的時代,可以是一個兼具韌性與共享安全的時代。只要做出正確選擇,開放且安全的 AI 系統就能為防禦人員提供所需工具、強化競爭、延續科技領導地位,並確保這項卓越技術的安全與保障,是以開放方式為所有人共同建構。
這樣的未來,不能僅憑保密本身就等同安全的假設來獲得保障,而必須仰賴經得起檢視、能持續改善,且足以凝聚整個防禦社群力量的開放系統。
這樣的未來值得共同打造。開放安全 AI 聯盟邀請各國政府、業界與研究人員加入,一同守護 AI 時代。
了解更多資訊,或表達加入「開放安全 AI 聯盟」的意願。

