9月8日,isc.ai 2025上海大模型安全論壇上暨大模型安全衛士產品發布會在上海外灘ftc舉辦。此次發布的360大模型安全衛士是360基於「安全+ai」雙重優勢推出的戰略級產品,以四大智能體為核心,系統化破解ai安全難題,全面夯實智能化發展基座,標誌著我國在大模型安全防護領域取得了重要進展。
ai驅動智能化浪潮 安全挑戰日益嚴峻
隨著大模型技術迅猛發展、智能體應用加速落地,人工智慧技術正在重塑百行千業,成為推動新一輪科技革命與產業變革的核心動力,引領人類社會邁入智能化時代,實現生產生活方式的全面革新。

ai是一把「雙刃劍」,在帶來機遇的同時,也衍生出了眾多新挑戰。360集團創始人、isc大會主席周鴻禕在致辭中指出,ai發展面臨著惡意利用、內容安全、幻覺問題、提示詞攻擊等風險,大模型既是生產力工具,也可能成為新的攻擊載體和攻擊入口,政府和企業的數據資產、商業機密面臨著前所未有的暴露風險,保障ai安全是一項長期而艱巨的任務,需要各方協同努力。
以模製模 360大模型安全衛士築牢ai安全防線
360數字安全集團副總裁余凱在演講中表示,面對ai安全新挑戰,傳統安全企業在大模型技術領域積澱不足,往往是「盲人摸象」,難以系統把握全局;而多數大模型企業缺乏必要的安全技術積累與攻防實踐經驗,往往難以提出行之有效的解決方案。

360發揮「懂ai更懂安全」的跨領域優勢,基於以模製模理念打造360大模型安全衛士,聚焦解決ai的「可靠、可信、可控、向善」核心問題,以四大智能體系統性解決大模型生命周期中各環節的安全問題。
內容安全智能體:通過垂直領域專業模型訓練,提供智能判定、風險內容檢測及安全回復代答等關鍵能力。通過建立五道內容防線,提供100+風險類目識別能力,確保輸入輸出雙向安全。同時,以測促防,持續對模型回復內容進行評測,識別潛在攻擊風險。
ai agent安全智能體:通過原生安全機制,全面保障ai agent在執行任務過程中的數據安全與許可權控制,有效防範自動規劃與執行中可能出現的行為失控問題,把大模型能力「關在籠子里」。
幻覺抑制智能體:通過搜索增強、知識增強與對齊增強技術,提升大模型推理過程的準確性,有效抑制因內容時效性缺失、數據過時等因素引發的大模型「幻覺」問題,確保生成內容真實可信。
軟體安全智能體:能夠高效識別開源軟體,精準定位ai軟體的安全漏洞。覆蓋從模型訓練到推理的全鏈路安全檢測,支持識別模型服務相關組件、生態鏈漏洞掃描與多語言代碼審計,保障ai軟體供應鏈生命周期的安全性。
此外,360創新性地將大模型安全衛士融入安全運營體系,通過整合安全大模型、安全大腦平台、大模型安全衛士及終端探針工具的核心能力,構建「網數模一體化」安全運營平台,實現安全運營系統性重塑與升級。
實戰成效顯著 360構建ai安全新基建
余凱表示,ai安全是一個門檻極高的技術領域,需要同時具備ai技術積澱、安全實戰經驗、真實場景驗證和海量語料積累。360通過自身大規模ai業務場景驗證產品能力,形成「從實踐中來,到實踐中去」的迭代閉環,同時沉澱了海量安全語料,構建起了難以複製的核心競爭力。目前,360大模型安全衛士已在公司內外多項業務中實現深度應用。
在360自有ai大模型業務實踐中,日均守護1.5萬卡算力集群、3000p+算力及數十條核心ai業務鏈路,為業務穩定運行築牢安全防線。在內容安全方面,通過部署360大模型安全衛士,可將開源大模型安全性提升10%-30%。
在某智慧政務內容安全保障過程中,360大模型安全衛士日均檢測不良內容1000餘條,業務代答900餘條,回復安全率超99%,風險識別準確率達99%以上,守護政務工作安全基線,有力推動政府智能化轉型。
在支撐某監管部門大模型備案監管方面,360大模型安全衛士接入8個備案大模型,完成100+檢查,積累專項評測數據集超100萬條,為監管部門提供了強有力的數據支持與決策依據。
目前,360已深度參與大模型國家標準、大模型技術研發標準、大模型安全框架標準以及國家人工智慧三大核心安全標準的制定,同時,積極牽頭成立行業生態聯盟,促進全球產學研企共建ai安全。據悉,360大模型安全衛士發布後,將為金融、政務、醫療、文旅等重點行業的智能化升級提供堅實安全基座,助力打造具有全球競爭力的人工智慧發展高地,為推動大模型技術的安全發展與創新應用注入強勁動能。
來源:新民晚報 作者:金志剛