9月15日,2026年國家網(wǎng)絡安全宣傳周人工智能安全治理論壇在山東濟南舉辦。騰訊集團副總裁、總編輯朱殿君出席論壇,分享了騰訊從模型安全、智能體安全到安全賦能的AI安全治理實踐和思考。
以下為發(fā)言全文:

過去兩年,我們看到人工智能的各項能力在飛速狂奔,新型網(wǎng)絡攻擊形式從大模型自身安全擴展到感知記憶和決策執(zhí)行等場景,傳統(tǒng)網(wǎng)絡安全的邊界已被打破,AI推理鏈路成為新的安全邊界。面對當前復雜的攻防博弈形勢,騰訊持續(xù)加大安全資源投入,提升新形勢下的網(wǎng)絡安全防護能力,積極參與AI安全眾測、落實AI標識管理,協(xié)同配合新型安全風險治理研究,持續(xù)推動AI技術創(chuàng)新發(fā)展。構(gòu)建了覆蓋模型、數(shù)據(jù)、權(quán)限與應用的多維內(nèi)生安全體系,為用戶提供安全、可靠的人工智能服務。接下來我將從模型安全、智能體安全和安全賦能三個方面,介紹騰訊公司的實踐和做法。
安全可靠的大模型底座 讓AI更智能、更可靠
大模型既是AI能力的源頭,也是安全的基礎防線。我們的混元大模型已深度融入WorkBuddy、元寶等核心業(yè)務,并在真實場景中持續(xù)迭代,用量快速增長。近日,我們發(fā)布并開源的新一代大語言模型HY 4 preview,在代碼與復雜工程處理能力、智能體長鏈任務處理能力上顯著提升,已經(jīng)在編程、辦公、科研等場景中展現(xiàn)出卓越效果。我們深知,模型能力越強,安全責任越重,模型安全是發(fā)展人工智能的基礎,我們圍繞訓練、推理、應用三個階段,構(gòu)建了一整套全生命周期、分層治理的安全架構(gòu)。
訓練階段通過建立安全隔離區(qū),將計算資源有效隔離,實現(xiàn)訓練、推理、清洗各環(huán)節(jié)數(shù)據(jù)互不干擾。專用計算資源與通用云資源相互隔離、獨立部署,有效避免訓練數(shù)據(jù)、模型文件泄露。
推理階段我們基于可信硬件構(gòu)建的可信執(zhí)行環(huán)境,確保大模型流暢服務的同時,有效保護用戶隱私,實現(xiàn)數(shù)據(jù)安全隔離。通過主機安全防護、運維操作審計等多種技術手段,疊加紅藍對抗演練和外部安全眾測,持續(xù)驗證防護的有效性,確保模型在推理過程中信息不被竊取、篡改和破壞。
應用階段我們以自研的大模型應用防火墻為底座,對輸入輸出的數(shù)據(jù)進行檢查,構(gòu)建覆蓋提示詞注入、算力濫用、接口越權(quán)、流量攻擊等威脅的多維度防護。內(nèi)容上,我們自主研發(fā)了系列安全風控平臺,從違法違規(guī)、虛假謠言、科技倫理等多個維度過濾內(nèi)容風險。
豐富安全的智能應用 讓用戶使用更簡單
騰訊已構(gòu)建覆蓋從個人到企業(yè),從端側(cè)到云端的豐富智能體產(chǎn)品矩陣。面向企業(yè)用戶,我們推出WorkBuddy辦公智能體、CodeBuddy編程助手以及馬維斯(Marvis)等不同辦公場景的智能體,深度融入客戶的生產(chǎn)、研發(fā)流程,助力千行百業(yè)提質(zhì)增效。近日,WorkBuddy開放平臺正式上線,引入超100家生態(tài)合作伙伴,覆蓋金融、法律、醫(yī)療、教育等20多個領域,讓AI全面走向“生態(tài)共建”。面向個人用戶,我們以元寶和微信小微等為抓手, 讓AI能力觸達億萬用戶的日常溝通與協(xié)作。辦公側(cè)持續(xù)做深做透,個人側(cè)不斷做廣做活,兩方技術同源、雙向互補,構(gòu)成騰訊AI布局最堅實的支撐。
基于自身的安全基因和技術積累,騰訊系統(tǒng)性地打造了自主可控的三層縱深防御體系——從技術防御、管理管控到合規(guī)審計,全方位護航網(wǎng)絡安全與業(yè)務合規(guī)。
第一道技術防線,為智能體構(gòu)筑“安全沙箱”。它劃定清晰的操作邊界——哪些系統(tǒng)資源可以訪問、哪些敏感路徑絕對禁觸,對異常操作實時攔截,從源頭阻斷各類高風險行為。
第二道管理防線,精細化管控工具的調(diào)用權(quán)限。我們采用逐項授權(quán)機制,執(zhí)行敏感操作前必須經(jīng)過用戶確認;所有操作全程留痕、可追溯,有效杜絕密鑰明文存儲、權(quán)限失控等隱患。同時,數(shù)據(jù)不經(jīng)第三方中轉(zhuǎn),確保隱私安全閉環(huán)可控。
第三道合規(guī)防線,聚焦第三方技能的供應鏈安全。所有第三方技能上線前,都必須與安全團隊聯(lián)動風險驗證,嚴格踐行“預檢—分析—跟蹤—處置—審計”五步閉環(huán),做到環(huán)環(huán)可追溯、步步有留痕。對于安全等級要求高的客戶,我們還提供了物理級隔離的專享環(huán)境,真正做到代碼與數(shù)據(jù)“零泄露”。
全面完善的安全能力體系 讓AI產(chǎn)業(yè)更安全、更繁榮
面對AI時代出現(xiàn)的各類安全風險和痛點,騰訊為企業(yè)和個人提供了覆蓋全鏈路的AI安全工具箱,構(gòu)建了端云協(xié)同、開放共享的安全產(chǎn)品體系。
我們認為智能體安全需要做到“可視、可控、可信、可溯”,可視——摸清資產(chǎn)底數(shù),可控——強化行為權(quán)限,可信——筑牢供應鏈安全,可溯——全維度行為審計。圍繞這四項原則,我們構(gòu)建了以iOA零信任安全管理系統(tǒng)、AI Agent安全中心、大模型應用防火墻(WAF)、AI Agent安全網(wǎng)關和NDR流量安全檢測為核心的安全組件體系,系統(tǒng)化解決智能體在推理防護、運行管控等環(huán)節(jié)面臨的安全風險,為用戶提供全鏈路、縱深防御的安全保障。近期,我們還全新推出安全產(chǎn)品CodeBuddy Security,已在多個知名開源項目中挖掘出0day漏洞,為企業(yè)提供代碼級、深層次安全保障。
各位嘉賓,置身AI浪潮之中,騰訊始終堅持以安全促創(chuàng)新、以治理贏信任、以開放謀共贏。通過體系化的安全防護、嚴格的數(shù)據(jù)保護和負責任的AI治理,持續(xù)贏得用戶信任,與各界共建安全的行業(yè)生態(tài)。
讓我們以科技向善的初心,守護AI變革行穩(wěn)致遠,為建設網(wǎng)絡強國、數(shù)字中國貢獻騰訊力量!
謝謝大家!
(注:此文屬于央廣網(wǎng)登載的商業(yè)信息,文章內(nèi)容不代表本網(wǎng)觀點,僅供參考。)
長按二維碼關注精彩內(nèi)容





