『书安』AI安全基座平台,构建可复现、可评估、可进化的全链路AI安全验证体系 | WAIC 2026
来源:上海人工智能实验室| 2026-07-28
7月17日,在WAIC 2026科学前沿论坛上,上海人工智能实验室(上海AI实验室)发布『书安』AI安全基座平台,涵盖“数字孪生平台、智能验证矩阵、数据进化飞轮”三大核心模块,旨在构建可复现、可评估、可进化的全链路AI安全验证体系,助力AI安全能力持续升级,推动“人工智能+”行动高质量落地。
目前,书安平台已在国际物流供应链、金融、进出境等多个关键领域开展试点落地,在厦门国际物流供应链中试基地的应用中,书安通过模拟新型安全隐患验证了核心业务系统应对复杂风险的能力,提升供应链在智能化场景中的安全韧性。
为进一步夯实人工智能基础安全防护底座,上海AI实验室牵头发起“AI安全基础模型联盟”,携手产学研各界伙伴单位共同推动人工智能成为造福全人类的公共产品。
自2024年提出“AI-45°平衡律”以来,上海AI实验室致力于推动AI安全与性能同步演进,当前已逐步建成覆盖顶层理念、核心技术与行业标准的完整支撑体系。
数字孪生平台:让验证环境无限接近真实世界
高保真孪生平台是整套AI安全验证体系的起点,旨在为实体业务搭建一套完全独立的平行数字沙盘,让验证环境无限接近真实世界。依托数字孪生、数据脱敏和安全隔离等技术,『书安』AI安全基座平台将真实系统中的业务流程、资产关系、权限结构和运行环境进行高精度映射,形成动态的验证体系。该孪生体不仅复刻静态配置,更实时模拟业务状态变化与异常响应,确保每一次验证都能反映真实生产环境下的潜在风险与安全盲区。
书安平台颠覆传统安全“靶场”模式,可承载数千级别安全验证智能体同场博弈、迭代进化。书安建成含1500余个业务场景、50万余真实工具的动态仿真环境,可支撑复杂工具联动调用、多轮长程交互等全真业务流程仿真验证;依托自研超图马尔科夫链验证算法,现已完成17套线上真实业务系统的全维度安全测评与有效性核验。
智能验证矩阵:多智能体协同赋能全栈安全
在AI安全验证过程中,『书安』AI安全基座平台首先扮演“体检中心”的角色。它内置了一套由上海AI实验室自主研发的智能扫描引擎,不依赖固定的漏洞库,通过自适应推理来理解系统的业务逻辑,用数字孪生高并发仿真模拟各种极端场景,同时驱动多智能体协同分别检查不同的模块。更关键的是,书安平台引入了类似AlphaZero的自博弈强化学习能力,让智能体具备自主演化能力。目前该智能验证体系已在真实业务环境中落地验证,成功发现多个高危漏洞,充分印证了书安平台未知风险挖掘能力。
随后,书安平台将转入“体测中心”模式,对系统进行全方位的风险应对测试。它构建了一套多维度动态评估体系,结合数据库访问行为、全链路业务上下文及系统运行状态,可自动识别异常,并动态调整和执行测试方案,形成自动化闭环“体测”流程。另外,书安平台搭载了智能体安全守卫模型AgentDoG,采用基于影响函数的高精度数据选择算法,打破大模型安全对齐依赖海量数据的行业瓶颈。仅通过千级优质样本完成监督微调与强化学习训练,AgentDoG即在权威ATBench智能体安全基准测试中超越同期前沿模型,达成小样本、低成本、高增益的智能安全效果。
整套验证过程,书安平台始终运行着一套智能裁判系统,实时记录验证全过程及最终效果,安全风险影响等数据,自动化研判打分并对结果公正裁决,最终输出标准化、可量化、可追溯的安全评估报告,解决传统验证结果模糊、无法量化、难以复盘的短板。
在此基础上,上海AI实验室打造了智能体全栈安全工具箱墨铠,整合14大类、150余个专业安全工具,支持用户按需组合、灵活部署,将安全验证、漏洞挖掘、智能防御等核心能力,以“安全即服务”模式对外开放,为关键行业与安全生态提供常态化、可迭代、可落地的AI全栈安全支撑。
数据进化飞轮:助力安全能力持续进化
数据是『书安』AI安全基座平台实现持续自进化的核心驱动力。区别于传统静态、一次性的安全验证,书安平台依托动态持续的智能体,实现验证数据的自动沉淀与智能治理。每轮验证结束后,系统自动归集风险证据、防御处置结果、智能体运行轨迹等全维度对抗数据,通过高价值轨迹筛选算法提炼有效学习信号,辅以长尾样本合成技术补齐低频高危风险场景,同时持续汇聚安全验证轨迹、漏洞记录、防御加固数据及行业风险案例,统一规整为高质量、可分级、可授权的标准化AI安全数据资源池,为模型训练、智能体迭代、安全评测和风险预警等各类场景提供真实、科学的数据支撑。
基于海量迭代数据的沉淀,书安平台构建起完整的自进化闭环:新生数据持续回流至基础模型与验证智能体,反向驱动模型能力、防御策略和智能验证体系的动态优化,形成“基模-验证-数据-基模”的正向循环,彻底打破传统安全规则固化、能力停滞的短板,实现从单次验证向常态化、自主进化的模式跨越。
目前,『书安』AI安全基座平台已在多个产业关键场景开展应用验证。在国际物流供应链领域,平台通过模拟新型安全隐患,助力厦门国际物流供应链中试基地验证核心业务系统应对复杂风险的能力,提升供应链在智能化场景中的安全韧性;在金融领域,平台支撑银联金融支付中试基地的金融支付垂域大模型PaySage1.0-Turbo、商户入网审核智能体、数据分类分级智能体、用户合作经营智能体等多类业务场景开展安全验证,保障模型与智能体应用安全可靠运行;在进出境领域,平台帮助上海海关将安全多智能体协同能力嵌入单证审核、风险防控、口岸查验等关键环节,实现监管更加精准严密、通关更加便利高效,同时确保系统安全可控,保障业务稳定运行。
未来,『书安』AI安全基座平台将持续面向国家、产业与社会治理等关键需求,开展重点领域应用验证,推动Make AI Safe与Make Safe AI双向赋能,促进AI安全向可验证、可复盘、可进化的新范式演进。上海AI实验室也将继续深化“AI安全基础模型联盟”建设,依托全国网络安全标准化技术委员会人工智能安全标准工作组(WG9),持续完善人工智能安全标准体系,为人工智能产业行稳致远提供坚实安全保障。


