蚂蚁集团发布两款开源安全模型守护大模型与智能体
时间:2026-07-19 | 作者:318050 | 阅读:0
7月13日,蚂蚁AI安全实验室正式开源了智能体安全护栏SingGuard-NSFA。
同时,实验室披露了多模态安全护栏SingGuard的详细情况。
这两款模型分别瞄准了当前AI最前沿的两个场景:
- **“自主执行的智能体”**
- **“多模态交互的大模型”**
这一步棋,意味着蚂蚁在AI安全领域的体系化布局又往前推进了一大截。
眼下,AI正从单纯的内容生成走向真正的自主执行。这听起来很酷,但安全问题的复杂度也跟着翻了几倍。
不再只是模型输出的好坏,而是蔓延到了行为控制、权限管理、系统治理这些更深层的领域。
智能体开始自主调用工具、运行代码、规划多步任务。
模型也逐渐能同时理解图像、文本等多种信息。
能力边界在拓宽,安全新挑战也在同步冒头。
过去一年,提示词注入、权限滥用、恶意代码执行、数据泄露……这些安全事件就没断过。
例如:
- Amazon Q被提示词投毒
- Microsoft Copilot的数据泄露
- 开源智能体OpenClaw暴露出提示词注入风险
这些案例都在反复提醒一件事:**智能体的自主性越强,安全风险的放大效应就越明显。**
2025年12月,OWASP发布了《智能体应用安全十大风险》,系统梳理了智能体特有的安全威胁。
2026年5月,国家网信办、国家发展改革委、工信部三部门联合印发了《智能体规范应用与创新发展实施意见》,从国家层面对智能体安全治理提出了明确要求。
在这样的背景下,蚂蚁AI安全实验室这次开源的模型,目标很清晰——为大模型和智能体提供更完善的底层安全能力。
在覆盖文本查询、文本回复、图像、多模态和多语言的6大类评测中,SingGuard在35个数据集及评测切分上的平均F1均为最高。
对比对象包括Llama Guard3、谷歌ShieldGemma、GPT-5.1、Gemini3-Pro等在业内极具代表性的主流护栏,SingGuard均实现了全面领先。
中国信通院人工智能研究所安全治理部副主任呼娜英表示:
随着大模型从内容生成迈向自主执行,AI安全正从内容审核延伸至行为管控和系统治理,这已经成为智能体规模化应用的重要基础能力。
事实上,蚂蚁AI安全实验室已经针对开源智能体框架OpenClaw开展了专项安全审计。
今年4月,实验室还联合清华大学开源了智能体安全防御插件ClawAegis,为自主智能体提供覆盖全生命周期的安全防护。
这次SingGuard-NSFA与SingGuard多模态安全护栏相继开源,是蚂蚁集团持续推进AI安全技术研发和开放生态建设的重要一步。
这些安全技术的研发与开源,背后是蚂蚁集团二十余年的安全技术积累。
依托在支付安全、数据安全、隐私保护和风险治理等领域的长期实践,蚂蚁持续完善AI安全体系。
相关能力已经落地在蚂蚁阿福、AI版支付宝“阿宝”、支付宝“AI付”等业务场景中。
与此同时,蚂蚁集团还在持续参与AI安全标准和治理体系建设:
- 参与了IIFAA《终端智能体可信互联技术规范》的制定
- 牵头了ITU国际标准《终端智能体可信互联技术规范》的立项
- 发布了智能体安全可信互连协议ASL
从技术创新到产业实践,这条路正在越走越宽。
SingGuard-NSFA:为智能体操作装上“实时刹车”
智能体从“回答问题”进化到“自主办事”。 AI开始调用工具、执行代码、编排多步任务。 安全风险的重心也从内容层面转移到了行为层面。 提示词注入、敏感信息窃取、恶意代码执行、资源耗尽、权限滥用……这些问题,传统的内容审核体系根本覆盖不过来。 针对这个痛点,蚂蚁AI安全实验室拿出了SingGuard-NSFA。 它的核心思路是在智能体执行动作之前,完成实时的安全检测。 从请求拦截和响应兜底两端,构建起行为安全防护体系。 具体怎么做? SingGuard-NSFA基于CIA原则(保密性、完整性、可用性),结合OWASP等国际安全指南,把智能体的风险细分成了7大类、28个中类和185个具体场景。 同时,建立了一个覆盖133种语言、近10万条样本的智能体安全评测体系。 技术实现上,它兼顾了安全审计和实时防护两种需求,提供了两种工作模式: - **安全审计模式**:逐条生成详细的风险分析报告,方便事后审查和合规记录。 - **实时防护模式**:在50毫秒左右完成单次风险判定,适合线上高并发场景下的实时拦截。 模型提供了0.8B、2B、4B、9B四种规模,可以适配不同的部署需求。
在覆盖文本查询、文本回复、图像、多模态和多语言的6大类评测中,SingGuard在35个数据集及评测切分上的平均F1均为最高。
对比对象包括Llama Guard3、谷歌ShieldGemma、GPT-5.1、Gemini3-Pro等在业内极具代表性的主流护栏,SingGuard均实现了全面领先。
中国信通院人工智能研究所安全治理部副主任呼娜英表示:
随着大模型从内容生成迈向自主执行,AI安全正从内容审核延伸至行为管控和系统治理,这已经成为智能体规模化应用的重要基础能力。
事实上,蚂蚁AI安全实验室已经针对开源智能体框架OpenClaw开展了专项安全审计。
今年4月,实验室还联合清华大学开源了智能体安全防御插件ClawAegis,为自主智能体提供覆盖全生命周期的安全防护。
这次SingGuard-NSFA与SingGuard多模态安全护栏相继开源,是蚂蚁集团持续推进AI安全技术研发和开放生态建设的重要一步。
这些安全技术的研发与开源,背后是蚂蚁集团二十余年的安全技术积累。
依托在支付安全、数据安全、隐私保护和风险治理等领域的长期实践,蚂蚁持续完善AI安全体系。
相关能力已经落地在蚂蚁阿福、AI版支付宝“阿宝”、支付宝“AI付”等业务场景中。
与此同时,蚂蚁集团还在持续参与AI安全标准和治理体系建设:
- 参与了IIFAA《终端智能体可信互联技术规范》的制定
- 牵头了ITU国际标准《终端智能体可信互联技术规范》的立项
- 发布了智能体安全可信互连协议ASL
从技术创新到产业实践,这条路正在越走越宽。
来源:整理自互联网
免责声明:文中图文均来自网络,如有侵权请联系删除,心愿游戏发布此文仅为传递信息,不代表心愿游戏认同其观点或证实其描述。
相关文章
更多-
- 蚂蚁集团发布百灵原生混合推理模型Ling-3.0-flash 124B参数对标旗舰
- 时间:2026-07-25
-
- 支付宝秘密内测“AI版”:代号“宝计划”,首推AI助手“阿宝”
- 时间:2026-07-24
-
- 蚂蚁集团副总裁陈亮:智能体越强,信任风险越不可忽视
- 时间:2026-07-20
-
- 蚂蚁灵波开源LingBot-Video 全球首个具身智能MoE视频基模落地
- 时间:2026-07-19
-
- 马云携阿里高管下田插秧 全员挽裤光脚劳作 田间笑容灿烂
- 时间:2026-06-22
-
- 智能眼镜能力套件落地!蚂蚁GPASS助力开发者高效搭建文旅AI应用
- 时间:2026-04-30
-
- 一台顶所有!银联支付宝将推出全能支付新设备
- 时间:2026-04-16
-
- 蚂蚁集团启动2026年春招:超70%岗位聚焦AI核心领域
- 时间:2026-03-11
精选合集
更多大家都在玩
热门话题
大家都在看
更多-
- iOS 13.5.1电池续航差是电池耗电问题吗
- 时间:2026-07-25
-
- 苹果教育优惠开启 附购买攻略
- 时间:2026-07-25
-
- 苹果iOS 14 beta 2 测试版主要更新内容:除细节变化外修复多项Bug
- 时间:2026-07-25
-
- iOS 14 beta 2 是否解决内存占用过多问题?
- 时间:2026-07-25
-
- 受欢迎的奥特曼游戏有哪些
- 时间:2026-07-25
-
- iOS 14信息应用5大更新变化
- 时间:2026-07-25
-
- iOS 14正式版上线时间公布 官方全新介绍
- 时间:2026-07-25
-
- 最新苹果iOS 14 Beta 2版本更新内容全解析与升级教程
- 时间:2026-07-25