时间:2025-07-29 03:58 作者:逸星晨
蚂蚁集团大模型安全解决方案“蚁天鉴”升级,新增智能体安全评测工具
7月28日,世界人工智能大会(WAIC)期间,在由中国信息通信研究院举办的“大模型智塑全球产业新秩序论坛”上,蚂蚁集团大模型安全解决方案“蚁天鉴”宣布升级,新增智能体(AIAgent)安全评测工具,具备Agent对齐、mcp安全扫描、智能体安全扫描及零信任防御等四大核心功能。
世界数字科学院(WDTA)最新发布《AI智能体运行安全测试标准》提出将输入输出、大模型、RAG、记忆和工具五个关键链路与运行环境对应起来,分析智能体全链路风险。
大模型安全解决方案“蚁天鉴”新增智能体安全评测工具
MCP安全扫描功能,则为行业内首个对外发布的MCP安全扫描工具,可自动化识别AI工具集成与数据交换链路中的安全漏洞及风险行为,覆盖工具投毒攻击、间接提示词注入、恶意代码注入等3大类共10项子类风险。
此外,其Agent对齐功能,集成了高效工具调用、敏感双重验证、多通道恶意识别及沙盒环境训练,确保智能体的决策、行为与开发者预设目标、价值观及伦理道德保持一致;通过深度理解智能体服务上下文与风险情境,“蚁天鉴”还可对每一次调用进行内容、链路、行为、权限、组件、来源、身份七层校验,并依据策略引擎动态决策放行、降级或阻断,实现“永不信任,始终验证”的零信任动态防御。
蚂蚁集团机器智能部总经理、安全实验室首席科学家王维强在WAIC论坛演讲
蚂蚁集团机器智能部总经理、安全实验室首席科学家王维强表示:“升级的‘蚁天鉴’基于‘以攻促防’的安全理念,通过构建‘对齐-扫描-防御’技术栈,形成全流程防护体系,从而为智能体提供风险扫描与实时防御能力,我们也将与行业共建,未来逐步开源开放安全工具。”
据了解,2024世界人工智能大会上,“蚁天鉴”2.0发布,形成了包括大模型基础设施测评、大模型X光测评、应用安全测评、AIGC滥用检测、证件伪造检测、围栏防御等在内的完整技术链条,面向行业提供全方位智能化的大模型安全测评和防御解决方案。
1、“中国体育彩票”2025年广东省老年人广场舞联赛广州赛区精彩启航
2、罗马仕电芯供应商安普瑞斯原控股股东宣告解散,罗马仕和安克
3、金山办公发布原生Office智能体WPS灵犀,革新用户、AI和软件交互方式,金山办公软件wps office