MosaicLeaks:研究 Agent 能否保守秘密
ServiceNow 在 HuggingFace 发布「MosaicLeaks」安全评估框架,针对 Agent 系统在处理敏感信息时的泄露风险进行基准测试。该工作属于前沿 Lab 对 Agent 安全性的系统化探索,涵盖提示词注入、记忆外溢等常见攻击向量。对于在企业/研究场景部署 Agent 的团队,这类评估方法论提供了可参考的防护思路。
ServiceNow 在 HuggingFace 发布「MosaicLeaks」安全评估框架,针对 Agent 系统在处理敏感信息时的泄露风险进行基准测试。该工作属于前沿 Lab 对 Agent 安全性的系统化探索,涵盖提示词注入、记忆外溢等常见攻击向量。对于在企业/研究场景部署 Agent 的团队,这类评估方法论提供了可参考的防护思路。