Reddit 等平台可被轻易操纵 AI 搜索结果,仅需 13 词
研究发现,在 Reddit、Wikipedia、Quora、Facebook 等用户生成内容(UGC)平台上植入仅 13 个词的恶意文本,就能稳定地诱导 AI Agent 输出垃圾或诈骗内容。这意味着当下 AI 搜索产品对训练数据源的质量把控严重不足,被操纵门槛之低超乎想象。OpenAI、Google、Anthropic 等主流 AI 搜索功能均从网页爬虫获取内容,若无更严格的数据净化机制,类似攻击可能大规模滥用。
研究发现,在 Reddit、Wikipedia、Quora、Facebook 等用户生成内容(UGC)平台上植入仅 13 个词的恶意文本,就能稳定地诱导 AI Agent 输出垃圾或诈骗内容。这意味着当下 AI 搜索产品对训练数据源的质量把控严重不足,被操纵门槛之低超乎想象。OpenAI、Google、Anthropic 等主流 AI 搜索功能均从网页爬虫获取内容,若无更严格的数据净化机制,类似攻击可能大规模滥用。