AI搜索被垃圾农场污染
推荐指数 51.0 NO. 013 · 2026.09.03
发布2026/09/02Score245Comments113
为什么值得看
研究发现Perplexity等AI搜索引擎的引用大量来自专为模型优化的低质网站,三个站点生成了21.5万篇"最佳软件"页面,59.8%的引用域名排名在10万之外。这意味着用户看到的"AI推荐"可能是SEO农场定向投喂给模型的内容,而非真实用户评价。
编辑判断
这暴露了一个被忽视的反馈循环:SEO农场从模型流量获利→更有动力生产"模型可读"内容→模型引用质量进一步稀释。Google的PageRank有人类点击作为质量信号,但AI搜索的引用闭环缺乏同等校验机制。
对做RAG产品的团队来说,这直接挑战了"检索即信任"的假设。如果你在做企业知识库或垂直搜索,现在就该加一层来源可信度评分,而不是直接透传模型检索到的URL。对内容创业者则是反向机会:在模型引用层建立品牌信任,可能比抢人类用户的SEO红利更值钱。
社区反馈
负面 103 条评论
核心争论:AI搜索正被SEO农场污染,模型训练数据陷入自我循环放大的垃圾内容危机
What protection do LLM search engines have against training off content generated by other LLMs? Will we get to a point where AI-generated sites make up a majority of the internet, and LLMs are training upon their own regurgitations, with exponential amplification of all their lies and flaws? Or wil
They’ll train on prompts and anything else you send in. Many LLM responses are sorta finger printable: I assume this is intentional
I have a feeling we're already there.