AI Slop泛滥:垃圾内容正在吞噬社交平台

当"死亡互联网理论"照进现实
最近,一位Reddit用户分享了他在Snapchat Discover信息流中的发现:连续两条推送内容几乎完全雷同,明显出自同一个批量生产的机器人账号。他的感叹颇具代表性——"AI垃圾内容正在接管Snapchat,互联网真的死了。"

Snapchat Discover是Snap公司于2015年推出的媒体内容板块,最初定位为与CNN、ESPN、Vice等知名媒体合作的精选内容入口。与Snapchat的核心阅后即焚社交功能不同,Discover更像是一个内置的内容聚合平台,后来逐步向普通创作者开放。Snap通过广告收入分成模式激励创作者入驻,这本意是丰富内容生态,但也客观上为批量化内容生产者提供了套利空间。
这条帖子看似是一次普通的吐槽,却触及了当下互联网生态中一个愈发严峻的问题:由生成式AI大规模炮制的低质量内容(俗称"AI Slop")正在以惊人的速度充斥各大社交与内容平台。用户抱怨这些内容"甚至懒得掩饰自己是复制粘贴农场机器人",这背后反映的是内容生产成本的坍塌与平台治理的严重滞后。
什么是AI Slop?为什么它无处不在
"AI Slop"是近两年在英文互联网社区流行起来的贬义词,专门用来形容那些由AI批量生成、缺乏原创价值、粗制滥造的垃圾内容。它可以是文字、图片、视频,也可以是三者的混合体。
"Slop"一词在英语中原意为泔水、残羹剩饭,暗含粗劣、令人不适之意。2024年初,这个词被《纽约时报》等主流媒体正式采纳,用以描述生成式AI产出的低质量内容洪流。与之前常用的"spam"(垃圾信息)不同,"AI Slop"特别强调内容在形式上可能看似完整甚至光鲜,但在信息价值上空洞无物。它已被部分词典收录为年度热词候选,反映了公众对AI内容污染问题认知的快速提升。
AI垃圾内容的典型特征
这类内容通常具备几个明显特征:
- 高度同质化:同一模板反复套用,标题、封面、结构如出一辙;
- 零边际成本:借助大语言模型和图像生成工具,一个账号一天可产出成百上千条内容;
- 迎合算法而非用户:内容设计的唯一目的是骗取点击、停留和推荐流量,而非传递真实信息;
- 难以溯源:往往通过多个马甲账号交叉发布,形成"内容农场"式的分发网络。
在技术层面,这种"零边际成本"的说法并非夸张。大语言模型(Large Language Models, LLMs)如GPT系列、Claude、Llama等,通过在海量文本数据上进行预训练,掌握了自然语言的生成能力。配合Midjourney、Stable Diffusion、DALL-E等图像生成模型,以及Sora、Runway等视频生成工具,内容创作的技术门槛和边际成本已降至接近于零。过去一篇需要记者数小时采编的文章,现在通过API调用和自动化脚本可以在几秒内批量生成数百篇变体。这种生产力的爆炸式增长,正是AI Slop泛滥的技术根源。
Snapchat Discover本应是精选优质创作者内容的入口,如今却沦为这类批量AI生成内容的重灾区,这正是本次讨论的核心焦点。
死亡互联网理论:从阴谋论到部分现实
帖子标题中"互联网真的死了"(the internet really is dead)并非随口一说,而是呼应了近年来广为流传的死亡互联网理论(Dead Internet Theory)。
该理论最初是一种带有阴谋论色彩的说法,认为互联网上的大部分内容和互动早已不是由真人产生,而是由机器人和自动化程序生成。死亡互联网理论最早可追溯至2021年前后在4chan等匿名论坛上的讨论。其核心主张是:大约从2016-2017年开始,互联网上由真人产生的内容和互动比例急剧下降,取而代之的是大量机器人账号、自动化脚本和算法生成的内容。该理论最初的版本甚至认为这是政府和大型科技公司有意为之的阴谋。虽然其极端版本缺乏证据,但2023年后随着ChatGPT等工具的普及,多项研究数据开始部分印证其判断——例如,网络安全公司Imperva的报告显示,2023年全球互联网流量中约49.6%来自机器人,首次接近超过人类流量的临界点。
曾经它被当作一种夸张的调侃,但随着生成式AI的爆发,这个理论正逐渐从"阴谋论"走向"部分现实"。
当一个普通用户在信息流中连续刷到两条几乎一模一样、明显是机器生成的内容时,那种"我究竟是在和真人还是和机器互动"的疑问就变得无比真实。这种体验上的割裂感,正是许多用户对当前平台生态感到失望的根源。
社交平台为何难以根治AI垃圾内容
流量指标与内容质量的天然矛盾
对平台而言,内容供给量和用户停留时长是关键指标。AI批量内容虽然质量低下,却能以极低成本填满信息流、维持推荐系统的"喂养"。
现代社交平台的推荐系统通常基于协同过滤、深度学习排序模型等技术,需要持续大量的新内容输入来维持推荐的多样性和时效性。这种机制被业内形象地称为"内容喂养"——算法需要不断消化新的内容素材,才能为每位用户生成个性化的信息流。当优质原创内容的产出速度远低于算法的"胃口"时,低质量的批量内容就自然填补了供给缺口。这也解释了为什么即使平台工程师知道AI Slop的存在,在产品层面仍可能对其"睁一只眼闭一只眼"。
在短期数据层面,这些内容甚至可能"有益"于平台的增长数字,这使得平台在治理动力上存在天然矛盾。
AI内容检测的军备竞赛
识别AI生成内容本身就是一场持续升级的"军备竞赛"。随着生成模型质量不断提高,单纯依靠水印、特征识别等技术手段越来越难以奏效。而内容农场也在不断调整策略,规避审核机制。
目前主流的AI内容检测方法包括:统计特征分析(如文本困惑度、词频分布异常)、水印嵌入技术(如OpenAI和Google DeepMind分别开发的文本和图像水印方案)、以及基于分类器的判别模型。然而,这些方法普遍面临高误报率和快速失效的问题。学术研究表明,经过简单的改写、翻译中转或混合人工编辑后,大多数AI检测工具的准确率会显著下降。此外,C2PA(内容来源与真实性联盟)正在推动一种基于加密签名的内容溯源标准,但其大规模部署仍面临行业协调和用户接受度的挑战。
商业激励机制的错位
只要平台的广告分成、流量激励机制存在漏洞,就会有人利用AI批量生产内容来套取收益。
内容农场(Content Farm)并非AI时代的新产物,早在2010年前后,以Demand Media、Associated Content为代表的公司就曾通过雇佣廉价写手批量生产SEO优化文章来获取Google搜索流量和广告收入。Google在2011年推出Panda算法更新后一度遏制了这一现象。然而生成式AI将内容农场的运营成本降低了一到两个数量级——不再需要人工写手,一台电脑配合API即可日产万篇。在社交平台上,这些农场通过注册大量账号、利用广告分成和打赏机制变现,形成了完整的灰色产业链。
治理的关键或许不在于"识别AI",而在于重构内容激励机制,让低质量的批量内容无利可图。
AI Slop对用户和原创作者意味着什么
对于普通用户,最直接的影响是信息环境的持续恶化——真实、有价值的内容被淹没在海量的机器生成内容之中,获取有效信息的成本反而上升。
对于真正的原创作者,这是一场极不公平的竞争。他们投入大量时间和精力创作的内容,可能在推荐权重上敌不过机器批量生产的"填充物",这将进一步打击优质创作的积极性,形成劣币驱逐良币的恶性循环。
这一现象在经济学中被称为"格雷欣法则"(Gresham's Law)的数字版本。在信息不对称的条件下,当推荐算法无法有效区分内容质量时,生产成本更低的劣质内容会在数量上压倒优质内容,获取更多的曝光和流量。这种动态一旦形成正反馈循环——优质创作者因回报下降而减少产出,而AI内容因持续获得流量而加速生产——平台的整体内容生态就会陷入不可逆的退化。历史上,这种模式已经在多个平台上演:从早期的eHow到后来的某些自媒体平台,内容质量的塌方往往伴随着用户信任的不可逆流失。
你可能没注意到,上述案例来自一位Reddit用户基于个人观察的反馈,尚缺乏平台层面的官方数据佐证。但类似的抱怨在Reddit、X等社区中并不鲜见,反映出这确实是一种被广泛感知的趋势。
应对AI垃圾内容泛滥的三条路径
AI技术本身是中性的,真正的问题在于滥用。面对AI垃圾内容的泛滥,可能的解法包括:
- 平台侧:完善内容溯源与标注机制,调整推荐算法权重,切断内容农场的变现路径;
- 技术侧:发展更可靠的AI内容检测与身份验证手段;
- 用户侧:提高媒介素养,主动辨别与举报低质量内容。
"死亡互联网理论"是否会成真,很大程度上取决于平台、监管者和用户能否共同建立起一套抵御AI垃圾内容的免疫系统。Snapchat上的这两条重复推送,或许只是一个缩影——它提醒我们,一个由AI主导内容生产的时代已经到来,而如何守护互联网的"真实性",将是所有人都无法回避的命题。
核心要点
相关推荐

GLM-5.2开源模型登顶榜首,综合评测跻身全球前三
智谱GLM-5.2正式开源,在Artificial Analysis综合智能指数中与Claude Opus比肩,Code Arena全球第二,DesignArena夺冠,FrontierSWE全球第三,成为当前最强开源大模型。

Perplexity隐藏设置:如何关闭Projects中Computer默认模式
详解Perplexity Projects中关闭Default to Computer默认模式的操作步骤,涵盖桌面端与Comet浏览器设置方法,帮助用户优化项目空间的日常查询体验。

免运维微调平台Rebiha:QLoRA+Unsloth驱动的SaaS实践
深入解析免运维微调平台Rebiha的技术架构与产品设计:基于QLoRA+Unsloth的4-bit量化训练、35个领域专用数据集、灵活的GGUF输出方案,以及数据与训练分离计费模式的利弊分析。