Reed's News
← 返回精选

社交媒体AI生成内容报告:LinkedIn最严重

AI 66 mukmuk 2026/7/9 997 字 原文 ↗

两个月前,我们推出了Chrome浏览器插件,旨在应对社交媒体上日益严重的"垃圾内容"问题。用户浏览社交平台时,插件可自动扫描动态,标记AI生成内容,帮助他们理性分配注意力

Pangram是一家以研究为核心的公司,不仅深耕行业领先的AI检测算法,还持续追踪AI生成内容的传播风险与普及程度。社交媒体是这类研究中难度最高的领域之一——远胜于新闻报道学术论文亚马逊商品评论。但它同时也是最关键的研究对象,因为这里可能是AI生成内容产量最高的场景。

我们认为,只有充分理解问题才能有效应对。因此,我们在Chrome插件中设置了自愿参与选项,用户可匿名分享扫描数据,助力我们的研究。以下是基于前几个月收集的数据整理而成的报告。

在我们的数据集中,AI生成内容遍布所有社交平台。所有扫描内容的AI平均占比为13.8%,但具体比例因平台和内容长度而异。在五分之四的平台上,长内容的AI生成概率高于短内容。跨平台来看,每四篇长内容中就有一篇(250字以上内容的25.72%)完全由AI生成。

Substack是个例外:该平台上完全由AI生成的内容占比基本持平,且篇幅更长、内容更详实的帖子,AI生成概率反而略低于短帖子。

LinkedIn是AI内容占比最高的平台,超过40%的长帖被标记为完全AI生成。但如果计入AI辅助或人机混合创作的内容,X/Twitter的情况最为严峻:近半数X平台文章要么完全由AI生成(23.9%),要么是AI辅助/混合创作(22.9%),仅53.2%的X平台文章被标记为完全由人类创作

数据显示,AI生成内容是所有平台都面临的问题,对长内容的影响尤为显著。即便是综合AI占比最低的长内容平台Substack,也有超过五分之一的帖子(21.9%)被标记为AI生成或AI辅助创作。这与我们在其他写作场景中观察到的AI内容增长趋势一致,例如报纸评论文章

LinkedIn在各平台中AI内容占比全面领先。其帖子占所有扫描内容的三分之一,却贡献了近三分之二(62%)的标记AI内容。与人们的预期相反,在与真实身份绑定的专业场景中,绝大多数人愿意用AI代笔;而在休闲或匿名平台上,AI的使用率反而更低。

LinkedIn还通过多种方式鼓励用户使用AI,例如内置的"AI写作"按钮(现已更名为"优化帖子",但仍提供AI写作辅助功能)。人们已注意到LinkedIn上垃圾内容泛滥的问题——或许为了应对这一情况,LinkedIn的一位高管近期宣布,平台将用自研算法检测AI生成帖子并降低其曝光度;颇具讽刺意味的是,这条声明本身就是AI生成的。无论该公司是否有意调控平台上的AI内容,我们的用户仍在LinkedIn上看到大量AI生成文字。

在我们的数据中,Reddit的扫描量最高,占所有扫描内容的36.7%,但其综合AI占比仅为4.4%,是各平台中最低的之一。这源于构成效应:Reddit上的回复绝大多数由人类创作(98.1%),且回复占所有扫描内容的72%。而Reddit的顶层帖子AI生成概率要高得多,达11.6%,与X/Twitter的10.0%AI占比持平。LinkedIn也存在类似规律,只是程度较轻:LinkedIn顶层帖子的AI生成概率是评论的1.35倍。

尽管LinkedIn评论的AI生成概率低于帖子,但如果控制内容长度变量,评论的AI生成概率反而略高于顶层帖子。而Reddit的AI占比差异与内容形式无关——控制长度变量后,顶层帖子的AI生成概率仍是评论的5.25倍

Reddit上几乎无AI生成回复的现象,暴露出许多反机器人策略的盲区。虽然Reddit的垃圾内容政策能有效清除自动生成AI垃圾回复的账号,但这种方式只能识别平台上最低质量的垃圾内容。Reddit顶层帖子仅占所有内容的四分之一,却拥有远高于回复的受众影响力;且由于数量较少,AI生成帖子更容易绕过基于发布频率的限流等 moderation机制。

自2026年4月24日Chrome插件上线以来,自愿参与数据分享的用户已帮助我们构建了一个包含1,002,627篇帖子的数据集,覆盖LinkedIn、Medium、Substack、X/Twitter和Reddit等主流社交平台。数据集中的每篇帖子仅统计一次,且我们仅扫描50字以上的内容。所有帖子均由我们最新的AI检测模型Pangram 3.3分析,该模型的误报率仅为0.01%。这份数据集让我们得以直观了解当前用户在社交平台上接触到的AI生成内容现状。

AI生成文字已成为社交媒体各平台普遍存在的问题。这一趋势令人担忧,但与我们在其他网络场景中的观察一致:研究人员估算,开放互联网上新增的网站中,35%为AI生成或AI辅助创作。一个充斥着未标注AI内容的互联网前景黯淡,但我们相信这并非必然。我们希望通过提高AI生成内容的透明度,帮助网民重新掌控自己的注意力分配。