Reddit 每天拦截 2300 万次垃圾曝光:AI 搜索时代的 Reddit 水军越来越难做

Reddit 每天拦截 2300 万次垃圾曝光:AI 搜索时代的 Reddit 水军越来越难做

不少做出海和 GEO 的团队都在讨论同一件事:ChatGPT、Perplexity 和 Google 的 AI 回答经常引用 Reddit,那么在 Reddit 上多发帖、多评论、多顶帖,品牌是不是就能出现在 AI 的回答里。

Reddit 在 2026 年 7 月 6 日公布了一组反垃圾数据:每天在垃圾内容到达用户之前拦截约 2300 万次垃圾曝光(spam views),每天新抓到约 2.5 万条垃圾帖子和评论,过去三个月每天撤销近 200 万个虚假投票。所以,批量发帖、伪装用户讨论的做法在 Reddit 上越来越难成功。品牌应该先研究 Reddit 上已有的真实讨论,再用透明身份参与。

要点

  • Reddit 官方称,新的自动化系统让用户接触垃圾内容的比例在 2026 年 1 月到 3 月下降了约 20%,每天撤销近 200 万个虚假投票。
  • Reddit 的防线分三层:平台的自动化系统和安全团队、社区版主的过滤工具、所有用户的投票。账号注册时就会被检查,可疑账号还要验证真人。
  • OpenAI 和 Google 都通过 Reddit Data API 获取 Reddit 内容。Peec AI 统计了 3000 万条 AI 引用来源,Reddit 是被引用最多的域名。
  • 批量发帖、批量评论、刷票、伪装用户,每一种做法都对应着 Reddit 的一道拦截。面向美国市场时,伪装消费者推荐自家产品还可能违反 FTC 的虚假评论规则。
  • 更稳妥的做法:先查 Reddit 上已有的讨论,把用户的问题反哺到官网、FAQ、对比页、产品页和客服素材,再用公开身份回答问题。

Reddit 公布了哪些数字

2026 年 7 月 6 日,Reddit 在官网发布了 How We’re Keeping Reddit Real and Safe in the AI Era。文章说,Reddit 已经和机器人账号对抗了 21 年,最近几个月升级了自动化系统,用 AI 发现被操纵的内容和垃圾内容。新系统上线后的数据如下:

  • 每天拦截 2300 万次垃圾内容浏览。这些内容在被真人看到之前就被拦下了。
  • 每天新抓到约 2.5 万条垃圾帖子和评论。
  • 过去三个月,每天撤销近 200 万个虚假投票。
  • 2026 年 1 月到 3 月,用户接触垃圾内容的比例比前三个月下降约 20%。另外,用户接触垃圾账号的整体比例又下降了 10%~15%。

Reddit 2026 年 7 月公布的反垃圾数据

这里的“垃圾曝光”指一条垃圾内容被用户看到一次。Reddit 统计的单位是浏览次数,和删除的帖子数是两个数字。Reddit 在文中说明了它的目标:在内容到达社区之前判断它是否有害,因为最有效的处理发生在任何人看到帖子之前。

同一篇文章还公布了仇恨和暴力内容的处理数据。Reddit 已经对全站英文文本启用自动化处理,其他语言随后上线。从发现到处理的平均时间缩短到 5 秒以内,处理量增加了 200% 以上,用户接触这类内容的比例下降了 40% 以上,误删正常内容的比例也下降了 40% 以上。这部分和品牌营销关系不大,但是能说明 Reddit 的自动化系统已经能在几秒内对内容作出判断。

给老手:Reddit 原文的数字表述

原文 TLDR:“By deploying advanced AI tools, we’ve reduced user exposure to spam by 20%, revoked nearly 2M fake votes daily, and slashed our enforcement time on hateful or violent content from hours to under five seconds.”

正文列表:

  • “Blocking 23 million spam views per day before they ever reach a human user.”
  • “Catching ~25K net new spammy posts and comments a day.”
  • “Reducing spam exposure for our users by ~20% from January to March 2026, relative to the prior three months and an additional 10–15% drop in overall spam account exposure.”
  • “Revoking nearly 2M inauthentic votes per day over the last three months.”

注意两点。第一,20% 是相对 2025 年 10 月到 12 月的环比,不是同比。第二,这些都是 Reddit 自己公布的数字,没有第三方审计,统计方法也没有公开。

Reddit 怎样识别水军

Reddit 在文章中描述了三个层次的防线:平台层、社区层和用户层。一个水军账号从注册到发帖、再到获得点赞,每一步都可能被拦下。

Reddit 的三层防线:平台、社区和用户

平台层:从注册开始检查

第一层由 Reddit 的管理员和安全团队负责,用自动化工具加人工复核执行全站规则。Reddit 说安全团队是公司最大的团队之一,有几十名专家专门预防和删除违规内容。

平台层有四个关键动作:

  1. 账号创建时就检查可疑信号,在账号发帖之前把可疑的人拦下。
  2. 对已经发帖的账号,用大语言模型(LLM)识别隐蔽的协同行为和虚假热度。Reddit 说,这类模式以前的系统识别不出来。
  3. 要求行为可疑的自动化账号验证自己是真人。Reddit 在 2026 年 3 月 25 日宣布了这项措施。9to5Mac 的报道提到,验证方式包括通行密钥(passkey),可以用 Touch ID 或 Face ID 完成。验证不针对所有用户,只在账号的发帖速度等行为信号异常时触发。正当用途的自动化账号要主动标明自己是机器人。
  4. 撤销虚假投票,每天近 200 万个。

“协同行为”指多个账号配合起来制造一种假象,例如几个账号在同一个帖子里轮流夸同一个产品,或者在短时间内集中给某条评论点赞。单个账号看起来正常,但放在一起看就有规律。Reddit 用 LLM 识别的正是这种规律。

社区层:版主手里的过滤工具

第二层是社区版主。Reddit 的每个社区(subreddit)都有志愿版主,他们执行社区规则和平台规则,并使用 Reddit 提供的 AI 工具识别低质量的发帖者。Reddit 点名了三个工具:

  • Reputation Filter:拦下疑似垃圾内容发布者的帖子和评论。
  • Crowd Control:限制低信任账号在社区里的发言,例如新账号或者不常在这个社区活动的账号。
  • Ban-Evasion Detection:识别被封禁后换号回来的人。

很多社区还有自己的规则,例如限制自我推广的比例、禁止贴自家网站链接、要求账号达到一定注册时长才能发帖。品牌账号即使通过了平台层,也可能因为违反社区规则被版主删帖或封禁。

用户层:投票决定可见度

第三层是所有用户。每个 Reddit 用户都可以点赞或点踩,投票结果直接影响内容的可见度。Reddit 说,低质量或操纵性的内容会很快被用户点踩,可见度随之下降。用户也可以举报看起来有害、垃圾或不真实的内容。

这三层防线互相补充:平台层处理规模化的作弊,社区层处理各社区自己的规则,用户层处理前两层漏掉的内容。

给老手:Reddit 全站规则里和营销相关的两条

Reddit Rules 中和品牌营销直接相关的是第 2 条和第 5 条:

  • Rule 2:“Abide by community rules. Participate authentically in communities where you have a personal interest, and do not spam or engage in disruptive behaviors (including content manipulation) that interfere with Reddit communities.”
  • Rule 5:“Be authentic. You don’t have to use your real name, but do not intentionally mislead others or impersonate an individual or entity in a deceptive manner.”

批量发帖属于 spam,刷票属于 content manipulation,员工伪装成普通用户推荐产品可以被认定为 intentionally mislead others。真人验证的原话来自 Reddit CEO Steve Huffman 对通行密钥的评价:“They actually require a human presence, like a human has to touch, or do or look at something, so that actually just proves there’s a person there.”

为什么 Reddit 成了 AI 搜索的重要信源

Reddit 已经是 AI 搜索里非常重要的信源之一。原因有两方面:AI 公司和 Reddit 签了数据合作,AI 搜索的引用数据里 Reddit 排在第一位。

OpenAI 和 Google 都通过 Data API 获取 Reddit 内容

2024 年 5 月 16 日,OpenAI 和 Reddit 宣布合作。根据 OpenAI 的公告,OpenAI 可以通过 Reddit Data API 获取实时、结构化、独特的 Reddit 内容,用于 ChatGPT 和其他新产品理解、展示 Reddit 内容,尤其是近期话题的内容。合作还包括另外两项:Reddit 基于 OpenAI 的模型为用户和版主开发 AI 功能,OpenAI 成为 Reddit 的广告合作伙伴。

更早的 2024 年 2 月 22 日,Reddit 宣布扩大和 Google 的合作。Google 可以通过 Reddit Data API 访问 Reddit 上持续更新的公开帖子和评论,用于在 Google 产品中展示 Reddit 内容、改进产品和服务,以及更高效地训练模型。Reddit 同时说明,这次合作不改变 Data API 的条款:未经 Reddit 批准,通过 API 获取的内容不能用于商业用途。

所以,ChatGPT 和 Google 除了普通的网页抓取,还有专门的数据接口获取 Reddit 内容。Reddit 上的讨论更新以后,这两家公司能比较快地拿到。

AI 回答引用最多的域名是 Reddit

Search Engine Land 报道了 AI 搜索监测工具 Peec AI 的一项研究。Peec AI 在 2026 年 3 月 31 日发布了研究原文,统计了美国地区 ChatGPT、Google AI 模式、Gemini、Perplexity 和 AI 概览这 5 个平台直接引用的 3000 万条来源。被引用最多的前 10 个域名依次是:Reddit、YouTube、LinkedIn、Wikipedia、Forbes、G2、Yelp、Facebook、Medium 和 Techradar。

Peec AI 还发现,Reddit 在所有 5 个平台上都排在第一或第二位。各平台之间也有差别:Google 的 AI 模式和 AI 概览更多引用 Facebook、Yelp 这类社交和点评内容,ChatGPT 更多引用 Forbes、Techradar 这类编辑类网站,Perplexity 在 B2B 问题上会引用 G2。

平台 引用最多的前 5 个来源
Google AI 模式 YouTube、Reddit、Facebook、LinkedIn、Yelp
Google AI 概览 YouTube、Reddit、Facebook、LinkedIn、Medium
Gemini Reddit、YouTube、Wikipedia、Medium、PCMag / Forbes
Perplexity Reddit、YouTube、LinkedIn、Wikipedia、G2
ChatGPT Wikipedia、Reddit、Forbes、Techradar、LinkedIn

所以大家盯上 Reddit 很正常。对 GEO 来说,Reddit 的价值在于它聚集了大量真实用户的讨论,包括产品体验、吐槽、对比、替代方案、购买建议和售后反馈。AI 系统很容易把这些内容当作第三方语境,用来理解一个品牌:用户怎么评价它,它和竞品比怎么样,它适合哪些人。

给老手:这份引用数据的局限
  • 只统计美国地区,不同国家和语言的结果可能不同。
  • 统计的是“被直接引用的来源”,不等于这些来源带来的点击,也不等于它们对回答的影响权重。
  • Peec AI 是 AI 搜索监测工具的厂商,研究同时在推广自己的产品,抽样的提示词范围没有公开。
  • Peec AI 自己也指出,行业差异很大。例如在酒店行业,Booking.com 和 Airbnb 被引用的次数常常超过 Reddit。所以要先查自己行业的数据,不能直接套用总榜。
  • Peec AI 还提到,Google 和 ChatGPT 过去都有过减少引用 Reddit 的时期,以后也可能再发生。只押注 Reddit 一个平台有风险。

批量发帖为什么越来越难

如果还用传统 SEO 里那套方法去做 Reddit,难度会越来越大。这套方法包括批量发帖、批量评论、批量顶帖,以及伪装成用户讨论。Reddit 官方已经明确说,他们会在账号创建阶段识别可疑信号,也会使用 LLM 捕捉更隐蔽的协同行为、虚假热度和人为操纵。

下表把常见做法和 Reddit 的拦截环节对应起来:

常见做法 对应的拦截环节 可能的结果
批量注册新号发帖 注册时的可疑信号;真人验证;版主的 Crowd Control 限制新账号 账号受限,帖子不显示或被折叠
多个账号在同一帖子里互相呼应、夸同一个产品 LLM 识别协同行为和虚假热度 内容被删,账号被封
刷赞、顶帖 每天撤销近 200 万个虚假投票 投票作废,热度回落
被封后换号继续发 版主的 Ban-Evasion Detection 新账号很快被识别
发帖内容是硬广或者只贴链接 Reputation Filter;社区的自我推广规则;用户点踩 被过滤、被删帖或者沉底

即使有一部分内容暂时躲过了检查,结果也不稳定。被撤销的投票、被删除的帖子和被封禁的账号,都会让前面的投入归零。帖子被删除后,用户在 Reddit 上看不到它,AI 实时检索 Reddit 时也就很难再引用它。

面向美国市场的品牌还要注意法律风险。美国联邦贸易委员会(FTC)在 2024 年 8 月 14 日宣布了禁止虚假评论和推荐的最终规则,规则在联邦公报发布 60 天后生效。规则禁止编造、购买和传播虚假评论,包括 AI 生成的评论。公司内部人员写的评论如果没有清楚披露和公司的关系,也在禁止范围内。员工或外包团队在 Reddit 上伪装成普通消费者推荐自家产品,可能落入这些条款,FTC 可以对明知违规的企业寻求民事罚款。

这对品牌出海和 GEO 优化有一个很直接的启发:品牌不能再把 Reddit 当成一个“发帖渠道”,它更像是一个公开的用户信任场。品牌可以影响它,但很难粗暴控制它。

给老手:FTC 规则的相关条款

规则编号 16 CFR Part 465(Trade Regulation Rule on the Use of Consumer Reviews and Testimonials),2024 年 8 月 14 日以 5 比 0 投票通过。和 Reddit 营销关系最大的两条:

  • Fake or false reviews:禁止编造或传播虚假的消费者评论、推荐,包括由不存在的人或没有实际使用经验的人写的内容,FTC 明确把 AI 生成的虚假评论列为打击对象。
  • Insider reviews:禁止公司高管和经理撰写未披露关系的评论;如果公司知道或应该知道员工、代理人写了未披露关系的评论,并且是公司要求或鼓励的,公司也要承担责任。

规则是否适用于某个具体的 Reddit 帖子,要看内容是否构成对产品的评价或推荐,以及发帖人和公司的关系。这里只说明风险方向,具体判断请咨询律师。

更稳妥的做法:先听,再回答

更稳妥的做法分四步:先查讨论,再拆问题,然后反哺自己的页面,最后用透明身份参与。顺序很重要。品牌先把用户的问题在自己的站上回答清楚,再去 Reddit 参与讨论,才有可以引用的资料。

品牌在 Reddit 上做 GEO 的四个步骤

第一步:查搜索场景里已有的讨论

先看品牌词、竞品词、review、alternative、vs、worth it、problem 这些搜索场景里,Reddit 已经出现了哪些讨论。可以在 Google 里加上 reddit 或者 site:reddit.com 搜索,也可以直接用 Reddit 站内搜索。

搜索场景 示例查询 能看到什么
品牌词 brandname reddit 用户对品牌的整体印象,有没有集中的投诉
竞品词 competitor reddit 竞品被夸和被骂的地方
review brandname review reddit 真实的使用体验、使用时长、使用场景
alternative competitor alternative reddit 用户为什么想换,最后换成了什么
vs brandname vs competitor reddit 用户比较时最看重的指标
worth it is brandname worth it reddit 价格异议和购买犹豫的原因
problem brandname problem reddit 质量问题、售后问题、使用误区

然后在 ChatGPT、Perplexity 和 Google AI 模式里问同样的问题,看 AI 回答引用了哪些 Reddit 帖子,又是怎样描述你的品牌的。Peec AI 的建议也是先查自己行业里 AI 最常引用的来源,因为总榜不一定适用于你的行业。

第二步:把讨论拆成用户真实关心的问题

读讨论时,记下原话、帖子链接、点赞数和发帖时间。然后按主题归类,例如尺码偏大、电池续航、退货流程、和某个竞品的价格差。每一类整理成一个用户问题,并标注它出现的频率。

点赞多的评论代表很多用户认同这个看法,而且排在讨论的前面,读者和 AI 都更容易读到。所以,高赞的负面评价要优先处理。

第三步:反哺官网内容、FAQ、对比页、产品页和客服素材

把整理好的问题分别交给对应的页面:

  • 官网内容:用户反复问的使用方法和选购问题,写成指南类文章。
  • FAQ:退货、物流、保修这类有明确答案的问题,每个问题写一个简短、完整的答案。
  • 对比页:用户在 vs 和 alternative 讨论里关心的指标,做成对比表。对比要写清楚自己不如竞品的地方。
  • 产品页:把用户常问的规格、尺码、适用场景写进产品描述。
  • 客服素材:把高频投诉和对应的处理方法交给客服团队,统一回答。

这样做以后,AI 系统在 Reddit 上读到一个问题,在品牌官网上也能找到一个清楚的答案。两边的信息一致,AI 描述品牌时就更准确。

第四步:用透明身份参与

如果品牌要参与 Reddit,应该尽量用透明身份去回答问题、解释产品、承认限制、补充资料。不要伪装成普通用户硬推链接。具体做法包括:

  • 用品牌官方账号,或者在员工账号的简介和回复里写明“我在某品牌工作”。
  • 先读社区规则,确认社区是否允许品牌参与、是否允许贴链接。
  • 回答具体问题,例如解释某个功能的原理、说明退货流程。只在链接能补充信息时才贴链接。
  • 承认产品的限制,例如“这款不适合大码用户”“这个问题我们在下一批货里修正了”。
  • 处理投诉时给出具体的解决办法,不删帖、不刷屏、不用小号反驳。

透明参与的效果比批量发帖慢。但是,用公开身份留下的回答不容易被反垃圾系统当成垃圾内容删除,也不会给品牌带来被曝光“刷水军”的风险。

对你意味着什么

GEO 的重点正在从“制造提及”(mention)转向积累可信的第三方语境。AI 系统引用 Reddit,是因为 Reddit 上有真实用户的讨论。如果这些讨论是品牌自己制造的,Reddit 的反垃圾系统会删掉一部分,用户会点踩一部分,剩下的部分也会降低 Reddit 作为信源的可信度。

Reddit 这次公布的数据提醒所有做 AI 搜索优化的人:AI 时代的第三方信任源会越来越重要,但是越重要的平台,越不适合用低成本的批量做法去污染。

具体可以按下面的清单执行:

  1. 用上面的 7 类查询,每个季度查一次品牌和竞品在 Reddit 上的讨论。
  2. 在 ChatGPT、Perplexity 和 Google AI 模式里问同样的问题,记录 AI 引用了哪些帖子。
  3. 把讨论里的高频问题和高赞负面评价整理成清单,分给官网内容、FAQ、对比页、产品页和客服。
  4. 品牌参与 Reddit 时,用官方账号或者标明身份的员工账号,遵守社区规则。
  5. 停止批量注册账号、批量发帖、刷票和伪装用户的做法。面向美国市场时,还要考虑 FTC 规则的法律风险。
  6. 不要只押注 Reddit。YouTube、LinkedIn、点评网站和行业论坛也在 AI 引用来源的前列。

附录:证据清单

判断 来源 日期
每天拦截 2300 万次垃圾内容浏览,每天新抓到约 2.5 万条垃圾帖子和评论 Reddit 官方文章 2026-07-06
过去三个月每天撤销近 200 万个虚假投票 同上 2026-07-06
2026 年 1–3 月用户接触垃圾内容的比例环比下降约 20%,接触垃圾账号的整体比例另降 10%~15% 同上 2026-07-06
注册时检查可疑信号,用 LLM 识别协同行为和虚假热度 同上 2026-07-06
三层防线:平台、社区(Reputation Filter、Crowd Control、Ban-Evasion Detection)、用户投票 同上 2026-07-06
仇恨和暴力内容处理时间缩短到 5 秒以内,处理量增加 200% 以上,接触比例和误删比例都下降 40% 以上 同上 2026-07-06
行为可疑的账号要验证真人,可用通行密钥 9to5Mac 对 Reddit 公告的报道 2026-03-25
Reddit 全站规则禁止垃圾内容、内容操纵和欺骗性冒充 Reddit Rules 第 2 条、第 5 条 当前版本
OpenAI 通过 Data API 获取实时、结构化的 Reddit 内容,用于 ChatGPT 和新产品 OpenAI 官方公告 2024-05-16
Google 通过 Data API 获取 Reddit 公开帖子和评论,用于展示内容、改进产品和训练模型 Reddit 官方公告 2024-02-22
3000 万条 AI 引用来源中,Reddit 被引用最多,在 5 个平台上都排第一或第二 Peec AI 研究,Search Engine Land 报道 2026-03-31
FTC 禁止虚假评论、AI 生成的虚假评论和未披露关系的内部人员评论 FTC 新闻稿,16 CFR Part 465 2024-08-14

参考来源

  1. Reddit 官方:How We’re Keeping Reddit Real and Safe in the AI Era
  2. OpenAI 官方:OpenAI and Reddit Partnership
  3. Reddit 官方:Expanding our Partnership with Google
  4. Search Engine Land:AI search engines cite Reddit, YouTube, and LinkedIn most: Study
  5. Peec AI:Top domains cited by AI search: Analysis based on 30M sources
  6. 9to5Mac:Reddit will soon make ‘fishy’ accounts verify their humanity
  7. Reddit:Reddit Rules
  8. FTC:Federal Trade Commission Announces Final Rule Banning Fake Reviews and Testimonials

Reddit 每天拦截 2300 万次垃圾曝光:AI 搜索时代的 Reddit 水军越来越难做

https://www.linusseo.com/reddit-spam-ai-era-geo/

作者

Linus Li

发布于

2026-07-13

更新于

2026-07-13

许可协议

关于作者

Linus Li

Linus Li

深圳谷歌SEO专家 · Head of Technical Solutions, 翼果科技 / 筋斗云SEO

信息安全背景出身,长期专注谷歌SEO算法研究与出海流量增长。

微信扫码关注公众号

微信扫码关注公众号