Reddit 每天拦截 2300 万次垃圾曝光:AI 搜索时代的 Reddit 水军越来越难做
不少做出海和 GEO 的团队都在讨论同一件事:ChatGPT、Perplexity 和 Google 的 AI 回答经常引用 Reddit,那么在 Reddit 上多发帖、多评论、多顶帖,品牌是不是就能出现在 AI 的回答里。
Reddit 在 2026 年 7 月 6 日公布了一组反垃圾数据:每天在垃圾内容到达用户之前拦截约 2300 万次垃圾曝光(spam views),每天新抓到约 2.5 万条垃圾帖子和评论,过去三个月每天撤销近 200 万个虚假投票。所以,批量发帖、伪装用户讨论的做法在 Reddit 上越来越难成功。品牌应该先研究 Reddit 上已有的真实讨论,再用透明身份参与。
要点
- Reddit 官方称,新的自动化系统让用户接触垃圾内容的比例在 2026 年 1 月到 3 月下降了约 20%,每天撤销近 200 万个虚假投票。
- Reddit 的防线分三层:平台的自动化系统和安全团队、社区版主的过滤工具、所有用户的投票。账号注册时就会被检查,可疑账号还要验证真人。
- OpenAI 和 Google 都通过 Reddit Data API 获取 Reddit 内容。Peec AI 统计了 3000 万条 AI 引用来源,Reddit 是被引用最多的域名。
- 批量发帖、批量评论、刷票、伪装用户,每一种做法都对应着 Reddit 的一道拦截。面向美国市场时,伪装消费者推荐自家产品还可能违反 FTC 的虚假评论规则。
- 更稳妥的做法:先查 Reddit 上已有的讨论,把用户的问题反哺到官网、FAQ、对比页、产品页和客服素材,再用公开身份回答问题。
Reddit 公布了哪些数字
2026 年 7 月 6 日,Reddit 在官网发布了 How We’re Keeping Reddit Real and Safe in the AI Era。文章说,Reddit 已经和机器人账号对抗了 21 年,最近几个月升级了自动化系统,用 AI 发现被操纵的内容和垃圾内容。新系统上线后的数据如下:
- 每天拦截 2300 万次垃圾内容浏览。这些内容在被真人看到之前就被拦下了。
- 每天新抓到约 2.5 万条垃圾帖子和评论。
- 过去三个月,每天撤销近 200 万个虚假投票。
- 2026 年 1 月到 3 月,用户接触垃圾内容的比例比前三个月下降约 20%。另外,用户接触垃圾账号的整体比例又下降了 10%~15%。
这里的“垃圾曝光”指一条垃圾内容被用户看到一次。Reddit 统计的单位是浏览次数,和删除的帖子数是两个数字。Reddit 在文中说明了它的目标:在内容到达社区之前判断它是否有害,因为最有效的处理发生在任何人看到帖子之前。
同一篇文章还公布了仇恨和暴力内容的处理数据。Reddit 已经对全站英文文本启用自动化处理,其他语言随后上线。从发现到处理的平均时间缩短到 5 秒以内,处理量增加了 200% 以上,用户接触这类内容的比例下降了 40% 以上,误删正常内容的比例也下降了 40% 以上。这部分和品牌营销关系不大,但是能说明 Reddit 的自动化系统已经能在几秒内对内容作出判断。
给老手:Reddit 原文的数字表述
原文 TLDR:“By deploying advanced AI tools, we’ve reduced user exposure to spam by 20%, revoked nearly 2M fake votes daily, and slashed our enforcement time on hateful or violent content from hours to under five seconds.”
正文列表:
- “Blocking 23 million spam views per day before they ever reach a human user.”
- “Catching ~25K net new spammy posts and comments a day.”
- “Reducing spam exposure for our users by ~20% from January to March 2026, relative to the prior three months and an additional 10–15% drop in overall spam account exposure.”
- “Revoking nearly 2M inauthentic votes per day over the last three months.”
注意两点。第一,20% 是相对 2025 年 10 月到 12 月的环比,不是同比。第二,这些都是 Reddit 自己公布的数字,没有第三方审计,统计方法也没有公开。
Reddit 怎样识别水军
Reddit 在文章中描述了三个层次的防线:平台层、社区层和用户层。一个水军账号从注册到发帖、再到获得点赞,每一步都可能被拦下。
平台层:从注册开始检查
第一层由 Reddit 的管理员和安全团队负责,用自动化工具加人工复核执行全站规则。Reddit 说安全团队是公司最大的团队之一,有几十名专家专门预防和删除违规内容。
平台层有四个关键动作:
- 账号创建时就检查可疑信号,在账号发帖之前把可疑的人拦下。
- 对已经发帖的账号,用大语言模型(LLM)识别隐蔽的协同行为和虚假热度。Reddit 说,这类模式以前的系统识别不出来。
- 要求行为可疑的自动化账号验证自己是真人。Reddit 在 2026 年 3 月 25 日宣布了这项措施。9to5Mac 的报道提到,验证方式包括通行密钥(passkey),可以用 Touch ID 或 Face ID 完成。验证不针对所有用户,只在账号的发帖速度等行为信号异常时触发。正当用途的自动化账号要主动标明自己是机器人。
- 撤销虚假投票,每天近 200 万个。
“协同行为”指多个账号配合起来制造一种假象,例如几个账号在同一个帖子里轮流夸同一个产品,或者在短时间内集中给某条评论点赞。单个账号看起来正常,但放在一起看就有规律。Reddit 用 LLM 识别的正是这种规律。
社区层:版主手里的过滤工具
第二层是社区版主。Reddit 的每个社区(subreddit)都有志愿版主,他们执行社区规则和平台规则,并使用 Reddit 提供的 AI 工具识别低质量的发帖者。Reddit 点名了三个工具:
- Reputation Filter:拦下疑似垃圾内容发布者的帖子和评论。
- Crowd Control:限制低信任账号在社区里的发言,例如新账号或者不常在这个社区活动的账号。
- Ban-Evasion Detection:识别被封禁后换号回来的人。
很多社区还有自己的规则,例如限制自我推广的比例、禁止贴自家网站链接、要求账号达到一定注册时长才能发帖。品牌账号即使通过了平台层,也可能因为违反社区规则被版主删帖或封禁。
用户层:投票决定可见度
第三层是所有用户。每个 Reddit 用户都可以点赞或点踩,投票结果直接影响内容的可见度。Reddit 说,低质量或操纵性的内容会很快被用户点踩,可见度随之下降。用户也可以举报看起来有害、垃圾或不真实的内容。
这三层防线互相补充:平台层处理规模化的作弊,社区层处理各社区自己的规则,用户层处理前两层漏掉的内容。
给老手:Reddit 全站规则里和营销相关的两条
Reddit Rules 中和品牌营销直接相关的是第 2 条和第 5 条:
- Rule 2:“Abide by community rules. Participate authentically in communities where you have a personal interest, and do not spam or engage in disruptive behaviors (including content manipulation) that interfere with Reddit communities.”
- Rule 5:“Be authentic. You don’t have to use your real name, but do not intentionally mislead others or impersonate an individual or entity in a deceptive manner.”
批量发帖属于 spam,刷票属于 content manipulation,员工伪装成普通用户推荐产品可以被认定为 intentionally mislead others。真人验证的原话来自 Reddit CEO Steve Huffman 对通行密钥的评价:“They actually require a human presence, like a human has to touch, or do or look at something, so that actually just proves there’s a person there.”
为什么 Reddit 成了 AI 搜索的重要信源
Reddit 已经是 AI 搜索里非常重要的信源之一。原因有两方面:AI 公司和 Reddit 签了数据合作,AI 搜索的引用数据里 Reddit 排在第一位。
OpenAI 和 Google 都通过 Data API 获取 Reddit 内容
2024 年 5 月 16 日,OpenAI 和 Reddit 宣布合作。根据 OpenAI 的公告,OpenAI 可以通过 Reddit Data API 获取实时、结构化、独特的 Reddit 内容,用于 ChatGPT 和其他新产品理解、展示 Reddit 内容,尤其是近期话题的内容。合作还包括另外两项:Reddit 基于 OpenAI 的模型为用户和版主开发 AI 功能,OpenAI 成为 Reddit 的广告合作伙伴。
更早的 2024 年 2 月 22 日,Reddit 宣布扩大和 Google 的合作。Google 可以通过 Reddit Data API 访问 Reddit 上持续更新的公开帖子和评论,用于在 Google 产品中展示 Reddit 内容、改进产品和服务,以及更高效地训练模型。Reddit 同时说明,这次合作不改变 Data API 的条款:未经 Reddit 批准,通过 API 获取的内容不能用于商业用途。
所以,ChatGPT 和 Google 除了普通的网页抓取,还有专门的数据接口获取 Reddit 内容。Reddit 上的讨论更新以后,这两家公司能比较快地拿到。
AI 回答引用最多的域名是 Reddit
Search Engine Land 报道了 AI 搜索监测工具 Peec AI 的一项研究。Peec AI 在 2026 年 3 月 31 日发布了研究原文,统计了美国地区 ChatGPT、Google AI 模式、Gemini、Perplexity 和 AI 概览这 5 个平台直接引用的 3000 万条来源。被引用最多的前 10 个域名依次是:Reddit、YouTube、LinkedIn、Wikipedia、Forbes、G2、Yelp、Facebook、Medium 和 Techradar。
Peec AI 还发现,Reddit 在所有 5 个平台上都排在第一或第二位。各平台之间也有差别:Google 的 AI 模式和 AI 概览更多引用 Facebook、Yelp 这类社交和点评内容,ChatGPT 更多引用 Forbes、Techradar 这类编辑类网站,Perplexity 在 B2B 问题上会引用 G2。
| 平台 | 引用最多的前 5 个来源 |
|---|---|
| Google AI 模式 | YouTube、Reddit、Facebook、LinkedIn、Yelp |
| Google AI 概览 | YouTube、Reddit、Facebook、LinkedIn、Medium |
| Gemini | Reddit、YouTube、Wikipedia、Medium、PCMag / Forbes |
| Perplexity | Reddit、YouTube、LinkedIn、Wikipedia、G2 |
| ChatGPT | Wikipedia、Reddit、Forbes、Techradar、LinkedIn |
所以大家盯上 Reddit 很正常。对 GEO 来说,Reddit 的价值在于它聚集了大量真实用户的讨论,包括产品体验、吐槽、对比、替代方案、购买建议和售后反馈。AI 系统很容易把这些内容当作第三方语境,用来理解一个品牌:用户怎么评价它,它和竞品比怎么样,它适合哪些人。
给老手:这份引用数据的局限
- 只统计美国地区,不同国家和语言的结果可能不同。
- 统计的是“被直接引用的来源”,不等于这些来源带来的点击,也不等于它们对回答的影响权重。
- Peec AI 是 AI 搜索监测工具的厂商,研究同时在推广自己的产品,抽样的提示词范围没有公开。
- Peec AI 自己也指出,行业差异很大。例如在酒店行业,Booking.com 和 Airbnb 被引用的次数常常超过 Reddit。所以要先查自己行业的数据,不能直接套用总榜。
- Peec AI 还提到,Google 和 ChatGPT 过去都有过减少引用 Reddit 的时期,以后也可能再发生。只押注 Reddit 一个平台有风险。
批量发帖为什么越来越难
如果还用传统 SEO 里那套方法去做 Reddit,难度会越来越大。这套方法包括批量发帖、批量评论、批量顶帖,以及伪装成用户讨论。Reddit 官方已经明确说,他们会在账号创建阶段识别可疑信号,也会使用 LLM 捕捉更隐蔽的协同行为、虚假热度和人为操纵。
下表把常见做法和 Reddit 的拦截环节对应起来:
| 常见做法 | 对应的拦截环节 | 可能的结果 |
|---|---|---|
| 批量注册新号发帖 | 注册时的可疑信号;真人验证;版主的 Crowd Control 限制新账号 | 账号受限,帖子不显示或被折叠 |
| 多个账号在同一帖子里互相呼应、夸同一个产品 | LLM 识别协同行为和虚假热度 | 内容被删,账号被封 |
| 刷赞、顶帖 | 每天撤销近 200 万个虚假投票 | 投票作废,热度回落 |
| 被封后换号继续发 | 版主的 Ban-Evasion Detection | 新账号很快被识别 |
| 发帖内容是硬广或者只贴链接 | Reputation Filter;社区的自我推广规则;用户点踩 | 被过滤、被删帖或者沉底 |
即使有一部分内容暂时躲过了检查,结果也不稳定。被撤销的投票、被删除的帖子和被封禁的账号,都会让前面的投入归零。帖子被删除后,用户在 Reddit 上看不到它,AI 实时检索 Reddit 时也就很难再引用它。
面向美国市场的品牌还要注意法律风险。美国联邦贸易委员会(FTC)在 2024 年 8 月 14 日宣布了禁止虚假评论和推荐的最终规则,规则在联邦公报发布 60 天后生效。规则禁止编造、购买和传播虚假评论,包括 AI 生成的评论。公司内部人员写的评论如果没有清楚披露和公司的关系,也在禁止范围内。员工或外包团队在 Reddit 上伪装成普通消费者推荐自家产品,可能落入这些条款,FTC 可以对明知违规的企业寻求民事罚款。
这对品牌出海和 GEO 优化有一个很直接的启发:品牌不能再把 Reddit 当成一个“发帖渠道”,它更像是一个公开的用户信任场。品牌可以影响它,但很难粗暴控制它。
给老手:FTC 规则的相关条款
规则编号 16 CFR Part 465(Trade Regulation Rule on the Use of Consumer Reviews and Testimonials),2024 年 8 月 14 日以 5 比 0 投票通过。和 Reddit 营销关系最大的两条:
- Fake or false reviews:禁止编造或传播虚假的消费者评论、推荐,包括由不存在的人或没有实际使用经验的人写的内容,FTC 明确把 AI 生成的虚假评论列为打击对象。
- Insider reviews:禁止公司高管和经理撰写未披露关系的评论;如果公司知道或应该知道员工、代理人写了未披露关系的评论,并且是公司要求或鼓励的,公司也要承担责任。
规则是否适用于某个具体的 Reddit 帖子,要看内容是否构成对产品的评价或推荐,以及发帖人和公司的关系。这里只说明风险方向,具体判断请咨询律师。
更稳妥的做法:先听,再回答
更稳妥的做法分四步:先查讨论,再拆问题,然后反哺自己的页面,最后用透明身份参与。顺序很重要。品牌先把用户的问题在自己的站上回答清楚,再去 Reddit 参与讨论,才有可以引用的资料。
第一步:查搜索场景里已有的讨论
先看品牌词、竞品词、review、alternative、vs、worth it、problem 这些搜索场景里,Reddit 已经出现了哪些讨论。可以在 Google 里加上 reddit 或者 site:reddit.com 搜索,也可以直接用 Reddit 站内搜索。
| 搜索场景 | 示例查询 | 能看到什么 |
|---|---|---|
| 品牌词 | brandname reddit |
用户对品牌的整体印象,有没有集中的投诉 |
| 竞品词 | competitor reddit |
竞品被夸和被骂的地方 |
| review | brandname review reddit |
真实的使用体验、使用时长、使用场景 |
| alternative | competitor alternative reddit |
用户为什么想换,最后换成了什么 |
| vs | brandname vs competitor reddit |
用户比较时最看重的指标 |
| worth it | is brandname worth it reddit |
价格异议和购买犹豫的原因 |
| problem | brandname problem reddit |
质量问题、售后问题、使用误区 |
然后在 ChatGPT、Perplexity 和 Google AI 模式里问同样的问题,看 AI 回答引用了哪些 Reddit 帖子,又是怎样描述你的品牌的。Peec AI 的建议也是先查自己行业里 AI 最常引用的来源,因为总榜不一定适用于你的行业。
第二步:把讨论拆成用户真实关心的问题
读讨论时,记下原话、帖子链接、点赞数和发帖时间。然后按主题归类,例如尺码偏大、电池续航、退货流程、和某个竞品的价格差。每一类整理成一个用户问题,并标注它出现的频率。
点赞多的评论代表很多用户认同这个看法,而且排在讨论的前面,读者和 AI 都更容易读到。所以,高赞的负面评价要优先处理。
第三步:反哺官网内容、FAQ、对比页、产品页和客服素材
把整理好的问题分别交给对应的页面:
- 官网内容:用户反复问的使用方法和选购问题,写成指南类文章。
- FAQ:退货、物流、保修这类有明确答案的问题,每个问题写一个简短、完整的答案。
- 对比页:用户在 vs 和 alternative 讨论里关心的指标,做成对比表。对比要写清楚自己不如竞品的地方。
- 产品页:把用户常问的规格、尺码、适用场景写进产品描述。
- 客服素材:把高频投诉和对应的处理方法交给客服团队,统一回答。
这样做以后,AI 系统在 Reddit 上读到一个问题,在品牌官网上也能找到一个清楚的答案。两边的信息一致,AI 描述品牌时就更准确。
第四步:用透明身份参与
如果品牌要参与 Reddit,应该尽量用透明身份去回答问题、解释产品、承认限制、补充资料。不要伪装成普通用户硬推链接。具体做法包括:
- 用品牌官方账号,或者在员工账号的简介和回复里写明“我在某品牌工作”。
- 先读社区规则,确认社区是否允许品牌参与、是否允许贴链接。
- 回答具体问题,例如解释某个功能的原理、说明退货流程。只在链接能补充信息时才贴链接。
- 承认产品的限制,例如“这款不适合大码用户”“这个问题我们在下一批货里修正了”。
- 处理投诉时给出具体的解决办法,不删帖、不刷屏、不用小号反驳。
透明参与的效果比批量发帖慢。但是,用公开身份留下的回答不容易被反垃圾系统当成垃圾内容删除,也不会给品牌带来被曝光“刷水军”的风险。
对你意味着什么
GEO 的重点正在从“制造提及”(mention)转向积累可信的第三方语境。AI 系统引用 Reddit,是因为 Reddit 上有真实用户的讨论。如果这些讨论是品牌自己制造的,Reddit 的反垃圾系统会删掉一部分,用户会点踩一部分,剩下的部分也会降低 Reddit 作为信源的可信度。
Reddit 这次公布的数据提醒所有做 AI 搜索优化的人:AI 时代的第三方信任源会越来越重要,但是越重要的平台,越不适合用低成本的批量做法去污染。
具体可以按下面的清单执行:
- 用上面的 7 类查询,每个季度查一次品牌和竞品在 Reddit 上的讨论。
- 在 ChatGPT、Perplexity 和 Google AI 模式里问同样的问题,记录 AI 引用了哪些帖子。
- 把讨论里的高频问题和高赞负面评价整理成清单,分给官网内容、FAQ、对比页、产品页和客服。
- 品牌参与 Reddit 时,用官方账号或者标明身份的员工账号,遵守社区规则。
- 停止批量注册账号、批量发帖、刷票和伪装用户的做法。面向美国市场时,还要考虑 FTC 规则的法律风险。
- 不要只押注 Reddit。YouTube、LinkedIn、点评网站和行业论坛也在 AI 引用来源的前列。
附录:证据清单
| 判断 | 来源 | 日期 |
|---|---|---|
| 每天拦截 2300 万次垃圾内容浏览,每天新抓到约 2.5 万条垃圾帖子和评论 | Reddit 官方文章 | 2026-07-06 |
| 过去三个月每天撤销近 200 万个虚假投票 | 同上 | 2026-07-06 |
| 2026 年 1–3 月用户接触垃圾内容的比例环比下降约 20%,接触垃圾账号的整体比例另降 10%~15% | 同上 | 2026-07-06 |
| 注册时检查可疑信号,用 LLM 识别协同行为和虚假热度 | 同上 | 2026-07-06 |
| 三层防线:平台、社区(Reputation Filter、Crowd Control、Ban-Evasion Detection)、用户投票 | 同上 | 2026-07-06 |
| 仇恨和暴力内容处理时间缩短到 5 秒以内,处理量增加 200% 以上,接触比例和误删比例都下降 40% 以上 | 同上 | 2026-07-06 |
| 行为可疑的账号要验证真人,可用通行密钥 | 9to5Mac 对 Reddit 公告的报道 | 2026-03-25 |
| Reddit 全站规则禁止垃圾内容、内容操纵和欺骗性冒充 | Reddit Rules 第 2 条、第 5 条 | 当前版本 |
| OpenAI 通过 Data API 获取实时、结构化的 Reddit 内容,用于 ChatGPT 和新产品 | OpenAI 官方公告 | 2024-05-16 |
| Google 通过 Data API 获取 Reddit 公开帖子和评论,用于展示内容、改进产品和训练模型 | Reddit 官方公告 | 2024-02-22 |
| 3000 万条 AI 引用来源中,Reddit 被引用最多,在 5 个平台上都排第一或第二 | Peec AI 研究,Search Engine Land 报道 | 2026-03-31 |
| FTC 禁止虚假评论、AI 生成的虚假评论和未披露关系的内部人员评论 | FTC 新闻稿,16 CFR Part 465 | 2024-08-14 |
参考来源
- Reddit 官方:How We’re Keeping Reddit Real and Safe in the AI Era
- OpenAI 官方:OpenAI and Reddit Partnership
- Reddit 官方:Expanding our Partnership with Google
- Search Engine Land:AI search engines cite Reddit, YouTube, and LinkedIn most: Study
- Peec AI:Top domains cited by AI search: Analysis based on 30M sources
- 9to5Mac:Reddit will soon make ‘fishy’ accounts verify their humanity
- Reddit:Reddit Rules
- FTC:Federal Trade Commission Announces Final Rule Banning Fake Reviews and Testimonials
Reddit 每天拦截 2300 万次垃圾曝光:AI 搜索时代的 Reddit 水军越来越难做

