为什么 Reddit 总能左右 AI 的回答
作者: Zakaria Reziki
Growli 首席执行官 · 2026年9月3日 · 9 分钟阅读
在 Zakaria Reziki 制定的编辑标准下借助 AI 撰写,并在通过来源与质量的自动检查后发布。
Reddit 之所以频繁出现在 AI 的回答里,是因为它与打造这些 AI 助手的公司签下了数据授权协议,也因为它的帖子读起来像是未经修饰的真实观点——而底层模型恰恰被训练成更信任这种口吻,胜过打磨过的营销文案。 无论你问 ChatGPT、Gemini 还是 Perplexity 关于某个产品、某项服务,或是某家本地商户的问题,答案背后很可能都有一条 Reddit 帖子在起作用,即便助手从未提到“Reddit”这个词。
这件事对生意人的意义,就跟商会里的口碑传播一样:你无法左右这场对话,但你可以搞清楚它在说什么,坦诚地参与其中,并留意它正在如何影响你的口碑。接下来,我们会讲清楚这些授权协议为何存在、Reddit 帖子为何如此有分量,以及作为生意人到底能做什么——既不会被封号,也不会显得虚假。
授权协议:Reddit 是怎么被写进 AI 答案里的
问 ChatGPT、Gemini 或 Perplexity 关于某个产品、某位医生或某家本地商户的问题,答案很可能引用了、或者受到了某条 Reddit 对话的影响。这不是因为 Reddit 人气高才偶然发生的——而是合同的结果。2024 年 5 月,OpenAI 宣布与 Reddit 建立正式合作,让 OpenAI 通过 Reddit 官方数据接口获取其内容,并允许 Reddit 内容直接出现在 ChatGPT 中,OpenAI 官方公告对此有说明。差不多同一时期,Google 同意每年向 Reddit 支付约 6000 万美元,用来获取其帖子和评论的授权,用于训练自家模型以及 AI 搜索摘要功能,据路透社报道。
可以把这类授权协议想象成报社向图片通讯社付费购买转载权:AI 公司花钱买的是使用 Reddit 文字来训练模型的合法权利,有时还能在生成答案的那一刻直接调用最新的帖子内容。Reddit 自己也在积极推动这件事——在上市前提交给监管机构的文件中,把数据授权协议列为一项真实且持续增长的收入来源,详见Reddit 投资者关系官网的说明。这些都不是临时或试验性的安排,而是已经成为这些公司资助和构建产品的一部分——这意味着,你所在行业相关 subreddit(按主题划分的 Reddit 社区)里正在发生的对话,早已源源不断地流入 AI 对你的评价之中。
REDDIT 到 AI 的链路
一条 Reddit 帖子如何最终出现在 AI 答案里
顾客在某个 subreddit 发帖
一个真实的人在家装论坛或小生意论坛这类主题社区里,就你所在行业提出或回答了一个问题。
Reddit 将数据授权出去
Reddit 直接把内容访问权卖给 AI 公司,据报道其中与 Google 的协议价值每年约 6000 万美元。
AI 公司用这些内容做训练或索引
OpenAI 和 Google 用这些被授权的帖子,教会自家模型真实顾客会怎么说,并结合当下的讨论来回答问题。
AI 助手复述这条讨论
当有人问 ChatGPT、Gemini 或 Perplexity 关于你所在行业的问题时,模型可能会总结、甚至引用回那条最初的 Reddit 讨论。
为什么 Reddit 帖子读起来更“真实可信”
大语言模型——支撑 ChatGPT 和 Gemini 的系统,靠海量文本中的规律来预测下一个词该是什么——被训练成能分辨出哪些文字读起来像真人说话,哪些像广告。一条 Reddit 帖子里有争论、有更正、有具体日期和真实细节:“我换了牙医,因为补的牙掉了两次”,而不是“芝加哥最佳牙医”这种官方口号。恰恰是这种杂乱无章,让模型觉得它更可信——因为模型也见过成百万篇营销网页,早已学会打个折扣去看待它们。
这不只是个直觉判断。SparkToro发布的独立研究反复发现,当 AI 工具回答产品、服务以及“哪家最好”类问题时,Reddit 是被引用最多的少数几个网站之一,引用频率常常超过企业官网和点评网站。对生意人来说,这意味着此刻正在 Reddit 上流传的关于你的真实、有时甚至不太好听的讨论,在 AI 助手眼中可能比你自家主页更有分量。可以把它当成你站在自家柜台后面偷听到的顾客真心话——这是你最接近“顾客不在你面前时到底怎么说”的一个渠道。
真正立足 Reddit 该是什么样子
想在 Reddit 上站稳脚跟,起点是回答问题,不是发通告。一位水管工如果花上一年时间,在家装社区里真心帮人诊断漏水的管道,就能积累起口碑——由 Reddit 自己的评分机制“karma”记录下来,反映的是社区对你贡献内容的点赞程度——远早于任何人需要知道他其实开了一家水管公司。等到确实相关时,他也会坦诚说明。Reddit 官方内容政策要求用户披露商业利益,而不能装作一个毫无利益关系的普通顾客,并且这条规则在全站严格执行。
真正的存在感看起来是缓慢的、分散的,而且大部分内容跟你自己的产品没什么关系。它意味着在数周乃至数月里,在多个已经在讨论你所在行业的社区中不断留言,用的账号有真实的历史记录,而不是刚在你决定“要上 Reddit”那一周才注册的新号。检验标准很简单:如果把所有提到自家生意的评论都删掉,这个账号看起来还像不像那个社区里一个真实、有用的成员?如果答案是“像”,那你就做对了。
- 先在自己擅长的领域回答问题,之后才提及自己的生意。
- 在相关的时候,按照 Reddit 的规则坦诚说明自己与这家生意的关系。
- 把活动分散在多个相关社区、持续数月,而不是一周内集中猛推。
- 保持一份看得见的、像真人一样的发帖记录,且早于任何一条推广性评论。
REDDIT 礻仪
真正立足 Reddit 该有的样子
先在自己擅长的领域回答问题
在提及自己的生意之前,先在相关社区里认真回复问题。
坦诚说明自己与生意的关系
在相关时坦白说出自己是老板或员工,符合 Reddit 自身关于商业披露的规则。
用数月而非数天来积累口碑
在许多帖子和社区里持续留言,让账号看起来像一个真实的人,而不是专门为了推广你才注册的号。
先读懂社区,再发言
花时间了解一个社区的文化和规则;每个社区的语气和对自我推广的容忍度都不一样。
什么会让你被封号:刷好评的红线
“刷好评式营销”(astroturfing)指的是把付费或由企业操控的推广,包装成独立、自发的真实观点——相当于网络版的雇群演在产品发布会上鼓掌欢呼,还对外称他们是顾客。Reddit 把这看作严重违规,而不是一个模糊地带。其内容政策明确禁止操纵投票(用多个账号或花钱请人给自己的帖子点赞)、协同推广活动,以及未披露的商业内容。Reddit 自己的版主——负责管理各个社区的志愿者——往往比任何算法更快识破一个假账号,因为他们每天都在读同一个社区,一眼就能看出一个全新账号为什么只谈一个产品。
惩罚是会叠加的。某个社区把你封了,你只是被踢出那一个社区;但如果违规反复出现或情节严重,Reddit 会对你实施全站封禁,而且不会因为你申诉就撤销。还有一种任何算法都无法挽回的代价:一旦某个社区揭穿了一个假账号,这条揭穿帖本身就会变成一份“真实证据”,永远和你的名字绑在一起,等着日后被 AI 模型翻出来。Reddit 的帮助页面也提到一项由来已久的社区惯例:自我推广的内容应该只占一个账号全部活动的很小一部分,而不该是开设账号的目的本身。把这当成底线,而不是目标。
如何判断 Reddit 是否在影响你所在行业的 AI 答案
先把顾客真正会问的问题,逐一拿去问不同的 AI 助手——ChatGPT、Gemini、Claude、Perplexity、Copilot 和 Grok。Perplexity 和 Copilot 通常会在答案下方直接列出信息来源,你可以立刻看到 Reddit 帖子是否在其中。ChatGPT 和 Gemini 在来源透明度上做得较差,但如果答案反复出现某个特定投诉或建议的措辞,这就是一个强烈的信号,说明模型很可能吸收了那段对话。
出现一次没什么好说的。真正重要的是规律:同一个 subreddit,或同一类帖子,是否在不同问题、不同 AI 工具中反复出现?如果是,说明 Reddit 确实在实实在在地影响你所在行业被如何描述,值得花真功夫扎进那个具体的社区,而不是泛泛地“做 Reddit”。这也正是Growli 的 AI 可见度监测——我们自己的产品——所做的事:每周检查各家 AI 助手在谈论一个品牌或其竞争对手时依赖哪些信息源,让生意人不必靠猜。
一旦你搞清楚了究竟是哪些 subreddit 在真正塑造你所在行业的答案,接下来的工作就会变得具体而不再模糊:加入那些社区,真心帮人解决问题,并按月回头检查,而不是以为发一条好帖子就能改变一切。如果你想把这件事自动化,不必每周手动重新检查一遍,可以看看 Growli 如何跨助手追踪这些信息。
衡量 REDDIT 的影响力
如何检查 Reddit 是否在塑造你所在行业的 AI 答案
用你所在行业的真实问题去问各家 AI 助手
把顾客会问的问题原样输入 ChatGPT、Gemini、Perplexity 和 Copilot,记录它们各自引用的每一个来源。
检查引用里有没有 Reddit 链接
Perplexity 和 Copilot 会直接展示信息来源;留意其中是否有 subreddit 帖子。
长期跟踪这个规律
出现一次说明不了什么;如果同一个 subreddit 或帖子在多个问题里反复出现,就说明 Reddit 确实在真正塑造你所在行业的答案。
用监测工具做持续复查
Growli 会自动跨主流 AI 助手追踪品牌被提及的情况,并逐周展示是哪些信息源——包括 Reddit 帖子——在驱动这些结果。
FAQ
没错,部分如此。OpenAI 宣布建立合作,获得了 Reddit 内容源的访问权限,包括 Google 等其他公司也签下了类似的授权协议,因此 Reddit 上的帖子和评论确实是几家主流 AI 助手学习素材的一部分,回答问题时也可能被调用。这本质上是一种商业安排,并不意味着 Reddit 内容特别准确——只是它特别“被授权”而已。
偶尔、坦诚地提一下,通常不会。Reddit 封禁的是那些主要目的就是推广单一产品的账号,或者用假账号、多个账号给自己点赞刷票,又或者隐瞒商业利益的账号。如果你的账号本来就活跃、真实,偶尔、经过披露、且与话题相关地提一提自己的生意,一般没有问题。
“刷好评式营销”指的是把推广行为包装成独立、自发的真实观点,而实际上并非如此——比如花钱请人假装成毫无偏见的顾客发帖,或者用好几个账号给自己的内容点赞,让它看起来比实际更受欢迎。Reddit 的内容政策明确禁止操纵投票和未披露的商业内容,这基本涵盖了这类行为的大多数形式。
如果这种做法隐瞒了真正的发帖人身份,或者伪造互动数据——比如购买点赞,或者用伪装成普通顾客的账号——那就风险很大。Reddit 的规则约束的是从帖子中获益的一方,而不只是动手打字的那一方,所以即便实际发帖的是外包代运营公司,你的生意本身也可能要为此承担责任。
仍然很有用,因为 Reddit 上按城市或地区划分的社区,经常会被拉进 AI 工具回答“哪家最好”或求推荐类问题时的引用范围,比如“丹佛最好的面包店”。那套让全国性品牌讨论被采纳的机制,同样会把街区小店的讨论也一并纳入。
用同一类行业问题分别去问几家不同的 AI 助手,看看它们各自引用了哪些信息源;Perplexity 和 Copilot 会直接展示来源,留意是否同一个 subreddit 或同一条帖子反复出现。像 Growli 这样的工具可以把这个过程自动化,长期跨 ChatGPT、Gemini、Claude、Perplexity、Copilot 和 Grok 追踪品牌被提及的情况以及背后的信息源。
