AI正在把互联网拖进一个死循环,这个坑谁也躲不开

AI正在把互联网拖进一个死循环,这个坑谁也躲不开

九月 21, 2026 ai ethics copyright openai microsoft web ecosystem content creators llm doom loop digital publishing tech regulation

AI"末日循环"这个让人不舒服的真相,以及它对互联网未来的意义

互联网一直遵循着一个不成文的约定:创作者产出内容,平台负责索引,用户负责消费,大家各取所需。搜索引擎给出版商带去流量,链接被点击访问。这套系统虽然不完美,但至少让数百万独立创作者、新闻媒体和中小企业能够维持运营。

但是——如果有一天,那个中间商突然说:"不好意思,我不需要再把你送到任何地方去了呢?"

这才是让人头疼的核心问题。也是纽约时报起诉 OpenAI 和微软的案件中,最近公开的法庭文件所揭示的关键。

他们心知肚明。这才是让人最难受的地方。

最让人震惊的,并不是 AI 训练可能侵犯版权,也不是大语言模型和原始材料之间有什么复杂的纠葛。最让人震惊的是——这些公司早就知道自己在干什么。

微软内部的文档清清楚楚写着,他们的 AI 内容策略就是要搞出一个"末日循环",最终会"同时损害我们模型的性能以及整个互联网"。他们自己都承认,自家产品威胁到了"必要供应商的经济基础"——也就是让这些系统得以运转的内容供应链。

换句话说:他们看到悬崖了,然后把车对准那个方向,踩着油门就冲过去了。

微软应用科学总监 Brent Hecht 更是直白,在内部沟通里把这种数据采集行为称为"人类历史上最大规模的劳动盗窃",还说微软的法律辩护"把合理使用的概念变成了彻底的笑话"。

当然,微软后来试图和他划清界限,说这只是"某个员工的个人看法"。但问题是,你自家内部文件说的基本上也是同一回事,这种区分就显得很苍白了。

没人愿意谈的供应链问题

这里有个根本性的矛盾,藏在现代 AI 发展的核心:大语言模型需要海量人类创作的内容才能运转。但问题是,这些模型本身就是为了消灭人类直接访问那些内容的需要而设计的。

微软自己的文档都承认了这个悖论。大语言模型用他们的话说,就是"一款会摧毁自身供应链的产品",因为它们替代的恰恰是让自己变得有用的训练数据。

好好想想这意味着什么。每次 ChatGPT 或者 Copilot 直接回答一个问题,而不是把你导向原始来源,就少了一个可能的读者。广告收入就没了。这个创作者可能就会想,做内容这事到底还值不值得。

然后呢?当井水枯竭了——当越来越少的人去创作那些值得学习的东西——那些用这些内容训练出来的模型会变成什么样?

数据很残酷

OpenAI 自己的分析师估算,由于 AI 摘要和聊天机器人把用户留在平台上,出版商从搜索引擎获得的推荐流量可能已经下降了 60%。Google Zero——也就是网站完全收不到 Google 搜索流量——已经从理论上的担忧变成了很多出版商切切实实正在经历的噩梦。

Satya Nadella 本人在证词中也承认,聊天机器人"基本上已经取代了搜索,消除了人们直接去源头获取信息的必要"。这不是系统的漏洞,这是让这些产品对用户有价值的核心功能。

OpenAI 的 Nick Turley 据说更直白:一旦你从 ChatGPT 得到了答案,就"没有理由再点击"原始来源的链接了。

这对开发者和创业者的影响

好了,说了这么多,对你来说——作为正在构建下一代网络产品的开发者或创业者——这意味着什么?

AI 公司本质上在说:旧规则已经不适用了。人类知识的公共资源可以被采集,用来构建专有系统,而这些系统最终会取代人们访问那些知识的需求。而且他们做这些事的时候,完全清楚自己在造成损害。

这起 NYT 诉讼案的法律戏码之外,还有更深远的影响:

  1. 依赖 AI API 有风险。 如果提供这些模型的公司做着法律和道德上都存疑的事,你产品的地基可能比想象中更不稳固。

  2. 内容合作很重要。 出版商越来越不愿意让自己的内容被白嫖。法律和商业环境正在向"必须付费授权"的方向转变。

  3. 推荐流量的经济逻辑在变。 如果你做的是内容生意,别再想当然地以为搜索流量或社交分享能养活你了。AI 摘要可能在你网站接触到用户之前,就已经把问题回答完了。

  4. 开放的互联网有价值。 让互联网真正有用的那些原则——互相链接、引用来源、流量流向原始出处——才创造了让 AI 成为可能的生态系统。把这个生态系统当成取之不尽的矿产来掠夺,最终是搬起石头砸自己的脚。

讽刺程度几乎完美

整个事情最讽刺的地方在于,微软、谷歌和 OpenAI 现在正急着跟那些被他们伤害过的出版商签订内容授权协议。Nadella 本人说"任何付费内容都应该获得授权"——这个立场本来挺有说服力的,唯一的遗憾是微软的产品好几年来一直把付费内容当成训练数据的免费食材。

OpenAI 的代表在文件中承认,他们"不知道"有任何系统性的努力来检测或移除训练数据中的付费内容。所以这个号称用公开信息训练出来的 AI,似乎在区分"免费的"和"付费墙后面的"内容方面,遇到了相当大的困难。

展望未来

末日循环不再只是理论了。它正在实时发生,发生在真实的创作者身上,发生在真实的出版商身上——他们试图在一个越来越不友好的环境中维持新闻和内容创作的资金来源。

科技行业一边声称 AI 正在"民主化信息",一边同时摧毁让信息创作成为可能的经济模式——这不是创新。这只是把采掘业包装上了硅谷的词汇而已。

对于在 AI 基础上构建产品和服务的企业来说,问题不只是"我们怎么用这些工具?",而是"我们怎么构建一个不会掏空自己根基的系统?"

说到底,网络依然是源头。API 和聊天机器人只是建在上面的那一层。如果大家都认定这一层比它所依托的地基更有价值,那整个架构迟早会坍塌。

末日循环是真实存在的。这个行业是否有智慧在为时已晚之前走出来,我们拭目以待。


你怎么看?AI 行业是在创造一个不可持续的系统,还是这些担忧被夸大了?欢迎在评论区分享你的观点。

Read in other languages:

BG RU EL CS UZ TR SV FI RO PT PL NB HU NL IT FR ES DE DA EN