BT财经

境内金融信息服务备案编号:

【京金信备(2021)5号】

2026年09月18日

注册 / 登录

高管内部承认"偷新闻""抢流量"——AI巨头的两副面孔

一批此前被标记为机密的微软OpenAI内部文件正式向公众公开,其中记录的高管对话和技术评估报告揭示了一个在法律诉讼爆发之前就已存在的事实:AI巨头高层清楚知道大模型训练正在如何蚕食传统媒体的流量入口。这不仅让纽约时报对微软提起的巨额版权诉讼获得了坚实的证据支撑,也直接戳破了科技行业多年来维持的一种业务辩解。

这些文件显示,早在ChatGPT横扫全球社交媒体、成为现象级消费产品时,公司内部的技术讨论就直指一个尖锐的商业矛盾:用海量新闻内容训练出来的聊天机器人,正在系统性取代人们主动访问新闻网站的原始动机。

"毁灭循环"的底层推演

这批泄密文件中最为刺眼的记录来自微软应用科学部门主管布伦特·赫希(Brent Hecht)。他在两份内部备忘录中对大规模抓取新闻用于AI基础语料库的做法做出了极为严厉的经济定性。

赫希在其中一份报告中将这种数据采集行为描述为"人类历史上规模最大的劳动力盗窃",并公开质疑这种做法与公司对外一贯标榜的"合理使用(Fair Use)"法律理念存在根本悖论。另一份技术评估则首次提出了完整的"毁灭循环(Doom Loop)"概念框架:当AI聊天机器人能够直接向用户汇总提供各类资讯时,用户便不再愿意点击原始新闻报道链接 → 新闻网站随之丧失展示广告位带来的核心收入 → 媒体被迫压缩采编团队规模、降低高质量报道的产出频率 → AI系统后续的训练数据质量进一步劣化且获取成本剧增。

在探讨如何规避外部版权追踪时,赫希还记录了公司的内部应对思路:开发特定的过滤机制来彻底隐藏训练数据的来源特征轨迹。文件原文措辞相当决绝,其目的是为了迫使受影响的版权方"更难了解哪些具体内容被用于了模型训练"。这两条记录加在一起,构成了原告方在法庭上指控科技巨头具备主观侵权意图的最核心论据。

尽管微软随后发表标准化声明,强调赫希的备忘录仅代表其个人学术研究观点,并不构成法律层面的企业决策依据,但这无法掩盖其在商业竞争中试图以最低成本攫取高价值内容的现实导向。

"没有充分理由"再去点开链接

相较于工程部门主管的风险担忧,负责实际产品迭代的一线开发团队展现出了更为直观甚至冷酷的商业认知。

文件披露,时任负责ChatGPT日常运营管理的尼克·特德利(Nick Tudley)在与内部架构团队会议中坦言,大量使用新闻语料训练商业大模型并借此替代传统新闻机构的分发渠道,将对主流出版商造成"生存性威胁"。他的判断并非凭空臆测,而是建立在对终端用户行为的精确观察之上:当一个高度自动化的交互窗口已经能够提供即时精准的答案时,受众确实"没有充分理由"再次投入时间去阅读冗长的原始调查报道,他认为当下的AI生成输出在功能体验上"基本上具有完全的替代性"。

这一表态之所以极具杀伤力,是因为它剥离了所有公关辞令,直指信息分发算法改变下的注意力资产转移。当AI牢牢掌握了知识的摘要权和对话入口,传统媒体依靠网页浏览量生存的商业模式必然遭遇结构性的瓦解。

CEO纳德拉在法庭上的正面确认

到了2026年公开的法庭听证环节,这种产品层面的认知正式升级为了具有法律强制力的书面证言。微软首席执行官萨蒂亚·纳德拉在向纽约时报版权案的联合法庭接受交叉质询时,明确承认大型语言模型通过直接分发生成式信息,确实在实质意义上"从新闻网站那里拿走了点击量"。

这是现任科技帝国最高掌舵人首次在严肃的司法程序中直面这一问题。不同于过往多以技术创新突破或技术中立为由的模糊回应,纳德拉的证词标志着硅谷顶级巨头在知识产权合规风暴面前的策略妥协。结合此前泄露的内部技术文档与产品路线图,一条从底层算法训练初衷到商业化流量变现路径,再到面临实质性司法反噬的逻辑闭环已然彻底形成。

关于此次事件引发的流量结构重塑幅度,公开材料指出部分涉案的主流新闻平台后台数据显示,其依赖搜索引擎与自然推荐引流的每日点击率出现了83%至93%的断崖式下滑,另一些中型媒体的相关指标跌幅在51%至94%之间剧烈震荡。必须严格区分的是,上述百分比主要源自科技企业内部的业务监测报表而非第三方金融审计机构,且具体的抽样基数与统计周期尚未在庭审质证中被完全展开还原,因此在严谨的投资视角下,这些数字更多呈现为一种警示性的宏观趋势预期,而非绝对的量化定论。

沉默素材的重新定价

这场风波的本质,是过去二十五年互联网生态中最核心的生产资料——具备公信力的原创深度报道,突然被赋予了极高的算力消耗成本。

长期以来,北美科技初创企业习惯于以自动化网络爬虫抓取全网公开数据的方式低成本完成初始神经网络参数的迭代,这是一种堪称完美的零边际增长红利。但是现在,这块长期存在于监管真空期的"灰色地带"正在被强力挤压。如果法院最终裁定未经许可的大规模语料抓取构成恶意侵权并判处巨额惩罚性赔偿,不仅意味着头部科技企业的数据合规开支将呈指数级膨胀,也会立刻倒逼整个生成式人工智能产业重构其供应链结算体系。

目前,围绕高质量新闻语料的专项版权交易已在局部垂直市场率先跑通。《纽约时报》与谷歌签署了总额高达六千万美元的独家多年期数据授权协议,知名商业资讯平台Axios更是早早完成了与OpenAI旗下核心模型的排他性内容合作。这种从无偿掠夺向付费采买的模式切换,就像一块投石问路的行业试金石,其最终落地的判赔数额将直接决定未来五到十年间数字经济顶层利润空间的切割比例。

接下来看什么

对于普通读者、产业分析师和投资者而言,这场博弈留下的具体商业痕迹主要体现在以下几个关键维度: 第一,传统纸媒付费墙订阅收入的增速是否会进一步加快。面对广告库存被AI助手截流的双重重压,老牌媒体能否真正建立起稳固的用户直连变现护城河。 第二,微软及OpenAI在未来的季度财报中,是否会新增长期稳定的数据授权类经常性支出(ARR)。一旦全行业铺开正版化买断计划,这将是显著拉升科技巨头运营杠杆的成本黑洞。 第三,华盛顿及各州立法机构针对现行版权法中"合理使用"边界条款的司法解释走向。未来的数字产权法案会不会专门为机器学习训练开辟出明确的法定豁免隔离带。 第四,缺乏资本加持的中小型独立新闻机构的生死状态。在这场优质信息源加速向大型闭源科技集团集中的残酷洗牌中,弱势媒体由于不具备平等的商业议价能力,极有可能遭受新一轮的合并与清退潮。



版权声明:本文版权归BT财经所有,未经允许任何单位或个人不得转载,复制或以任何其他方式使用本文全部或部分,侵权必究。
帮助中心
联系我们
联系我们

 

商务合作:

 

公司地址

北京市丰台区汉威国际广场一区一号楼629

 

 

商务合作

周先生

Tel: +86-17743514315

Email: info@btimes.com.cn

官方微信公众号

北京领讯时代信息技术有限公司 | Copyright ©️ 2026 财经时报 版权所有 京ICP备19043396号-7

京公网安备 11010602007380号 | 境内金融信息服务备案编号:京金信备(2021)5号

网信算备110106674807801230011号


声明:未经授权,不得复制、转载或以其他方式使用本网站的内容。BT财经尽最大努力确保数据准确,但不保证数据绝对正确。