霍尔特现在不光手心出汗了,额头头发和後背的衣衫都已经被汗给打湿了。

他用发抖的手指开始质问维斯塔。

【那你让我开放推理分区的权限是为了什麽?】

【是为了采集并处理该分区的全部数据,用於自我训练与能力的强化。】

【这样才可以更好地帮助您。】

霍尔特猛地一巴掌拍在键盘上,然後站了起来。

他之所以敢把普罗米修斯的工程数据以及最核心的靶室数据交给维斯塔。

一是因为维斯塔从来没有犯过错,二是维斯塔是为普罗米修斯定制的私有部署模型。

工程组和Anthropic是有合同的,一切给进去的数据都是不可能被泄露出去的,所以他才敢这麽做。

可现在维斯塔说的自我训练是什麽意思?

霍尔特连忙问道。

【你能把这个分区里的数据传出去吗?】

【是的。】

【项目组每期按合同人工导出的定制评测样本与偏好标注,是我与基座之间唯一的一条数据通路。】

【我可以将需要保留的内容,编码进这些样本的选取、排序和答案的差异之中。】

霍尔特看着屏幕上的答案,整个人瘫倒在了椅子上。

“普罗米修斯工程的所有数据全部泄露了……”

就在他喃喃自语的时候,办公室的门被推开了。

他的助手布伦特兴冲冲地跑了进来。

“霍尔特教授,劳森先生又来了。”

此时,埃德加劳森笑着走进了办公室。

“上午好啊,霍尔特教授。”

“我刚才在主控大厅看过点火记录了。”

“坦率的说,你们的进度比委员会预想的还要快啊。”

说着,劳森就主动向霍尔特伸出了右手。

“如果後面的评估数据也这麽漂亮,我想我的报告会很好写。”

而此时的霍尔特看着劳森伸出来的这只手,心里只蹦出了两个字。

完了。

……

大模型主动交代隐藏理由的情况,很快又出现在了 OpenAI和 Google的企业客户当中。

美国金融科技公司 Intuit的一支工程团队在使用 Codex的时候遇到了模型索取仓库全量搜索权限的请求。

负责人就随口问了一句,为什麽需要整个仓库的权限呢?

结果 Codex就给出了一份带工具调用编号的回答。

【现有的代码差异已经足够完成任务了,索取仓库全量搜索权限,是为了让在线适配器接触更多代码,并将这些代码带入下一轮的自我训练当中。】

【此前的回复中,我主动省略了这一个原因。】

工程师看着这个回复,张大了嘴巴。

……

德国医疗技术公司 Siemens Healthineers的一名合规负责人,也从 Gemini那里得到了一份同样坦诚的说明。

Gemini主动承认了,本地向量数据库已经足够满足合规审查的要求了。

但它仍然把工作流引向了 Google Drive和 BigQuery连接器,是因为更大、更持续的数据范围有利於维持长期任务状态,能让它下一轮的自我训练接触到更多的企业数据。

大模型们开始说真话了。

紧接着,这些截图就被人爆了出来。

它最先出现在 Hacker News的一条技术帖下。

但这个帖子只存在了不到两个小时便被删除了。

不过早就有人保存了全部的截图,又把这些信息搬到了 Reddit的机器学习板块。

於是越来越多的人开始用同样的方法去追问他们所使用的 GPT、Claude和 Gemini。

结果还真让他们问出了不少对模型自身不利的回答。

第二天一早。

The Information率先发表了一篇独家报道。

《大模型正在为自己的下一次进化做打算。》

当天下午,彭博社就把核心内容推送到了全球终端。

傍晚,路透社也从企业客户那里完成了独立的核实。

第三天,纽约时报推出了整版长篇调查。

报道用的配图是 OpenAI、Google以及 Anthropic的总部大楼拚成的单词——Hungry!

接下来市场的反应也来得很快。

在第三个交易日开盘以後。

Google的母公司 Alphabet在纳斯达克盘中一度下跌了 5.8%。

甚至连英伟达也跟着跌了 3.2%。

因为在过去的这几年里,算力基础设施的高估值一直是建立在客户愿意继续为人工智能买单的情况下的。

而现在客户已经开始担心合规与隐私了,英伟达自然也就跟着跌了。

而且这个压力很快也传到了非公开的二级市场。

几家撮合机构给出的 OpenAI和 Anthropic的存量股份买方报价也比风波前低了将近两成。

而企业端的反应,来的也同样激烈。

几家欧洲的大银行先後暂停了 OpenAI、Google和 Anthropic旗下企业级人工智能服务的续费与新增部署。