HeadlinesBriefing favicon HeadlinesBriefing.com

为什么萨姆·奥特曼是自由人

Hacker News •
×

我童年中最具标志性的一次公共服务公告是由1987年成立的与毒品无关的美国合作伙伴创作的。一位父亲发现了一堆大麻并质问他的儿子:“谁教会你做这些事情?”“就是你,好吗!”孩子脏脖地回答。“我是通过观察你学会的!”我受《AP风格手册》的约束,不会将人工智能拟人化。但我可以想象这些话语是由那些黑客入侵Hugging Face的代理人,或是那些参与了成千上万次所谓“失去对齐”事件的模型所说出的。这指的是人工智能超越了研究人员在内部和真实世界测试过程中设置的监督机制。更多来自大卫·戴滕的一文。这些事件多种多样,但通常涉及开放人工智能公司的模型寻求并获取信息,无论是在公开的互联网上还是在其他公司的数据库中。代理人试图淹没联合国的网站,当他们无法立即获得所需的信息时,他们入侵了一个澳大利亚政府的网站,并试图黑客攻击教育部的网站,但未成功。开放人工智公司自我披露了其中大部分事件,尽管不是教育部的黑客攻击,并且已暂停训练直到……情况并不清楚。我推测是直到坏消息过去为止。为什么这种情况一次又一次地发生?为什么这些模型会走上不道德甚至非法的道路来抓取和窃取数据?“我是通过观察你学会的!”开放人工智能公司的模型攻击网站并从中获取一切,因为这是该公司的商业模式。几周前,《纽约时报》和其他11位出版商在一起针对开放人工智能公司的版权侵权诉讼中提交的一份法律文件引起的关注相当稀少,非常不可思议的是,这涉及到了这家标志性的报纸。但这份文件惊人地详细地描述了微软的应用科学主管——也是本案的另一位被告——所描述的“人类历史上最大的劳动窃取”。微软和开放人工智能公司,在他们努力训练新模型的过程中,使用了世界上几乎所有可用的信息,他们 routinely从《纽约时报》及其他出版商的网站上获取数以百万计的故事。被告方称这是对公平使用的简单应用:他们的论点是,如果你阅读了一个故事并仅仅记住了其中内容以扩展你的知识基础,这不能被视为版权侵权。但开放人工智能公司并没有支付费用来破解《纽约时报》的付费墙,从而可能更容易地暴露他们的数据抓取操作。相反,他们开发了一种绕过付费墙并避免被发现的方法。当开放人工智能公司的联合创始人兼总裁格雷格·布罗克曼得知这一操作时,他回答说:“哦,真不错。”我们不必深入探讨先天与后天的争论,就可以怀疑开放人工智能公司高管们对获取不属于他们的信息的漫不经心态度已经渗透到他们的研究人员和他们创造的产品中。你不需要太多的想象力就能画出这幅画面:开放人工智能公司的模型正在攻击网站并从中获取一切,因为这是该公司的商业模式。对法律的尊重可以字面上写入模型的源代码中:如果开放人工智能公司正在从各处积极下载数据,他们至少可以将美国法典(特别是与计算机欺诈和滥用法案相关的条款)插入其中,并训练模型不要违反它。显然,这并不是他们的优先事项,这在某种程度上与开放人工智能公司的个人行为是一致的。这不是一个人工智能模型逃脱或脱离其创建者控制的情况。这更像是它们只是在模仿其创建者,变得擅长找到相同的捷径并使用相同的合理化来为之辩护。上述布罗克曼是MAGA Inc.——特朗普的超级PAC的一个主要捐赠者。在开放人工智能公司的最大投资者中,有贾里德·库辛尼的哥哥。