LLM 不是不可避免的技术
LLMs Aren't Inevitable
作者以火器和化学武器的历史类比论证 LLM 并非不可避免的技术,认为 LLM 对追求高质量输出的从业者无压倒性优势,核心瓶颈处增益有限,严肃领域终将由人工技能拉开差距。同时指出 LLM 驱动的信息污染、astroturfing 机器人和混合战是更现实的持续威胁,能否通过监管与社会抵制有效中和将决定未来竞争格局。
用火器、磁罗盘和化学武器的历史类比,拆解了 LLM 不可避免论,并给出可复用的判断技术必然性标准。
和'AI技术只是一个工具'这种说法一样常见的,是AI'不可避免'的说法,因此我们都应该放弃,跟着走就行了,因为这项技术一定会持续存在,而我们一定会把思考权交给机器。这显然是一个让人停止思考的陈词滥调,但值得再深入挖掘一下:毕竟,鉴于这种说法被如此频繁地提及,知道它到底是如何以及为何是错误的会很有价值。
一项技术是'不可避免'的这种想法很有意思:毕竟,没有人能够提前知道哪些技术会被开发出来或被社会所采用,所以你当然不能比如说可行的核聚变发电是不可避免的:那样说就太愚蠢了。同样地,事后看来,任何被广泛采用和流行的技术都可以说是不可避免的:你说iPhone的发展是'不可避免的',这并没有任何说服力,尤其因为我们实际上并不知道该技术所呈现的形态是否真的不可避免。对于某种与所述技术大致形态相符的东西,这可能是真的,但它本来可以采取任何形式,包括我们可能认为相当奇怪的许多形式。
那么,当AI的鼓吹者说到'不可避免'时,他们到底是什么意思?按照他们隐含的标准,AI的表现如何?
一项技术'不可避免'意味着什么?
一个轻率的回应是说,没有任何技术是真正不可避免的,一切都是偶然的。这有技术上正确和听起来明智的优点,但不幸的是,确实存在一些技术,一个理性的人很可能将其称为'不可避免'。枪支就是后一种情况的好例子:一旦它们被开发出来,你就会很快面临这样一种局面:如果你想在一个社会中保持独立和安全,你就必须使用它,或者让别人代表你使用它:其他选择基本上都不管用。
然而,一项技术的不可避免性并不仅仅是技术本身的因素。毕竟,中美洲文明非常了解轮子这项技术。然而,在茂密的丛林中,而且在没有现成道路网络的情况下,轮子实际上并不是特别有用:因此,中美洲文明主要依赖水上交通和驮畜,并将轮子主要用于儿童的玩具,也就不足为奇了。更明显的是,大炮作为一项军事技术的价值在欧洲要远大于中国——在欧洲,政治上的分裂导致建造了高大而薄弱的城墙以抵御敌军攀登;而在中国,主要由夯土建成的石面城墙是常态(大炮可以在前者中比在后者中更快地轰开一个缺口,尽管最终都能轰开)。
因此,一项技术的不可避免性本身是取决于社会和文化结构的东西:同一项技术在一个文化领域可能被证明是'不可避免'的,在另一个文化领域则完全无用,在第三个文化领域有用但远非'不可避免'。我们相对于特定文化的'不可避免性'标准因此大致如下。
在以下情况下,一项技术是不可避免的:
- 该技术执行某项任务的标准不低于执行同一任务的替代技术,或不显著低于后者。
- 上述任务具有社会价值:我们需要大量完成它,而目前它是由在某种意义上稀缺的人力来完成的。
- 该技术在充足产出量或产出质量方面,能够压倒性地超越其他替代技术所能做到的。仅仅是适度的改进并不足以迫使它成为必然:它必须是一种巨大的差距。
- 不使用该技术的人没有任何办法改变自身行为来抵消该技术的影响。火器在这个意义上是压倒性的,而配重投石机则不是,因为虽然在不彻底改变防御工事建造方式的情况下几乎不可能减轻火炮的影响,但可以通过渐进式的调整来削弱配重投石机的作用。
除非所有这些条件都成立,否则对某一技术的采用可以合理地被视为偶然的而非必然的:它不是一个社会群体被迫做出的选择,而是一个他们相对自由做出的选择。简而言之,必然性的技术是指,如果你不采用它们,你将迅速被采用它们的文化和社会所压倒。在我看来,这大体上与 LLM 支持者使用该术语的方式一致:LLM 技术是必然的,因为不使用它的人在实力上将远远落后于使用它的人,最终将沦为 LLM 使用者的附庸。
由此看来,我们可以相当清楚地看到火药所体现的必然性模式。大炮突破城墙的速度比配重投石机快得多,也更有效率。在一个分裂的中世纪欧洲,突破城墙具有巨大的社会价值:如果你能突破城墙,你就能攻占城市或城堡,而速度越快,你围城所需的时间就越少。大炮比其他类型的攻城武器压倒性地更强大,甚至早期的轻武器单发射击所能传递的能量也远超同等十字弓或长弓。最后,并没有什么特别容易的方法来抵消火器:很难对其进行有效的盔甲防护,虽然你可以设计出能够抵御大炮的防御工事,但所需的人力投入要求对社会进行大规模重组。因此,从实际角度来说,一旦大炮出现在欧洲,军队就发现自己处于一种必须尽快采用火器技术、否则就会被已经采用该技术的人吞并的局面。我认为,这就是我们在口语中所说的技术"必然性"的含义。
为了便于讨论,我们可以拿指南针来做对比。指南针满足前两条标准:它在寻找北方方面比观测太阳位置再进行计算要好用得多,而且即使在没有任何已知地标的情况下它也能工作。此外,知道北方在哪里对于一个海洋强国来说是相当有用的,因为它们需要能够有效地进行导航。不过,它也并非压倒性地高效:你仍然可以在没有它的情况下有效导航,而且只要对海洋活动不感兴趣,转而成为一个陆上强国,就能轻松地抵消它的用处。因此,尽管指南针让欧洲各殖民强权大幅扩展了它们的势力范围,并得以开发那些本来无法获取的资源,但俄罗斯——举例来说——无论有没有指南针,都很可能会成为一个大陆性强国并维持这一地位。这么说,指南针虽然是一项非常强大而且有用的技术,但它并不像火器那样具有必然性。
现代大语言模型是必然的吗?
那么现代人工智能(就大语言模型而言)按这些标准来衡量表现如何?
第一个问题是,大语言模型能否在不明显逊于人类完成同一任务的水准下完成工作。这一点是有争议的。客观地说,大语言模型目前绝对无法产出达到人类最高水准,甚至良好水准的作品,而且它将来或许也做不到。然而,大部分人类的工作本来就不是以良好水准完成的。往好了说是平庸,往坏了说是糟糕透顶。在各种糟糕的环境中所完成的大量人类知识工作,可悲地与大语言模型产出的大致可以互换(说真的,这么多人类的工作就是糟糕透顶:我真希望事实并非如此)。那么就这一点而言,大语言模型大概是通过了这条标准。
下一个问题是社会价值问题。大语言模型号称能替代的许多知识工作——编写软件、研究工作、平面设计等等——是稀缺且有价值的。但总体而言,大语言模型只能或多或少地替代这些工作中价值最低的部分(大语言模型能产出数量可观的尚可但平庸的代码,但只能产出最差劲的平面设计和相当粗浅的研究文档)。这意味着,当任何水平的真正质量被要求时,无论是否使用大语言模型,都仍然需要人类专家介入。那么就这个问题而言,结果是喜忧参半的:大语言模型能完成具有社会意义的工作,但仅限于一定程度,而且工作越是具有社会重要性,大语言模型能起到的作用就越小。
现在我们讨论的问题是,LLM 所带来的差异是否足够压倒性,足以使其采用变得不可避免。关于这一点,我认为答案显然是否定的。正如上文所确立的,LLM 完全无法完成顶尖的工作:在几乎任何学科的巅峰,我们仍然在很大程度上依赖未经增强的人类工作。即使在较低水平的成就上,LLM 仍然不具备压倒性的力量:即使在使用 LLM 时,确保 LLM 被正确引导并使输出足以胜任任务所需的投入,意味着输出量受到严格限制。这意味着,虽然在某些情况下使用 LLM 可能比不使用 LLM 获得更多输出,但实际的速度提升并不显著。你可能会从 LLM 增强的工作流程中获得比不使用 LLM 多出 20% 到 50% 的 PowerBI 仪表板,但这些仪表板无论如何都不太可能是你业务中的核心瓶颈,而且至少截至目前,似乎越接近这些核心瓶颈,效率提升就越少。无论如何,我不禁觉得,如果在能力上真的存在压倒性的优势,我们到目前为止肯定会看到这种迹象。至少会有一家科技公司生产的新科技产品数量是其他公司的五到十倍,并逐渐将其他公司挤出市场。但我们并没有看到这一点:事实上,我们看到的是,那些全力投入 AI 的公司反而比其他的公司更加挣扎。要得出这项技术必须不可避免地被采用这一结论,我们本应看到的那种真正压倒性的影响水平(想象一下装甲纵队穿过阿登森林,车里坐着嗑了药的国防军)……那种影响根本不存在。
最后还有一个问题,即其他人能否以相对低廉的成本采取行动来中和这项技术的影响。目前关于这一点还很少有一方面的证据,因为社会趋势需要一段时间才能显现,但在我们的社会倾向于参与的社会竞争形式中,我倾向于认为确实存在这样的手段。针对 LLM 使用以及试图将生成的劣质内容冒充为工作成果的人的社会谴责程度是巨大的,这从长远来看不可避免地会对这项技术产生负面影响。总体而言,新技术需要一定水平的社会接受度才能被采用,虽然许多技术在面对漠视或轻度厌恶时仍被采用,但很少有技术能在目前针对 LLM 的那种白热化的仇恨面前被采用。此外,我们这里谈论的并不是约翰·亨利对抗打钢机那样的故事:在实际有用的产出方面,人类仍然可以相当轻松地匹配 LLM,即使 LLM 在纯粹的数量上胜过我们。
根据这些不可避免性的标准,LLM 的表现并不理想。它们实际上只在一个标准上勉强通过,而且还不完整。此外,在将技术从仅仅有用推向真正不可避免的标准(标准 3 和 4)上,LLM 绝对未能取得任何进展。那么,无论 LLM 工具的实用性如何,很明显 LLM 本身完全属于偶然性而非不可避免性的范畴。
然而,这件事并没有结束,因为我们可以清楚地看到,LLM 正在对我们当前社会状况的诸多领域产生巨大影响。即便从上述观点来看,这项技术并非不可避免,但对许多人来说,它的确给人一种不可避免的感觉。这是为什么呢?
LLM 作为化学武器
在他的文章为什么我们不再使用化学武器了?中,Bret Devereaux 探讨了这样一个问题:为什么自第一次世界大战以来,一流的军队几乎从未在战场上使用过化学武器。令人立刻注意到的是,这基本上是真的:尽管诸如沙林、VX 和诺维乔克等威力越来越大的神经毒剂得到了发展,但这些毒剂几乎从未被大国在战场上使用过。无论是苏维埃俄罗斯还是纳粹德国在二战期间都没有使用它们,尽管这两个国家都被逼到了绝望的境地,如果化学武器真有任何效力的话,他们本很可能会使用它们。它们没有在越南或朝鲜使用过(尽管使用了表面上类似的脱叶剂),尽管有报道称俄罗斯在俄乌战争中使用了化学武器(似乎大多是作为一种形式上的暴行),但关于它们以任何严肃方式被使用并帮助俄罗斯取得战场进展的报道几乎完全缺失。鉴于这些毒剂的极端致命性,那么,可能会问这样一个问题:为什么它们没有成为我们在战争中无法避免使用的必然技术,无论其使用多么不道德。
Devereaux 对此的回答是,对于按照现代机动战原则作战的一流军队而言,化学武器的巨大杀伤力事实上并不能转化为巨大的效用。毕竟,现代机动战依赖于攻击中大量的战术机动,旨在以足够快的速度移动以孤立和扰乱抵抗,防止协同防御并导致防御部队崩溃。在这种情况下,你最不想使用的就是让你自己和敌人都无法通过大面积区域的弹药——而化学武器必然会做到这一点。雪上加霜的是,以现代经济的标准来看,对化学毒剂的近乎完全防护(防毒面具加 NBC 防护服)便宜得惊人:用 Devereaux 的话来说,对这种武器的完全防护很可能比一个士兵的步枪还要便宜,而一个富裕的国家如果愿意的话,基本上可以为其全体民众提供对化学攻击的防护。此外,现代炸药在战场情况下,按重量计算,可以说比几乎任何化学毒剂都更致命(原则上,化学毒剂的致死剂量非常低,但在战场上让一个人实际暴露于足够剂量的化学毒剂充其量是一场赌博:在东京地铁袭击中使用的五升沙林实际上只杀死了十二个人,尽管这种情势对化学攻击而言已经尽可能有利了)。这意味着,如果你拥有一支具备现代系统机动战能力的军队,无论你是在与另一支现代系统军队作战,还是与一支静态系统军队作战(用 Devereaux 的术语来说),化学武器对你来说基本上毫无用处。
如果你是弱势一方与另一个弱势一方交战,化学武器确实可能相当有用。毕竟,如果上述各点都不成立,使用这项技术或许完全说得通,正如我们在两伊战争中所见。同样,化学武器可能被用于恐怖袭击或传达某种信息(谢尔盖·斯克里帕尔在伦敦遭投毒似乎就属于这一类)。然而值得注意的是,无论从哪种意义上讲,只有当你缺乏进行现代机动战的预算、意愿或技能时,你才会使用这项技术。一般来说,化学武器是一个绝佳的反面教材,说明一项看似能力出众、效果显著的技术远非不可避免之物,事实上在使用与否方面高度取决于文化背景。并且,必须明确指出,按照我们的意思,说化学武器的广泛采用是不可避免的显然是错误的:或许可以说这项技术将持续存在是不可避免的(毕竟不可能"反发明"一项技术),但先进军队必然制造和使用这类武器显然并非不可避免。
现在,说到本文的主旨:我主张,LLM就其不可避免性而言,与LLM大致属于同一技术类别。毕竟,化学武器在我们此前的分类中与LLM的处境大致相同:它们能在某些军事场景中派上用场,有时比同类常规武器表现更好,但远远谈不上压倒性地优于常规武器,往往还糟糕得多,而且极易被中和。
因此,LLM的不可避免性与化学武器的不可避免性如出一辙。弱势玩家之间相互对抗时,或许真能从中找到一些用处。我预计我们将长期看到二流或三流的软件工程作坊使用这些工具(无论是大厂模型还是本地模型)。对他们而言,首要关切是产出的垃圾量,而产出物的功能性充其量只是次要关切(Shopify和Mailchimp在LLM普及之前就是几乎没法用的垃圾软件,但它们在各自应用的低端市场一直颇有竞争力)。然而,任何认真对待此事的人或公司,可能只会少量使用甚至根本不用(在我所认识的、算得上认真的使用者中,我观察到的使用模式与其他使用者大不相同,而且即便是重度使用者,使用量也普遍低得多);如果我们在化学武器上看到的规律成立,那么这些公司将远远甩开大多数竞争对手所能做到的。同样,LLM可能在混合战争中具有有意义的用途,正如化学武器作为恐怖武器被使用一样(最近LLM驱动的网络攻击和LLM水军机器人的兴起确实让我担忧),但在真正完成实质性工作方面仍然缺乏竞争力。我认为这两种模式出现的频率足够高,因此我强烈怀疑这将成为未来的趋势,至少在近期内如此。
当然,鉴于这种情况,你可能会说 LLM 在弱意义上是不可避免的:这种不可避免是指我们无法让这项技术变得从未被发明过,而且总会有坚持使用这些工具的弱势行动者。但在强意义上呢?当然不是。任何在其领域中稍具认真态度的行动者,迟早都会撞上这样一个临界点——届时 LLM 对他们不再有用,反而会切实阻碍他们的进一步发展。而我们绝对看不到 LLM 若要变得不可避免所必须具备的那种压倒性优势。
至于我们的未来会是什么样子,我认为取决于我们的最后一点:我们能在多大程度上抵消 LLM 正在对我们处境所造成的影响?如果我们找不到切实可行的办法来让 LLM 难以伤害我们,那么局面很可能是——LLM 的采用虽然并非不可避免,但仍会因各种偶然性原因而延续下去。毕竟,我们社会中的大多数博弈(姑且这么说)都是弱者与弱者之间的冲突,而如果 LLM 无法被有效抵消,LLM 技术仍可充当针对更强力量的有效威慑。对于那些 LLM 对之毫无用处的领域,从事相关工作的人依然能够守住自己的阵地,但他们对 LLM 用户并不具备足以让使用 LLM 变得令人却步的压倒性优势。不幸的是,这是一个相当灰暗的世界——在这里仍然有留给真本事和真用心的空间,但也有相当一部分人被困在彼此用 LLM 对准对方、并在此过程中使心智腐朽的境地,其后果将由我们所有人共同承担:这是一个污染井水的局面——我们所有人都不得不投入大量精力去滤除 LLM 制造的糟粕,而这些精力本可以用于其他事情。
然而,如果我们能以某种方式抵消 LLM 带来的威胁(也许是通过监管、经济手段和社会谴责的某种组合),那么前景就相当乐观。如果我们能够减轻 LLM 对我们造成的影响、降低过滤的负担,那么我们多半就能直接地在竞争中胜过 LLM 的使用者。毕竟,正如我们此前所确立的,LLM 主要对那些不擅长自己所做之事的人有用——也就是我们这场社会经济博弈中的弱者。眼下,LLM 主要是让他们相对于那些技艺较高的从业者得以勉强浮在水面上。我认为,我们有望能够有效地抵消这一局面。LLM 使用者目前之所以能够与强者相抗衡,很大程度上是因为人们对 LLM 的力量与效力抱有相当大的信念——这种信念对很多人来说很方便,但本质上是荒谬的。认为 LLM 能把人类所做的一切都做得更好、甚至能带来巨大生产力提升的观点,早已在瓦解。我们可以加速这一瓦解,而一旦这种信念瓦解得足够彻底,那些因为自身水平已经超越 LLM 而不使用它们的人,将瞬间获得压倒性的竞争优势。我不知道这会在何时发生——可能需要几年,也可能长达十年。但我坚信,这种信念最终很可能会崩塌。
综合来看,认为 LLM 在某种意义上"不可避免"的想法相当愚蠢。诚然,这项技术将永远伴随着我们。诚然,水军机器人也不会消失。但这项技术是否强大到足以让我们所有人都必须现在使用它,否则就会受制于那些使用它的人?
不。
Arca 是我的项目,旨在帮助维持我们所需掌握的技能和知识,从而超越 LLM 的使用者。我们目前还处于非常早期的阶段,但平台已经开放了抢先体验,所以如果你感兴趣,请注册并帮助我把项目完整实现,让我在此期间能够维持生活。
来源:Hacker News · deadsimpletech.com