Mozilla首席技术官:AI应以互联网模式构建开放生态

Mozilla首席技术官拉菲·克里科里安指出,企业对可定制、可控的开放AI模型需求日益增长,其性能差距已显著缩小,预示着人工智能未来将如互联网般走向开放基础设施模式。

Mozilla首席技术官:AI应以互联网模式构建开放生态

随着消费者涌向ChatGPT和Claude等热门平台,企业客户正日益转向可定制、可控的开放模型。Mozilla首席技术官拉菲·克里科里安对此深有感触。

数十年来,Mozilla一直是开放互联网最坚定的倡导者之一。如今,随着人工智能在商业和政府运营中扮演的角色越来越核心,该组织正为开放人工智能提出类似的愿景。

Mozilla这份非营利性自由软件社区项目在上个月发布的一份报告中指出,顶尖开源模型与Claude、ChatGPT等专有系统之间的性能差距已缩小至仅3%。报告强调了开放模型日益增长的受欢迎程度,并指出,到2026年2月,阿里巴巴的开源模型Qwen的下载量超过了紧随其后的八个模型下载量总和。

在Meta于8月10日发布新的开放权重模型并承诺将推出更多模型后,关于开放人工智能的讨论再次获得了新的动力。

拉菲·克里科里安认为,企业需要专有AI系统之外的替代方案,以更好地控制其数据和基础设施。

从领导X(前身为Twitter)的工程团队,到在Uber从事自动驾驶汽车工作,再到如今塑造Mozilla的愿景,克里科里安的职业生涯始终与突破性技术及其对消费者的意义息息相关。在一次深度对话中,他阐述了政策制定者为何应将人工智能视为基础设施而非商品,为何企业正日益尝试开放及开放权重模型,以及他认为这项技术将在下一代产品和服务中扮演何种角色。

被低估的开放生态力量

当你在某些圈子,特别是政府政策圈谈论开源时,人们可能会说:“哦,那不过是某个地下室里的技术小子搞出来的东西,对吧?”但这个生态系统远非如此。这些企业正在构建庞大的经济体、基础设施、产品和技术。

这就像Linux的崛起。它最初只是一个不被认真对待的内核,但Google能够利用Linux创建Android,如今,几乎地球上的每一台计算机都在运行Linux。每一台新的自动售货机可能也在运行Linux。

我们在开源、开放权重的人工智能领域看到了同样的情况。正是由于大型前沿实验室的营销攻势,我们才普遍认为人工智能只是Anthropic、OpenAI等少数公司在做的事情。实际上,在开源、开放权重方面,一个蓬勃发展的生态系统正在悄然兴起,许多人也确实意识到了这一点。

这可能是目前技术领域中守得最好的秘密之一。

消费者与企业的分野

消费者和企业正在做的事情之间存在差异。

确实,个人用户——比如秘书或其他白领工作人员——可能正在使用ChatGPT和Claude。但IT或HR团队正在构建的工作流正转向开放模型,原因在于性价比,或是因为受监管行业希望完全控制其数据及数据流向。他们希望自托管,将数据保留在自己的防火墙内。他们正在寻求一种能够在自己的掌控下部署应用的能力。

对于为何人们没有大声疾呼他们节省了这么多钱,我并没有一个很好的答案。

我们没有确凿的证据来证明这一点,但我认为你可以推断这是事实。

开源人工智能模型理解起来很复杂,我认为这也是问题的一部分。当你看这些模型时,它就像是下载一个你想要运行的文件到你的电脑上。所以,我能理解如果人们不真正了解这项技术如何运作,可能会担心只是下载一个恶意软件,从而在某些地方泄露他们的数据。

但这些系统的实际运作方式并非如此。然而,最简单的解释往往最容易被接受。

我也确实相信,中国整体上的一些情况正在使整个局面变得更加复杂。令人困惑的是,为什么没有更多的国家和组织试图填补这种需求?如果大量流量流向人们希望开放的模型,那么你可以想象,美国公司、印度公司或欧洲公司也应该努力满足这种需求。

我认为政府理解正在发生的事情。但他们正处于两难境地:“我们是想让我们现有的标准制定者获胜”还是“我们想冒险尝试成为生态系统的变革力量”。

我认为,我们有两家公司做得非常出色,它们正竞相在今年年底或明年年初上市,我们希望它们获胜,这是一个容易理解的事情。政府在这方面正受到非常大的游说。

所以,最简单的做法就是支持他们认为已经是赢家的人。

但我要说,美国人普遍将智能视为一种产品。产品根据定义是可以租用或关闭的东西,但它应该被归类为基础设施,而这似乎是世界其他地区希望购买的。这种分类错误实际上才是问题所在。我们应该以某种方式努力满足这种需求,我感到沮丧的是,我的政府目前无法看到这种区别,他们正在采取简单化的做法。

从开放源码到开放权重:构建信任

我承认,我们正在探讨开放源码与开放权重的区别。开放源码有其最严格的定义,这包括理解所有用于训练的数据、所有评估系统以及预训练和后训练的细节。我认为这非常重要,我们需要投入更多资源来实现这一点。这将带来信任和透明度,让我们在道德层面感到非常安心。

我并不是在指责大公司的做法,但他们一定会优化那些能赚最多钱的领域。

目前,我们讨论的大部分是开放权重系统。因此,我们对所有数据——预训练和后训练——并没有一个很好的了解。但我们具备下载、运行、执行,然后修改和微调的能力。这种微调正是世界其他地区发挥作用的地方。实现真正符合用户价值观的本地模型和本地AI,其途径就是获取这些大型开放权重模型,并根据我们使用的语言或社区价值观对它们进行微调。这方面的技术仍需改进。所以,如果你是一名计算机科学家,你可能可以做到,但如果你是一名社区领袖,你可能就无法做到了。

我并不是在指责大公司的做法,但他们一定会优化那些能赚最多钱的领域。

因此,他们将为西方世界和亚洲部分地区进行优化,但不会为世界其他地区进行优化。世界其他地区只有通过开源和开放权重的生态系统,才能成为这场AI变革对话的一部分。

Firefox等事物的存在推动了整个行业的发展。像Google这样的公司无法构建一个封闭的互联网版本,因为Firefox用户的强大声音会站出来说你不能那样做。这些用户数量足以迫使并保持互联网处于开放协议状态,使其在底层基础设施层面不偏袒任何特定公司。

我希望在AI互联网上也能出现完全相同的动态。你可以说,我们通过开放模型在AI互联网上获得了少量流量,但这足以引发关于模型选择、代理协调选择、用户自主权以及确保数据留在用户侧而非供应商侧的讨论。你可以认为只需少量流量就能实现这一点,但我也要强调,已经有大量流量正在转向开放模型。

我认为这将是一个扩散的过程。我们将发现,最大的供应商是那些提供开放式智能版本的公司,每个公司都可以使用和定制——就像我们现在拥有Google Drive订阅或Microsoft Office 365解决方案一样。它将是一个服务提供商,能够走进一家公司,帮助他们真正克服障碍并使用AI。

返回 | FIRST CLASS VIP Lounge 专属情报频道