这些初创公司正在无需数据中心的情况下构建先进AI模型
研究人员利用遍布全球的 GPU,结合私有和公开数据,训练出了一种新型大语言模型(LLM)。这一举措表明,构建人工智能的主流方式可能会被颠覆。
Flower AI 和 Vana 这两家追求非传统 AI 构建方式的初创公司合作开发了这一新模型,名为 Collective-1。
Flower 开发的技术允许训练过程分布在通过互联网连接的数百台计算机上。该公司的技术已被一些公司用于训练 AI 模型,无需集中计算资源或数据。Vana 则提供了包括 X、Reddit 和 Telegram 上的私人消息等数据来源。
Collective-1 按现代标准来看规模较小,拥有 70 亿个参数——这些参数共同赋予模型能力——相比之下,当今最先进的模型(如驱动 ChatGPT、Claude 和 Gemini 的模型)拥有数千亿参数。
剑桥大学计算机科学家、Flower AI 联合创始人 Nic Lane 表示,这种分布式方法有望扩展到远超 Collective-1 的规模。Lane 补充说,Flower AI 正在使用常规数据训练一个 300 亿参数的模型,并计划在今年晚些时候训练一个 1000 亿参数的模型——接近行业领导者提供的规模。「这可能会彻底改变人们对 AI 的看法,所以我们正在全力以赴,」Lane 说。他还表示,这家初创公司正在将图像和音频纳入训练,以创建多模态模型。
分布式模型构建还可能动摇塑造 AI 行业的权力格局。
目前,AI 公司通过将海量训练数据与集中在数据中心的大量计算资源结合,构建模型。这些数据中心充满先进的 GPU,并通过超高速光纤电缆联网。它们还高度依赖通过抓取公开(尽管有时涉及版权)的材料(如网站和书籍)创建的数据集。
这种方法意味着,只有最富有的公司和拥有大量最强大芯片的国家,才能切实开发出最强大、最有价值的模型。即使是开源模型,如 Meta 的 Llama 和 DeepSeek 的 R1,也由拥有大型数据中心的公司构建。分布式方法可能使小型公司和大学通过聚合同质资源来构建高级 AI。或者,它可能使缺乏传统基础设施的国家通过联网多个数据中心来构建更强大的模型。
Lane 认为,AI 行业将越来越倾向于允许训练突破单个数据中心的新方法。分布式方法「让你能够以比数据中心模型更优雅的方式扩展计算能力,」他说。
新兴技术安全中心 AI 治理专家 Helen Toner 表示,Flower AI 的方法「有趣且可能非常相关」于 AI 竞争和治理。「它可能难以跟上前沿,但可能是一种有趣的快速跟随方法,」Toner 说。
分而治之
分布式 AI 训练涉及重新思考用于构建强大 AI 系统的计算分配方式。创建 LLM 需要将大量文本输入模型,调整其参数以生成对提示的有用响应。在数据中心内,训练过程被分割,以便在不同 GPU 上运行部分任务,然后定期整合成单一的主模型。
新方法允许通常在大型数据中心内完成的工作在可能相距数英里的硬件上执行,并通过相对较慢或不稳定的互联网连接进行连接。
一些大公司也在探索分布式学习。去年,谷歌的研究人员展示了一种名为 DIstributed PAth COmposition(DiPaCo)的新方案,用于分割和整合计算,使分布式学习更高效。
为了构建 Collective-1 和其他 LLM,Lane 与英国和中国的学术合作者开发了一种名为 Photon 的新工具,使分布式训练更高效。Lane 表示,Photon 改进了谷歌的方法,采用了更高效的数据表示方式和共享及整合训练的方案。这一过程比传统训练慢,但更灵活,允许添加新硬件以加速训练,Lane 说。
Photon 由北京邮电大学和浙江大学的研究人员合作开发。该团队上个月以开源许可发布了该工具,允许任何人使用这种方法。
Flower AI 在构建 Collective-1 的努力中的合作伙伴 Vana,正在开发新方法让用户与 AI 构建者共享个人数据。Vana 的软件允许用户将来自 X 和 Reddit 等平台的私人数据贡献给大语言模型的训练,并可能指定允许的最终用途,甚至从他们的贡献中获得经济利益。
Vana 联合创始人 Anna Kazlauskas 表示,这一想法是让未被利用的数据可用于 AI 训练,同时让用户对其信息如何用于 AI 有更多控制权。「这些数据通常无法纳入 AI 模型,因为它们不是公开的,」Kazlauskas 说,「这是用户直接贡献的数据首次被用于训练基础模型,用户对其数据创建的 AI 模型拥有所有权。」
伦敦大学学院计算机科学家 Mirco Musolesi 表示,分布式 AI 训练方法的一个关键好处可能是它解锁了新型数据。「将其扩展到前沿模型将使 AI 行业能够利用分散且隐私敏感的大量数据,例如在医疗保健和金融领域,用于训练,而无需数据集中化的风险,」他说。
本文来自投稿,不代表BlockBeats观点。
猜你喜欢

风控核心团队刚被赶走,Aave就有了两亿美元坏账

2.93亿美元的漏洞不在代码里,酿成2026最大黑客案的「DVN配置漏洞」是怎么回事?

a16z关于招聘:如何在加密原生人才和传统人才之间进行选择?

2026年最大的DeFi盗窃案,黑客轻松利用了Aave的漏洞

机器人会取代人类吗?他说不会!

15倍涨到新高的币安人生,人造牛市的三次救命

Arbitrum X账号遭入侵,官方呼吁用户保持警惕
核心要点:Arbitrum官方X账号遭到入侵,攻击者利用虚假空投信息进行网络钓鱼诈骗……

加密货币市场回顾:柴犬币(SHIB)的万亿级牛市触发点,比特币(BTC)跌势或在此止步,狗狗币(DOGE)处于迷你牛市吗?
柴犬币在下跌后出现放量阳线,暗示潜在复苏但尚未确认…

加密货币末日即将来临,2008年金融危机预言家发出警告
Nouriel Roubini预测加密货币市场将迎来全面末日,声称除了犯罪之外,它缺乏实际用例…

三大模因币价格预测:Dogecoin、Shiba Inu 和 MemeCore 领跑市场复苏
Dogecoin、Shiba Inu 和 MemeCore 等模因币显示出复苏迹象,价格分别上涨 5.45%、5% 及…

XRP价格面临跌至1美元的风险,XRPL指标低迷且销毁率停滞

本月最佳空投狩猎:2026年1月
本指南重点介绍了五个有前途的无代币协议,以获取2026年1月的早期空投机会,旨在帮助用户…

这是加密货币寒冬吗?Burry预测跌至5万美元,Tiger则认为不然

1月20日主要市场洞察:你需要了解的内容
核心要点:马斯克开源的X算法有望持续改进,提升效率和功能。BSC上的模因币“Distinguished Wall Street Trader”...

Electric Capital计划为其第三支风险投资基金筹集3亿美元
关键要点:专注于Web3技术的风险投资公司Electric Capital正计划筹集…

Ondo向多家交易所转移2500万枚ONDO代币
要点:Ondo多重签名钱包转移了2500万枚ONDO代币,价值约1019万美元。此次转移…

多家金融机构表示美联储降息预期或将推迟
核心要点:多家大型金融机构调整了预测,预计美联储降息时间将推迟…

以太坊国库公司BitMine达成100万枚ETH质押的重要里程碑
核心要点:领先的以太坊国库公司BitMine Immersion Technologies已达成质押超过100万枚以太坊的重大成就……

