网易首页 > 网易号 > 正文 申请入驻

摩尔线程国产GPU智算集群扩展至万卡规模

0
分享至

近日,在上海世界人工智能大会期间,国产GPU创企摩尔线程宣布对其夸娥(KUAE)智算集群解决方案进行重大升级,从当前千卡级别大幅扩展至万卡规模。该集群以全功能GPU为底座,旨在打造能够承载万卡规模、具备万P级浮点运算能力的国产通用加速计算平台。

摩尔线程创始人兼CEO张建中向观察者网表示,相信通用人工智能(AGI)一定会到来。之前没有万卡集群,有些模型在千卡集群上无法训练出来,“当万卡集群建起来,Scaling(扩展性)往上走,准确度、精度、IQ能力都在提升的话,有了实际价值,就会建下一个集群。”

在现场,摩尔线程联合中国移动通信集团青海有限公司、中国联通青海公司、北京德道信科集团、中国能源建设股份有限公司总承包公司、桂林华崛大数据科技有限公司等,分别就三个万卡集群项目进行了战略签约,多方将聚力共同构建好用的国产GPU集群。


摩尔线程CEO张建中 图源:观察者网

万卡集群已成入场券

大模型自问世以来,关于其未来的走向和发展趋势亟待时间验证,但从当前来看,几种演进趋势值得关注,使得其对算力的核心需求也愈发明晰。

首先,Scaling Law将持续奏效。Scaling Law自2020年提出以来,已揭示了大模型发展背后的“暴力美学”,即通过算力、算法、数据的深度融合与经验积累,实现模型性能的飞跃,这也成为业界公认的将持续影响未来大模型的发展趋势。Scaling Law将持续奏效,需要单点规模够大并且通用的算力才能快速跟上技术演进。

其次,Transformer架构不能实现大一统,和其他架构会持续演进并共存,形成多元化的技术生态。生成式AI的进化并非仅依赖于规模的简单膨胀,技术架构的革新同样至关重要。

Transformer架构虽然是当前主流,但新兴架构如Mamba、RWKV和RetNet等不断刷新计算效率,加快创新速度。随着技术迭代与演进,Transformer架构并不能实现大一统,从稠密到稀疏模型,再到多模态模型的融合,技术的进步都展现了对更高性能计算资源的渴望。

与此同时,AI、3D和HPC跨技术与跨领域融合不断加速,推动着空间智能、物理AI和AI 4Science、世界模型等领域的边界拓展,使得大模型的训练和应用环境更加复杂多元,市场对于能够支持AI+3D、AI+物理仿真、AI+科学计算等多元计算融合发展的通用加速计算平台的需求日益迫切。

多元趋势下,AI模型训练的主战场,万卡已是标配。随着计算量不断攀升,大模型训练亟需超级工厂,即一个“大且通用”的加速计算平台,以缩短训练时间,实现模型能力的快速迭代。当前,国际科技巨头都在通过积极部署千卡乃至超万卡规模的计算集群,以确保大模型产品的竞争力。随着模型参数量从千亿迈向万亿,模型能力更加泛化,大模型对底层算力的诉求进一步升级,万卡甚至超万卡集群成为这一轮大模型竞赛的入场券。

然而构建万卡集群并非一万张GPU卡的简单堆叠,而是一项高度复杂的系统工程。

摩尔线程CEO张建中对观察者网表示,算力集群不光是一个计算GPU,怎么把它组织成一个大的网络,相互之间的通讯效率还可以更高,去满足MFU(算力利用率)达到60%的最优目标,这要靠网络通讯、计算存储一起来解决。“只有软硬件结合,才能把整个集群算力发挥到最高。否则用户买了一万卡,可能还没有2000卡的效率高,那规模上就没有效果了。”


摩尔线程GPU 图源:观察者网

能否打破英伟达一家独大?

据摩尔线程介绍,夸娥(KUAE)是该公司的智算中心全栈解决方案,以全功能GPU为底座,软硬一体化、完整的系统级算力解决方案,包括以夸娥计算集群为核心的基础设施、夸娥集群管理平台(KUAE Platform)以及夸娥大模型服务平台(KUAE ModelStudio)等。

基于对AI算力需求的深刻洞察和前瞻性布局,摩尔线程夸娥智算集群可实现从千卡至万卡集群的无缝扩展,旨在满足大模型时代对于算力“规模够大+计算通用+生态兼容”的核心需求,整合了超大规模的GPU万卡集群、极致的计算效率优化以及高度稳定的运行环境。

“我们现在万卡集群还没有搭建,已经在用的是千卡级集群。当用户要在我们的千卡上训练一个大模型时,如果是已经适配过的,基本上不需要做任何工作。如果是第一次适配,可能当天或者几个小时之内就可以在我们的平台上跑起来,但是性能调优是一个比较花时间的工作,因为不同模型使用方法不一样,国外不同的芯片厂策略不一样。”张建中说道。

“我们的产品跟国内外主流生态在兼容性方面做的很好,开发者移植到夸娥集群上,几乎不需要修改代码,迁移成本接近0,可以在数小时之内完成迁移。当然用户可能需要花数天时间去调优性能,但整体迁移成本很低,并不需要几周时间。”摩尔线程CTO张钰勃补充称。

当前,国产GPU的主要策略就是先兼容英伟达CUDA生态,把用户迁移成本尽量降低,那在这种举措下,像摩尔线程、天数智芯等国产GPU,能否打破英伟达一家独大?

“这是一个很难回答的问题,首先在美国,那么多公司抢不到英伟达的份额,说明英伟达还是很强的,用户是用脚投票的。但在国内不一定,因为某些原因受限,这样国产GPU就有机会。所以我相信中国市场格局和美国可能会完全不一样。”张建中对观察者网说道。

在发布会现场,摩尔线程携手中国移动通信集团青海有限公司等,分别就青海零碳产业园万卡集群项目、青海高原夸娥万卡集群项目、广西东盟万卡集群项目战略签约。发布会后,无问芯穹、清程极智、360、京东云、智平方等五家企业登台,分享了摩尔线程夸娥智算集群如何助力其在大模型训练、大模型推理、具身智能等不同场景和领域的创新。

本文系观察者网独家稿件,未经授权,不得转载。

特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。

Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.

相关推荐
热点推荐
刚刚证券市场又爆猛料,万千散户抄底还是逃跑,下周A股要大变天

刚刚证券市场又爆猛料,万千散户抄底还是逃跑,下周A股要大变天

一丛深色花儿
2024-11-15 11:27:37
马不停蹄!记者:国足已经落地厦门,今晚回国第一练

马不停蹄!记者:国足已经落地厦门,今晚回国第一练

直播吧
2024-11-15 14:19:14
国足1-0挖到宝!28岁国脚太亮眼:C罗式过人+造红牌,获球迷盛赞

国足1-0挖到宝!28岁国脚太亮眼:C罗式过人+造红牌,获球迷盛赞

小火箭爱体育
2024-11-15 01:12:15
伊朗导弹行动警告中国!若中美开战,1000枚高超弹饱和打击?

伊朗导弹行动警告中国!若中美开战,1000枚高超弹饱和打击?

阵匠
2024-11-14 11:48:08
上海网红被告上法庭!自称复旦交大双硕士,宝妈们愤怒:收完钱就被拉黑

上海网红被告上法庭!自称复旦交大双硕士,宝妈们愤怒:收完钱就被拉黑

上观新闻
2024-11-14 14:42:40
新任命的美国卫生部部长肯尼迪想干些什么?

新任命的美国卫生部部长肯尼迪想干些什么?

阿司匹林42195米
2024-11-15 08:37:55
星光大道如今收视率暴跌,央视迫于压力请他出山,百姓大呼叫好!

星光大道如今收视率暴跌,央视迫于压力请他出山,百姓大呼叫好!

华人星光
2024-11-14 13:30:02
医保缴费连年增长导致断缴剧增,人大代表建议调整医保增长机制

医保缴费连年增长导致断缴剧增,人大代表建议调整医保增长机制

阿伧说事
2024-11-15 10:19:32
重排NBA历史5大分卫,哈登落选,艾弗森第5,榜首无法撼动

重排NBA历史5大分卫,哈登落选,艾弗森第5,榜首无法撼动

兵哥篮球故事
2024-11-14 08:20:35
19+6+7+3!我太轻视哈登了,乌度卡承认错误,火箭G2将毫无保留

19+6+7+3!我太轻视哈登了,乌度卡承认错误,火箭G2将毫无保留

巴叔GO聊体育
2024-11-15 14:42:32
黑哨变金哨!光头裁判否决巴林点球,吹掉进球+少给3分钟,立大功

黑哨变金哨!光头裁判否决巴林点球,吹掉进球+少给3分钟,立大功

嘴炮体坛
2024-11-15 01:15:06
秋瓷炫定居北京后第一次坐地铁,人挤人全程站着,被老公催考驾照

秋瓷炫定居北京后第一次坐地铁,人挤人全程站着,被老公催考驾照

娱乐的小灶
2024-11-15 09:17:17
泽连斯基终于做出了史上最正确的一个决定

泽连斯基终于做出了史上最正确的一个决定

莫问先生
2024-11-15 10:55:24
贾玲又胖回来了,路人镜头下至少140斤,回归《王牌9》的看点有了

贾玲又胖回来了,路人镜头下至少140斤,回归《王牌9》的看点有了

星寒新影视
2024-11-12 19:59:20
有“性瘾”的女人一般有什么表现?

有“性瘾”的女人一般有什么表现?

番茄健康
2024-11-14 18:28:06
5轮仅1胜!澳大利亚球迷怒喷:真是耻辱!我受够了这垃圾球队!

5轮仅1胜!澳大利亚球迷怒喷:真是耻辱!我受够了这垃圾球队!

直播吧
2024-11-14 20:01:38
83岁高仓健去世后,将40亿遗产全给保姆。保姆:我陪了他17年

83岁高仓健去世后,将40亿遗产全给保姆。保姆:我陪了他17年

书画艺术收藏
2024-11-14 20:00:06
杨紫“带套试戏”后续:已取证,男方被爆承认,牵连多位女星

杨紫“带套试戏”后续:已取证,男方被爆承认,牵连多位女星

阿凫爱吐槽
2024-11-14 16:57:31
新诺威超70亿元并购背后的资产腾挪:溢价收购与低价定增疑云重重

新诺威超70亿元并购背后的资产腾挪:溢价收购与低价定增疑云重重

时代商学院
2024-11-14 18:04:06
52岁徐峥到耶鲁大学上课,同学几乎都是华人,伙食太好圆润一大圈

52岁徐峥到耶鲁大学上课,同学几乎都是华人,伙食太好圆润一大圈

娱圈小愚
2024-11-15 08:55:45
2024-11-15 15:54:44
观察者网
观察者网
全球视野,中国关怀
103611文章数 1844629关注度
往期回顾 全部

科技要闻

奇瑞董事长夸余承东:你改名余成功吧

头条要闻

男子砍人十多刀仅被拘10日 律师:伤者可要求重新鉴伤

头条要闻

男子砍人十多刀仅被拘10日 律师:伤者可要求重新鉴伤

体育要闻

我们究竟需要一支怎样的国家队?

娱乐要闻

娜扎和张云龙恋爱,男帅女美挺好

财经要闻

紫金矿业哥国矿山到底"被掠走"多少黄金?

汽车要闻

配易四方+云辇-Z系统 仰望U7于广州车展亮相

态度原创

健康
房产
游戏
艺术
数码

花18万治疗阿尔茨海默病,值不值?

房产要闻

最新房价!海口新房,年内新低!但二手房,开始回暖!

《LOL》T1官宣:打野选手Oner续约至2026年

艺术要闻

故宫珍藏的墨迹《十七帖》,比拓本更精良,这才是地道的魏晋写法

数码要闻

宅家玩游戏,没有称手的工具怎么行

无障碍浏览 进入关怀版