当前位置:首页 > 通信技术 > 通信先锋
[导读]这是一个AI的时代,这是一个算力的时代。

这是一个AI的时代,这是一个算力的时代。

遗憾的是,我们已经无缘接触到最先进的AI硬件和算力,用着H20这样阉割两次的N卡,还要支付上百亿元的费用,实在憋屈。

面对持续上涨的AI算力需求,我们唯有发展自己的国产方案,发展自己的大规模AI算力集群,才能突破围追堵截,走上康庄大道。

说到这里,很多人或许会第一时间想到华为,在美国制裁下顽强屹立突破的中国企业标杆,昇腾910B在AI算力领域也取得了一定的成就。

当然了,中国只依靠一个华为是不够的。中国的AI生态需要遍地开花,才有可能多点突破,让生态更繁荣。

目前来看,摩尔线程以全功能GPU走通用计算路线是另一条希望之路,尤其是它已经成为华为之外,另一家可以实现千卡千亿参数大模型训推的全国产AI芯片公司。

说起来,大家对摩尔线程并不陌生,其堪称中国自主GPU最大的希望,但很多人对摩尔线程的认知还停留在国产游戏显卡,其实不然,摩尔线程在AI上也实力突出。

自成立以来,摩尔线程做的就是通用GPU,跟英伟达一样,除了图形渲染,也能用于AI人工智能加速、科学计算。

经过三年多潜心发展,摩尔线程在AI GPU方面已经展现了强劲的实力,构建了一张从芯片、板卡、服务器,到集群、软件栈的全栈AI智算产品版图,并且已经多点落地、处处开花。

比如和清华系AI大模型公司无问芯穹的合作。摩尔线程是第一家接入无问芯穹,并成功完成千卡级别大模型训练的国产GPU公司。

摩尔线程的“夸娥”(KUAE)千卡智算集群,已与无穹Infini-AI大模型开发与服务平台完成系统级融合适配,并完成了LLama2 700亿参数大模型的训练测试。近期,双方又完成了“MT-infini-3B” 3B(30亿参数)大模型的实训。

这意味着什么呢?这是行业首个基于国产GPU芯片的从0到1的端到端大模型实训案例。夸娥也成为业内首个成功跑通并完整运行国产大模型的千卡集群。

无问芯穹联合创始人兼CEO夏立雪表示力挺:“经过无问芯穹Infini-AI平台的实训与联合优化工作验证,摩尔线程夸娥千卡智算集群在精度、性能、易用性和算力利用率上均有优异表现,而且在实训中实现了长时间稳定训练不中断,可以为千亿参数级别大模型训练提供持续高效的高性能算力支持。”

另外,滴普科技、实在智能等也基于摩尔线程的夸娥千卡智算集群,成功完成了不同参数量级的大模型分布式训练测试,效率、精度、稳定性都相当完美。基于摩尔线程夸娥千卡智算集群,滴普科技成功完成了700亿参数LLaMA2大语言模型的预训练测试,训练时长共计77小时,全程无故障连续运行,集群训练稳定性达到100%。

夸娥(KUAE)是摩尔线程推出的智算中心全栈解决方案,而夸娥这个名字来自我国神话传说中的大力神夸娥氏,

可以说,为AI算力集群取这么一个名字,充分展现了独属于中国人的坚忍不拔和浪漫情怀。出自《愚公移山》:“帝感其诚,命夸娥氏二子负二山,一厝朔东,一厝雍南。自此,冀之南,汉之阴,无陇断焉。”

夸娥解决方案的基本节点是大模型智算加速卡MTT S4000组成的双路八卡GPU服务器“MCCX D800”,以软硬件一体化交付、开箱即用的方式,高可靠地解决大规模GPU算力的建设和运营管理问题。

MTT S4000是摩尔线程新一代专为AI大模型打造的智算加速卡,基于其自主研发的第三代MUSA架构。

利用自研的MTLink互连技术,MTT S4000可以高效千卡并行,线性加速比高达91%以上。

最为关键的是,摩尔线程拥有自研的全功能GPU MUSA统一系统架构,包括指令集架构、MUSA 编程模型、驱动、运行时库、算子库、通讯库、数学库等,而且充分兼容CUDA软件生态,代码可以几乎零成本迁移,也无需担心未来的可用性问题。

MTT S4000不但可用于大规模AI计算,还具备领先的图形渲染能力、视频编解码能力、8K超高清显示能力。

这使得它可为数字孪生、云游戏、云渲染、数字内容创作等场景提供支持,并配合大模型推理能力,服务于AIGC等多模态业务场景。

从2024年的趋势来看,多模态需求将快速崛起,英伟达CFO Colette Kress曾预计这块业务将从零增长至数十亿美元,对国产芯片来说也同样如此。

本站声明: 本文章由作者或相关机构授权发布,目的在于传递更多信息,并不代表本站赞同其观点,本站亦不保证或承诺内容真实性等。需要转载请联系该专栏作者,如若文章内容侵犯您的权益,请及时联系本站删除。
换一批
延伸阅读

随着汽车电子技术的飞速发展,多核处理器在车辆控制系统中的应用日益广泛。特别是在区域控制器和中央计算单元等关键部位,高性能、多功能的微控制器成为了不可或缺的核心部件。其中,AURIX™ TC3xx系列微控制器以其高算力、多...

关键字: 多核处理器 TSIM 算力

近日,以“数治成长,迈向一流”为主题的金蝶云苍穹峰会2024在北京隆重召开,金蝶与来自中国信息通信研究院、英特尔、腾讯、软通动力、IDC中国等知名企业的400余位技术领袖、AI专家相聚一堂,共同探讨企业级AI技术发展方向...

关键字: AI 数智化转型 算力

2024中国移动算力网络大会于4月28-29日在苏州成功举办。作为数据存储领域的领军企业,得瑞领新携旗下全系列企业级SSD及解决方案出席,为助力企业实现数字化转型和智能化升级贡献力量

关键字: 算力 得瑞领新 企业级SSD 2024中国移动算力网络大会

纵观人类近现代史,每一次工业革命都是将战略性科技转化为生产力,从而创造巨大的新增财富和全面提升国家竞争力的过程;而且一个国家在工业革命面前的“沉与浮”,则取决于一个国家对这些战略性科技和产业化能力的把控。从被称为蒸汽机时...

关键字: 人工智能 算力 大模型

业内消息,近日全国政协委员、中国信息通信研究院院长余晓晖在接受《环球时报》记者采访时表示,数字经济时代尤其是人工智能的蓬勃发展,算力已经成为全球紧缺的战略性资源。目前,中国的算力总规模已位居全球第二。

关键字: 中国信通院 算力

北京——2024年3月4日 新年伊始,全球和中国科技领域消息不断,生成式人工智能的发展依然如火如荼。亚马逊全球副总裁、亚马逊云科技大中华区总裁储瑞松认为,生成式人工智能与实体经济的融合将成为新质生产力发展的引擎。

关键字: 人工智能 大语言模型 算力

业内消息,近日中国电信中部智算中心在武汉东湖新技术开发区(光谷)举行正式投入运营。中国电信专家介绍,该智算中心的算力、安全、环保及扩展性均达到一流水平,目前在中部地区属于最高等级。

关键字: 中国电信 智算中心 算力

2023年,随着生成式AI的爆火,该赛道被再次推至高潮,据IDC数据显示,2027年中国AI投资规模有望达到381亿美元,全球占比约9% 。火爆的现象之下,是大数据技术数十年积淀的成果,该技术涵盖数据获取、存储、基于庞大...

关键字: AI 大数据 算力

游戏 GPU 性能更强,具备生成式 AI 功能,建议零售价人民币 4899 元起

关键字: GPU AI 算力

2023年,生成式AI研究和应用的爆发给云计算产业带来了全新的机遇和挑战:大模型需要庞大的算力支持,用户普遍需要向云计算厂商购买算力服务;且由于大量用户涌入云服务市场,云厂商需要尽快升级数据中心算力以应对AI需求,同时持...

关键字: 算力 至强可扩展处理器 AI
关闭