当前位置:首页 > 厂商动态 > Intel
[导读]一直以来,英特尔致力于与行业领先、创新的生态伙伴开展合作,并针对AI模型进行优化。近日,英特尔宣布其数据中心、客户端和边缘的AI解决方案为阿里云通义千问2(Qwen2)的全球发布提供支持。

一直以来,英特尔致力于与行业领先、创新的生态伙伴开展合作,并针对AI模型进行优化。近日,英特尔宣布其数据中心、客户端和边缘的AI解决方案为阿里云通义千问2(Qwen2)的全球发布提供支持。

英特尔公司副总裁兼数据中心与人工智能软件总经理Pallavi Mahajan和英特尔数据中心与人工智能集团副总裁兼中国区总经理陈葆立表示,在阿里云推出通义千问2大模型的当日,英特尔即为客户和开发人员提供了针对该AI模型和软件而优化的AI解决方案。

软件优化

为了最大限度地提升诸如阿里云通义千问2的大模型效率,全面的软件优化非常重要,其中包括从高性能融合算子到平衡精度和速度的先进量化技术。此外,英特尔还采用KV Caching、PagedAttention机制和张量并行来提高推理效率。英特尔的硬件可利用软件框架和工具包进行加速,并获得出色的大模型推理性能,其中包括PyTorch和英特尔® PyTorch扩展包、OpenVINO™工具包、DeepSpeed、Hugging Face库和vLLM。

英特尔与阿里云在数据中心、客户端以及边缘平台上的AI软件优化,有助于构建一个创新的生态环境,且截至目前,已取得了包括ModelScope、阿里云PAI、OpenVINO等在内的诸多创新成果。得益于此,阿里云AI模型可在多样化的计算环境中进行优化。

测试结果:英特尔® Gaudi AI加速器

英特尔Gaudi AI加速器专为生成式AI以及大模型的高性能加速而设计。使用最新版本的英特尔Gaudi Optimum,可以轻松部署新型号的大模型。在英特尔Gaudi 2上对70亿参数和720亿参数的通义千问2模型的推理和微调吞吐量进行了基准测试,以下为详细性能指标和测试结果。

表1. 70亿参数的通义千问2在单颗英特尔Gaudi 2加速器上的推理

表2. 720亿参数的通义千问2在8颗英特尔Gaudi 2加速器上的推理

表3. 通义千问2 FP8在英特尔Gaudi 2加速器上的推理

表4. 通义千问2在英特尔Gaudi 2加速器上的微调

测试结果:英特尔®至强®处理器

英特尔®至强®处理器作为通用计算的基石,为全球范围内的用户提供强大的算力。英特尔至强处理器具有广泛可用性,适用于各个规模的数据中心,这使其成为那些希望能够快速部署AI解决方案,又无需配备专项基础设施企业的理想选择。英特尔至强处理器的每个核心均内置了英特尔®高级矩阵扩展(英特尔AMX),可处理多样化的AI工作负载并加速AI推理。下图展现了英特尔至强处理器所提供的延迟性能可满足多种用例。

图1. 在基于第五代英特尔®至强®可扩展处理器的阿里云ecs.ebmg8i.48xlarge实例上,通义千问2的下一个推理token延迟

AI PC

由最新英特尔®酷睿™ Ultra处理器和英特尔锐炫™显卡驱动的AI PC让AI的力量触及客户端和边缘,使开发者在本地也能部署大模型。AI PC配备了专门的AI硬件,如神经处理单元和内置的英特尔锐炫™显卡,或配备了英特尔® Xe Matrix Extensions加速的英特尔锐炫™A系列显卡,以处理高需求的边缘AI任务。这种本地处理能力可实现个性化的AI体验,增强隐私性,并提供快速响应时间,这对于交互式应用程序至关重要。

以下展示了15亿参数的通义千问2,在基于英特尔®酷睿™Ultra的AI PC上运行时所展现的强大性能。

Demo 1. 在内置英特尔锐炫™显卡的英特尔®酷睿™ Ultra 7 165H上,通义千问2的推理

表2. 在内置英特尔锐炫™显卡的英特尔®酷睿™ Ultra 7 165H AI PC上,通义千问2的下一个token延迟

表3. 在由英特尔锐炫™ A770 16GB限量版驱动的AI PC上,通义千问2的下一个token延迟

本站声明: 本文章由作者或相关机构授权发布,目的在于传递更多信息,并不代表本站赞同其观点,本站亦不保证或承诺内容真实性等。需要转载请联系该专栏作者,如若文章内容侵犯您的权益,请及时联系本站删除。
换一批
延伸阅读

深圳2024年7月23日 /美通社/ -- AI时代,数据中心建设正在经历一场深刻的变革。依照行业最高标准建设的金融数据中心需要怎样的存力?当高密度、大容量、高可靠、高性能存储逐步成为高端存储新标签时,存力飞跃也为金融行...

关键字: 数据中心 存储解决方案 AI SSD

北京2024年7月23日 /美通社/ -- 作为全球最大的金融机构之一,这家国有银行拥有规模庞大的IT基础设施,囊括大量服务器、存储和网络设备。这些IT设备来自不同年代、不同厂商,拥有上百种产品型号,主要分布在上海和北京...

关键字: 数据中心 GE AN 智能管理

由于电力需求不断增长,关注能源效率至关重要。泰克与知名电源完整性专家Steve Sandler合作,开发了出色的测量技术,旨在改进下一代人工智能数据中心的运营效率/能效。

关键字: 人工智能 数据中心

深圳2024年7月22日 /美通社/ -- 7月19日,为期三天的2024中国国际金融展(简称:金融展)在北京国家会议中心开幕。作为国内领先的存储解决方案提供商,忆联携其最新一代PCIe Gen5企业级SSD及...

关键字: SSD AI 数据中心 SAS

本文根据的介绍是解决在超空间数据中心中使用的尖端处理器日益增长的功率需求,特别是用于培训大型人工智能模型。不断增加的电力需求对整个电力转换链构成重大挑战,从交流/直流电源到直接位于处理器旁边的负载点电源级。

关键字: 数据中心 处理器电源

突破性的美光 MRDIMM 具备高达 256GB 容量和 40% 更低延迟,赋能 AI 及 HPC 等内存密集型应用

关键字: 数据中心 AI 内存

【2024年7月12日,德国慕尼黑讯】英飞凌科技股份公司(FSE代码:IFX / OTCQX代码: IFNNY)推出功率系统可靠性建模。这项创新解决方案能够应对数据中心和电信基础设施面临的日益严峻的系统电源故障问题。这些...

关键字: 数据中心 功率系统 AI服务器

天津2024年7月2日 /美通社/ -- 从AI绘画、AI作诗到随意聊天的机器人、提供全学科答疑的随身家教、精准识别车机指令的智驾助理,大模型应用如火如荼。AI技术的发展,让各行各业对智能化的未来产生了更多的畅想。 江...

关键字: IDC 智能化 模型 数据中心

深圳2024年7月2日 /美通社/ -- 6月26日-28日,2024开放数据中心委员会(ODCC)夏季全会在大连圆满召开。深圳忆联信息系统有限公司(以下简称"忆联")作为ODCC资深会员单位应邀出席交流课题研究进展和成...

关键字: DC AI SSD 数据中心

北京2024年6月28日 /美通社/ -- 日前,浪潮信息重磅发布数据中心基础设施管理平台InManage V7,新版本升级资产数字化和智能化管理两大系统能力。作为浪潮信息和金融大行联合创新的成果,新平台进行了创新功能研...

关键字: 数据中心 智能管理 GE AN
关闭