站长之家 - 业界 2024-06-07 21:30

Intel三条线优化阿里云通义千问2模型:720亿参数轻松拿捏

Intel助力阿里云大模型提升效率

Intel宣布其数据中心客户端边缘AI解决方案已为阿里云通义千问2(Qwen2)提供支持,取得了多项创新成果。

为了提升通义千问2等大模型的效率,Intel进行了全面优化,包括融合算子、量化技术等。

Intel还采用了多种技术提高推理效率,如KV Caching和PagedAttention。

硬件加速

Intel硬件与软件框架相结合,可加速大模型推理。如PyTorch和Intel PyTorch扩展包、OpenVINO工具包等。

Intel Gaudi AI加速器专为大模型加速而设计,可轻松部署超大模型。

Intel对70亿和720亿参数的通义千问2模型进行了基准测试,结果如下:

70亿参数通义千问2在单颗Gaudi 2加速器上的推理

70亿参数通义千问2在单颗Gaudi 2加速器上的推理

720亿参数通义千问2在八颗Gaudi 2加速器上的推理

720亿参数通义千问2在八颗Gaudi 2加速器上的推理

通义千问2 FP8在Gaudi 2加速器上的推理

通义千问2 FP8在Gaudi 2加速器上的推理

通义千问2在Gaudi 2加速器上的微调

通义千问2在Gaudi 2加速器上的微调

Intel至强处理器适用于各种规模的数据中心,可加速AI推理。

至强处理器内置Intel AMX高级矩阵扩展,可处理多样化的AI工作负载。

阿里云ecs.ebmg8i.48xlarge实例上运行通义千问2的下一个token延迟

阿里云ecs.ebmg8i.48xlarge实例上运行通义千问2的下一个token延迟

消费级AI PC

消费级AI PC可本地部署大模型,可以使用内置GPU核显、NPU AI引擎或独立显卡。

酷睿Ultra 7 165H上的通义千问2推理

酷睿Ultra 7 165H上的通义千问2推理

酷睿 Ultra 7 165H上的通义千问2下一个token延迟

酷睿 Ultra 7 165H上的通义千问2下一个token延迟

锐炫A770 16GB显卡上的通义千问2下一个token延迟

锐炫A770 16GB显卡上的通义千问2下一个token延迟

推荐关键词

24小时热搜

查看更多内容

大家正在看

阿里AI,进入以战养战