站长之家 - 业界 2023-11-27 14:24

腾讯披露大模型训练方法:Angel框架升级效率提升2.6倍

要点:
腾讯披露混元大模型训练方法，Angel框架升级，大模型训练效率提升至2.6倍，千亿级大模型训练可节省50%算力成本。
AngelPTM机器学习训练框架通过多维度并行优化存储，在通讯方面采用软硬件结合解决方案，提高大模型训练稳定性。
腾讯推出大模型推理框架AngelHCF，通过扩展并行能力和关键能力优化，相较于主流框架，推理速度提高了1.3倍。

站长之家(ChinaZ.com) 11月27日消息:在当前大模型参数规模呈指数级增长的情况下，腾讯近日披露了混元大模型训练的最新方法，通过升级自研机器学习框架Angel，成功提升大模型训练效率。这一升级使得千亿级大模型训练可以节省高达50%的算力成本，为应对算力紧缺提供了有力支持。Angel框架的升级不仅仅在于提高效率，还支持单任务万卡级别超大规模训练，进一步提升了腾讯云HCC大模型专属算力集群的性能和效率。

云服务人工智能

图源备注：图片由AI生成，图片授权服务商Midjourney

为了进一步提高大模型的训练和推理效率，腾讯自研了机器学习训练框架AngelPTM。在存储方面，AngelPTM采用多维度的并行计算，包括数据并行、模型并行、流水并行和序列并行。

此外，通过在ZeRO-Cache的基础上引入统一视角技术，将显存和主存打通，有效扩展了显存容量，提升了单机存储容量达90%。在通讯方面，腾讯通过软硬件结合的方式解决，构建了3.2T RDMA网络来拓宽带宽，同时在框架软件层面做GPU拓扑感知，实现了负载均衡的流水并行。为了确保稳定性，腾讯对基础设施的网络、硬件、存储、云原生调度都进行了监控，并实施了自动续训和系统容错。

此外，为解决推理成本不断上升的问题，腾讯推出了大模型推理框架AngelHCF。通过扩展并行能力和关键能力的优化，包括Embedding共享、Attention算子优化、Paged Attention优化等方式，提高了推理性能，相较于主流框架，AngelHCF的推理速度提高了1.3倍。这一框架在腾讯混元大模型文生图的应用中，将推理耗时从原本的10秒缩短至3至4秒。

腾讯不仅仅在大模型训练方面取得了显著的效率提升，还在推理阶段取得了实质性的优化。这一系列技术提升已经在腾讯云上得以开放，为用户提供更优的训练和推理加速能力，同时支持客户一站式训练精调，打造专属智能应用。腾讯内部已有超过300项业务和应用场景接入腾讯混元大模型内测，涵盖了文本总结、摘要、创作、翻译、代码等多个领域，这标志着整个生产链路的全面升级，从模型研发到应用落地形成了一站式的平台，进一步推动了大模型应用的发展。

24小时热搜

热
4.53万次阅读
1 沙特申博宣传片真是中国拍的网友：这风格意境是中国的手笔
70991次阅读
2 南方人东北购物被店主语气“凶哭”：文化差异导致误解
58002次阅读
3 女子下班回家发现家门口被贴U盘：新型诈骗手段？
39073次阅读
4 爸爸送娃撂下就走结果学校没开门：交警协助联系安全返家
37434次阅读
热
3.23万次阅读
5 宗庆后在黄金地段为员工建廉租房：从不裁45岁以上员工我算有钱
30095次阅读
荐 2020年高通骁龙CPU排名高通骁龙888排名领先
35420次阅读

查看更多内容

首页

IT业界

热点视频

站长资讯

好物榜

更多分类

更多主题

腾讯披露大模型训练方法:Angel框架升级效率提升2.6倍

推荐关键词

24小时热搜

大家正在看

大模型的苦，创业的AI 科学家最懂

大模型上了火山方舟：数据唯你可见，唯你所用，唯你所有

端到端大模型到底是个啥小米官方详解

指令层级，帮助AI大模型防御恶意攻击

大模型为何如此热衷投广告？只因用户的兴趣降低了

国产4o大模型，秒懂国风李子柒

刚刚，沈向洋官宣通用视觉大模型！无需提示，就能识别万物

大模型公司们创业未半，技术主心骨们却先弃船回大厂了？

华为盘古汽车大模型夺得第一 300+家车企都选它

RockAI出席酷+科技峰会，揭示大模型群体智能新趋势

李彦宏最新发声：大模型基本消除幻觉 AI变得可用可信赖！

百度大模型又拿了个冠军！全部8个维度均第一、7项满分

世界AI大会召开马上消金展示金融大模型安全实践成果丨马上消金

大模型应用开发，AI 厂商开启新一轮“群雄逐鹿”？

讯飞输入法升级14.0 AI大模型重塑输入体验

对话李彦宏：大模型进化变慢是好事，百度从来没对标过OpenAI

猿辅导集团副总裁程群：AI时代，大模型在教育场景的创新与应用

谷歌展示首个大模型实时游戏模拟引擎，重塑游戏开发流程

易慧智能发布汽车行业大模型评测集，并重磅推出模型路由技术方案

刚刚，OpenAI开源SimpleQA！轻松检测、校准大模型能力

首页

IT业界

热点视频

站长资讯

好物榜

更多分类

更多主题

腾讯披露大模型训练方法:Angel框架升级 效率提升2.6倍

推荐关键词

24小时热搜

大家正在看

大模型的苦，创业的AI 科学家最懂

大模型上了火山方舟：数据唯你可见，唯你所用，唯你所有

端到端大模型到底是个啥 小米官方详解

指令层级，帮助AI大模型防御恶意攻击

大模型为何如此热衷投广告？只因用户的兴趣降低了

国产4o大模型，秒懂国风李子柒

刚刚，沈向洋官宣通用视觉大模型！无需提示，就能识别万物

大模型公司们创业未半，技术主心骨们却先弃船回大厂了？

华为盘古汽车大模型夺得第一 300+家车企都选它

RockAI出席酷+科技峰会，揭示大模型群体智能新趋势

李彦宏最新发声：大模型基本消除幻觉 AI变得可用可信赖！

百度大模型又拿了个冠军！全部8个维度均第一、7项满分

世界AI大会召开 马上消金展示金融大模型安全实践成果丨马上消金

大模型应用开发，AI 厂商开启新一轮“群雄逐鹿”？

讯飞输入法升级14.0 AI大模型重塑输入体验

对话李彦宏：大模型进化变慢是好事，百度从来没对标过OpenAI

猿辅导集团副总裁程群：AI时代，大模型在教育场景的创新与应用

谷歌展示首个大模型实时游戏模拟引擎，重塑游戏开发流程

易慧智能发布汽车行业大模型评测集，并重磅推出模型路由技术方案

刚刚，OpenAI开源SimpleQA！轻松检测、校准大模型能力

腾讯披露大模型训练方法:Angel框架升级效率提升2.6倍

端到端大模型到底是个啥小米官方详解

世界AI大会召开马上消金展示金融大模型安全实践成果丨马上消金