网站首页

BOB半岛产品中心

智能终端处理器 智能云服务器 软件开发环境

BOB半岛新闻中心

关于BOB半岛

公司概况 核心优势 核心团队 发展历程

联系我们BOB半岛

官方微信

官方微博

BOB半岛·体育(中国)官方网站 > BOB半岛新闻中心

蚂蚁集团 NextEvo全面开源AI Infra 技术可实现大模型训练「自动驾驶」

发布时间：2024-02-01 11:07浏览次数：来源于：网络

　　近日，蚂蚁集团 AI 创新研发部门 NextEvo 全面开源 AI Infra 技术，可帮助大模型千卡训练有效时间占比超过 95%，能实现训练时「自动驾驶」，这推动了 AI 研发效率。
　　该技术框架名为 DLRover，目标在于大规模分布式训练的智能化。目前很多企业的训练作业都是跑在混合部署的集群中，运行环境复杂多变，不管多么「崎岖的地形」，DLRover 都可以「轻松行驶」。
　　2023 年大模型技术的发展，带来了工程实践的爆发，如何管理数据，提高训练和推理效率，最大化利用现有算力，成了关键一环。
　　完成一个千亿参数级别的大模型，如 GPT-3，用一张卡训练一次要耗时 32 年，那么训练时的算力利用尤为重要。方法之一是把能用的算力用得更好，比如进一步压榨已购买 GPU 的性能；二是把以前利用不了的算力用起来，比如 CPU、内存等，这就需要通过异构计算平台来解决。
　　最新集成进 DLRover 的是 Flash Checkpoint（FCP）方案。模型训练时，一般要打 Checkpoint（检查点），以便中断时能恢复到最近状态，目前常规的做法，存在着耗时长、高频打点易降低训练可用时间、低频打点恢复时丢失过多等缺点。新方案 FCP 应用在千卡千亿参数模型训练后，Checkpoint 导致的训练浪费时间降低约 5 倍，其中持久化时间降低约 70 倍，有效训练时间从 90% 提升至 95%。
　　同时集成进去的，还有三项新的优化器（Optimizer）技术。优化器作为机器学习的核心组件，用于更新神经网络参数以最小化损失函数。其中，蚂蚁的 AGD（Auto-switchable optimizer with Gradient Difference of adjacent steps）优化器，在大模型预训练任务中，相比传统的 AdamW 技术加速 1.5 倍，AGD 已在蚂蚁内部多个场景使用并取得显著效果，相关论文已被 NeurIPS 23 收录。
　　作为自动化分布式深度学习系统，DLRover 的「自动驾驶」功能模块还包括：Atorch，一种 PyTorch 分布式训练扩展库，在千亿参数模型千卡级别规模下，训练的算力利用率可达 60%，帮助开发者进一步压榨硬件算力。
　　DLRover 以「ML for System」的理念来提升分布式训练的智能度，旨在通过一个系统，让开发者完全摆脱资源配置的束缚，专注于模型训练本身。在没有任何资源配置输入的情况下，DLRover 仍然可以为每个训练作业提供最佳资源配置。
　　据了解，蚂蚁集团在人工智能领域持续进行技术投入，最近，蚂蚁集团在内部成立了 AI 创新研发部门 NextEvo，承担了蚂蚁 AI 的所有核心技术研发，包含百灵大模型的所有研发工作，涉及 AI 算法、AI 工程、NLP、AIGC 等核心技术，并在布局多模态大模型、数字人等领域的技术研发和产品创新。
　　同时，蚂蚁集团还加速开源节奏，填补了国内相关技术空白，推动人工智能行业快速发展。
　　公司地址：北京市朝阳区酒仙桥路4号751 D·Park正东集团院内 C8座105室极客公园

下一篇：盛趣游戏：AI仿真BOB半岛体育用户行为已实现测试全自动化
上一篇：罗克韦尔自动化1月31日成BOB半岛体育交额为1680亿美元成交额较上个交易日增加62115%。

咨询我们

输入您的疑问及需求发送邮箱给我们

相关新闻推荐

盛趣游戏：AI仿真BOB半岛体育用户行为 2024-02-01

蚂蚁集团 NextEvo全面开源AI I 2024-02-01

罗克韦尔自动化1月31日成BOB半岛体育 2024-02-01

BOB半岛体育博众精工：公司目前紧紧围绕 2024-02-01

华昌达：公司业务主业涉及所有工业机器人领 2024-02-01

BOB半岛体育自动化类专业有哪些？自动化 2024-02-01

简历投递

admin@sylyzdh.com

商务合作

admin@sylyzdh.com

媒体垂询

admin@sylyzdh.com

BOB半岛产品中心: 智能终端处理器智能云服务器软件开发环境

BOB半岛新闻中心

关于BOB半岛: 公司概况核心优势核心团队发展历程

关注腾讯

微信二维码

微博二维码

Copyright © 2002-2023 BOB半岛·体育(中国)官方网站-在线登录版权所有备案号：黔ICP备19007419号-1