博客
关于我
1024块TPU在燃烧!BERT训练从3天缩短到76分钟 | 技术头条
阅读量:127 次
发布时间:2019-02-26

本文共 756 字,大约阅读时间需要 2 分钟。

BERT预训练时间大幅缩短:Google与UC Berkeley研究团队提出新算法

近日,Google与UC Berkeley、UCLA的研究团队在大模型训练领域取得重大突破。他们成功将BERT预训练的时间从三天压缩至76分钟,采用LAMB优化器后实现了这一显著进展。

BERT作为当前最耗时的工业界应用之一,其预训练过程一直面临效率瓶颈。特别是在使用大批量数据时,传统的训练方法难以满足需求。UC Berkeley博士尤洋在接受采访时表示:“直接优化传统批处理方法会导致测试集准确性下降,这对模型性能是一个严峻挑战。”

为了应对这一难题,他们提出了一种全新的优化算法LAMB(LARGE batch Matrix Optimization)。该算法不仅支持更大的批量处理(如65536),还能在不降低准确率的情况下显著提升训练效率。具体而言,使用LAMB优化器的BERT-Large模型在批量处理为65536时,仅需8599次迭代完成预训练,而传统方法需要100万次迭代。

尤洋的研究团队还进一步优化了批量处理的内存限制,实现了与TPUv3 pod相匹配的训练效果。最终,他们将BERT的预训练时间从三天压缩至76分钟。

尤洋的研究成果备受关注。他目前专注于大规模深度学习训练算法的分布式优化。值得一提的是,他曾在2017年9月以24分钟完成ImageNet训练,刷新了世界纪录。尤洋的导师是美国科学院与工程院院士、伯克利计算机系主任James Demmel教授,这为他的研究提供了坚实的理论基础。

推荐阅读:

  • 「2019 Python开发者日」演讲议题全揭晓!10余位一线Python技术专家共同打造硬核技术大会。
  • 更有深度培训实操环节,为开发者们带来更多深度实战机会。

点击阅读原文,查看更多历史精彩文章。

转载地址:http://muay.baihongyu.com/

你可能感兴趣的文章
OpenCV与AI深度学习 | OpenCV常用图像拼接方法(一) :直接拼接
查看>>
OpenCV与AI深度学习 | OpenCV常用图像拼接方法(三):基于特征匹配拼接
查看>>
OpenCV与AI深度学习 | OpenCV常用图像拼接方法(二) :基于模板匹配拼接
查看>>
OpenCV与AI深度学习 | OpenCV常用图像拼接方法(四):基于Stitcher类拼接
查看>>
OpenCV与AI深度学习 | OpenCV快速傅里叶变换(FFT)用于图像和视频流的模糊检测(建议收藏!)
查看>>
OpenCV与AI深度学习 | PaddleOCR 2.9 发布, 正式开源文本图像智能分析利器
查看>>
OpenCV与AI深度学习 | SAM2(Segment Anything Model 2)新一代分割一切大模型介绍与使用(步骤 + 代码)
查看>>
OpenCV与AI深度学习 | T-Rex Label !超震撼 AI 自动标注工具,开箱即用、检测一切
查看>>
OpenCV与AI深度学习 | YOLO11介绍及五大任务推理演示(目标检测,图像分割,图像分类,姿态检测,带方向目标检测)
查看>>
OpenCV与AI深度学习 | YOLOv10在PyTorch和OpenVINO中推理对比
查看>>
OpenCV与AI深度学习 | YOLOv11来了:将重新定义AI的可能性
查看>>
OpenCV与AI深度学习 | YOLOv8自定义数据集训练实现火焰和烟雾检测(代码+数据集!)
查看>>
OpenCV与AI深度学习 | YOLOv8重磅升级,新增旋转目标检测,又该学习了!
查看>>
OpenCV与AI深度学习 | 一文带你读懂YOLOv1~YOLOv11(建议收藏!)
查看>>
OpenCV与AI深度学习 | 五分钟快速搭建一个实时人脸口罩检测系统(OpenCV+PaddleHub 含源码)
查看>>
OpenCV与AI深度学习 | 什么是 COCO 数据集?
查看>>
OpenCV与AI深度学习 | 低对比度缺陷检测应用实例--LCD屏幕脏污检测
查看>>
OpenCV与AI深度学习 | 使用 MoveNet Lightning 和 OpenCV 实现实时姿势检测
查看>>
OpenCV与AI深度学习 | 使用 OpenCV 创建自定义图像滤镜
查看>>
OpenCV与AI深度学习 | 使用 SAM 和 Grounding DINO 分割卫星图像
查看>>