内容简介:Paddle v0.11.1a2 发布了,PaddlePaddle (PArallel Distributed Deep LEarning 并行分布式深度学习)是百度研发的深度学习平台,具有易用,高效,灵活和可伸缩等特点,为百度内部多项产品提供深度学习算法支持。 ...
Paddle v0.11.1a2 发布了,PaddlePaddle (PArallel Distributed Deep LEarning 并行分布式深度学习)是百度研发的深度学习平台,具有易用,高效,灵活和可伸缩等特点,为百度内部多项产品提供深度学习算法支持。
本次更新主要带来了性能增益和存储优化,更新内容如下:
配置和环境:
model: SE-ResNet-150
Input: 3 x 224 x 224
batch_size: 25
CentOS 6.3, Tesla P40, single card.
优化前后对比
优化前
| Speed | Memory | |
|---|---|---|
| Fluid(before) | 1.95 sec/iter | 18341 MB |
| PyTorch | 1.154 sec/iter | 13359 MB |
| Fluid/PyTorch | 1.6898 | 1.3729 |
速度优化后
| Speed | Memory | |
|---|---|---|
| Fluid(opti_speed) | 1.45 sec/iter | 17222 MB |
| PyTorch | 1.154 sec/iter | 13359 MB |
| Fluid/PyTorch | 1.2565 | 1.2892 |
存储优化后
| Speed | Memory | |
|---|---|---|
| Fluid(opti_mem) | 1.93 sec/iter | 14388 MB |
| PyTorch | 1.154 sec/iter | 13359 MB |
| Fluid/PyTorch | 1.6724 | 1.0770 |
整体性能提升
issue 详情: #8990
训练时删除 GPU 内存
[WIP] 来自 C ++ 的 Feed 数据
添加基本的 RecordIO API
Polish C++ Reader operators
添加 DoubleBuffer Reader
下载地址:
【声明】文章转载自:开源中国社区 [http://www.oschina.net]
以上就是本文的全部内容,希望本文的内容对大家的学习或者工作能带来一定的帮助,也希望大家多多支持 码农网
本站部分资源来源于网络,本站转载出于传递更多信息之目的,版权归原作者或者来源机构所有,如转载稿涉及版权问题,请联系我们。
WebKit技术内幕
朱永盛 / 电子工业出版社 / 2014-6 / 79.00元
《WebKit技术内幕》从炙手可热的HTML5 的基础知识入手,重点阐述目前应用最广的渲染引擎项目——WebKit。不仅着眼于系统描述WebKit 内部渲染HTML 网页的原理,并基于Chromium 的实现,阐明渲染引擎如何高效地利用硬件和最新技术,而且试图通过对原理的剖析,向读者传授实现高性能Web 前端开发所需的宝贵经验。 《WebKit技术内幕》首先从总体上描述WebKit 架构和组......一起来看看 《WebKit技术内幕》 这本书的介绍吧!