内容简介:Paddle v0.11.1a2 发布了,PaddlePaddle (PArallel Distributed Deep LEarning 并行分布式深度学习)是百度研发的深度学习平台,具有易用,高效,灵活和可伸缩等特点,为百度内部多项产品提供深度学习算法支持。 ...
Paddle v0.11.1a2 发布了,PaddlePaddle (PArallel Distributed Deep LEarning 并行分布式深度学习)是百度研发的深度学习平台,具有易用,高效,灵活和可伸缩等特点,为百度内部多项产品提供深度学习算法支持。
本次更新主要带来了性能增益和存储优化,更新内容如下:
配置和环境:
model: SE-ResNet-150
Input: 3 x 224 x 224
batch_size: 25
CentOS 6.3, Tesla P40, single card.
优化前后对比
优化前
| Speed | Memory | |
|---|---|---|
| Fluid(before) | 1.95 sec/iter | 18341 MB |
| PyTorch | 1.154 sec/iter | 13359 MB |
| Fluid/PyTorch | 1.6898 | 1.3729 |
速度优化后
| Speed | Memory | |
|---|---|---|
| Fluid(opti_speed) | 1.45 sec/iter | 17222 MB |
| PyTorch | 1.154 sec/iter | 13359 MB |
| Fluid/PyTorch | 1.2565 | 1.2892 |
存储优化后
| Speed | Memory | |
|---|---|---|
| Fluid(opti_mem) | 1.93 sec/iter | 14388 MB |
| PyTorch | 1.154 sec/iter | 13359 MB |
| Fluid/PyTorch | 1.6724 | 1.0770 |
整体性能提升
issue 详情: #8990
训练时删除 GPU 内存
[WIP] 来自 C ++ 的 Feed 数据
添加基本的 RecordIO API
Polish C++ Reader operators
添加 DoubleBuffer Reader
下载地址:
【声明】文章转载自:开源中国社区 [http://www.oschina.net]
以上就是本文的全部内容,希望本文的内容对大家的学习或者工作能带来一定的帮助,也希望大家多多支持 码农网
本站部分资源来源于网络,本站转载出于传递更多信息之目的,版权归原作者或者来源机构所有,如转载稿涉及版权问题,请联系我们。
计算机程序的构造和解释
Harold Abelson、Gerald Jay Sussman、Julie Sussman / 裘宗燕 / 机械工业出版社 / 2004-2 / 45.00元
《计算机程序的构造和解释(原书第2版)》1984年出版,成型于美国麻省理工学院(MIT)多年使用的一本教材,1996年修订为第2版。在过去的二十多年里,《计算机程序的构造和解释(原书第2版)》对于计算机科学的教育计划产生了深刻的影响。第2版中大部分重要程序设计系统都重新修改并做过测试,包括各种解释器和编译器。作者根据其后十余年的教学实践,还对其他许多细节做了相应的修改。 海报:一起来看看 《计算机程序的构造和解释》 这本书的介绍吧!