大規模AI学習向け高速推論学習と省電力を両立する深層学習プロセッサのコデザイン
大規模AI学習向け高速推論学習と省電力を両立する深層学習プロセッサのコデザイン
批准号:
18J11572
负责人:
森 陽紀
金额:
$1.34万
依托单位:
依托单位国家:
日本
项目类别:
Grant-in-Aid for JSPS Fellows
财政年份:
2018
资助国家:
日本
项目状态:
已结题
起止时间:
2018-04-25 至 2020-03-31
中文摘要
本研究の目的は、アルゴリズムとハードウェアの両面から、システム全体の効率化・省電力化を図り、既存技術と比較してコスト対電力性能比2桁改善を実現する大規模深層学習に向けた高速かつ高効率な深層学習プロセッサを開発することである。本年度は、H29年度に開発したパイプライン並列型深層学習アルゴリズムで未解決となっていた、パイプライン学習実行時の認識精度向上を目指した最適関数の再設計及び、パイプライン深層学習メモリ転送量と通信レイテンシを2桁向上する、低電力メモリアーキテクチャの提案を行った。具体的には、パイプライン実行時の重み係数更新量の誤差を補完する適応型最適化関数の設計に取り組むと共に、各レイヤにおけるプロセッサ内部の演算コプロセッサとメモリ分割アーキテクチャの設計、畳み込み層・バッチ正規化層における高効率なMAC演算手法の設計に加え、プロセッサ間の外部通信のためのデータバス分割アーキテクチャの検討、外部データバスのデータフロー片方向制御によるメモリバンド幅削減手法の開発に取り組んだ。さらに、プロセッサ内の高速キャッシュメモリ(SRAM)の低消費電力化手法及び提案アーキテクチャをLSI上に実装し、その電力性能検証を行った。これらの成果は、国内及び国際学会に採択されているとともに、IEEEにおけるトップ学術論文誌に採録されている。今後、コプロセッサと申請者の開発したモデル並列アルゴリズム、メモリ分散アーキテクチャを統合し、FPGA上に深層学習プロセッサを実現することで、実際のレイヤ処理時間、メモリアクセス数、外部通信バンド幅や外部転送データ容量等の検証が必要となる。
英文摘要
本研究の目的は、アルゴリズムとハードウェアの両面から、システム全体の効率化・省電力化を図り、既存技術と比較してコスト対電力性能比2桁改善を実現する大規模深層学習に向けた高速かつ高効率な深層学習プロセッサを開発することである。本年度は、H29年度に開発したパイプライン並列型深層学習アルゴリズムで未解決となっていた、パイプライン学習実行時の認識精度向上を目指した最適関数の再設計及び、パイプライン深層学習メモリ転送量と通信レイテンシを2桁向上する、低電力メモリアーキテクチャの提案を行った。具体的には、パイプライン実行時の重み係数更新量の誤差を補完する適応型最適化関数の設計に取り組むと共に、各レイヤにおけるプロセッサ内部の演算コプロセッサとメモリ分割アーキテクチャの設計、畳み込み層・バッチ正規化層における高効率なMAC演算手法の設計に加え、プロセッサ間の外部通信のためのデータバス分割アーキテクチャの検討、外部データバスのデータフロー片方向制御によるメモリバンド幅削減手法の開発に取り組んだ。さらに、プロセッサ内の高速キャッシュメモリ(SRAM)の低消費電力化手法及び提案アーキテクチャをLSI上に実装し、その電力性能検証を行った。これらの成果は、国内及び国際学会に採択されているとともに、IEEEにおけるトップ学術論文誌に採録されている。今後、コプロセッサと申請者の開発したモデル並列アルゴリズム、メモリ分散アーキテクチャを統合し、FPGA上に深層学習プロセッサを実現することで、実際のレイヤ処理時間、メモリアクセス数、外部通信バンド幅や外部転送データ容量等の検証が必要となる。
期刊论文(0)
专著(0)
科研奖励(0)
会议论文
登录
查看更多内容
A 28-nm FD-SOI 8T Dual-Port SRAM for Low-Energy Image Processor With Selective Sourceline Drive Scheme
用于具有选择性源线驱动方案的低能耗图像处理器的 28 nm FD-SOI 8T 双端口 SRAM
DOI:
10.1109/tcsi.2018.2885536
发表时间:
2019
期刊:
IEEE Transactions on Circuits and Systems I: Regular Papers
影响因子:
--
作者:
[H. Mori, T. Nakagawa, Y. Kitahara, Y. Kawamoto, K. Takagi, S. Yoshimoto, S. Izumi, H. Kawaguchi, and M. Yoshimoto]
通讯作者:
and M. Yoshimoto
学習システム、学習方法、およびプログラム
学习系统、学习方法和项目
DOI:
--
发表时间:
2018
期刊:
影响因子:
--
作者:
[]
通讯作者:
28-nm FD-SOI Dual-Port SRAM with MSB-Based Inversion Logic for Low-Power Deep Learning
具有基于 MSB 的反转逻辑的 28 nm FD-SOI 双端口 SRAM,适用于低功耗深度学习
DOI:
--
发表时间:
2018
期刊:
影响因子:
--
作者:
[H. Mori, S. Izumi, H. Kawaguchi, M. Yoshimoto]
通讯作者:
M. Yoshimoto
分散深部学習におけるメモリと帯域幅削減のためのレイヤーブロックワイズパイプライン
用于减少分布式深度学习中的内存和带宽的分层分块管道
DOI:
--
发表时间:
2018
期刊:
影响因子:
--
作者:
[森 陽紀, 陽川 哲也, 和泉 慎太郎, 吉本 雅彦, 川口 博, 井上 敦樹]
通讯作者:
井上 敦樹
学習システム、処理装置、処理方法、およびプログラム
学习系统、处理装置、处理方法及程序
DOI:
--
发表时间:
2018
期刊:
影响因子:
--
作者:
[]
通讯作者: