GPUスパコンのための3倍・4倍精度線形演算ライブラリの開発に関する研究
GPUスパコンのための3倍・4倍精度線形演算ライブラリの開発に関する研究
批准号:
13J01290
负责人:
椋木 大地
金额:
$1.32万
依托单位国家:
日本
项目类别:
Grant-in-Aid for JSPS Fellows
财政年份:
2013
资助国家:
日本
项目状态:
已结题
起止时间:
2013-04-01 至 2015-03-31
中文摘要
本研究の目的は,GPUスパコンにおける3倍・4倍精度演算の実用化を目的として,GPUにおける高性能な3倍・4倍精度線形計算ライブラリの実現に向けた基礎研究を行うことであった.本年度は主として,GPUにおける複数の演算精度に対応した線形計算ライブラリの効率的な実装手法に関する研究を行った,その結果として,複数のNVIDIA GPUアーキテクチャに対応した高速な行列ベクトル積ルーチン(GEMV)の実装手法を開発した.本実装ではGPUにおけるプログラムの実行メカニズムをモデル化し,実行効率が最大となるようなスレッドブロックサイズを自動的に決定するオンライン自動チューニングを採用する.これにより既存の実装と比べ,実行環境や問題サイズに依存して生じる性能の変動を防ぎ,常に高い性能を維持できる.本手法は,ある線形計算を行うプログラム(例えばBLASルーチンなど)において演算精度が異なる複数バージョンを実装・最適化する上で有効であると考えられる.またこの他に,4倍精度演算手法の応用として,倍精度演算性能が単精度演算性能の1/32であるNVIDIA社の最新GPUにおいて,ソフトウェアエミュレーションによる疑似倍精度演算を実装し,倍精度行列積ルーチン(DGEMM)においてハードウェア処理による実装を上回る性能が得られることを示した.本年度に開発したGPU向けソフトウェアの一部は,オープンソースのライブラリとしてウェブ上で公開しており,今後も開発を継続する予定である.
英文摘要
本研究の目的は,GPUスパコンにおける3倍・4倍精度演算の実用化を目的として,GPUにおける高性能な3倍・4倍精度線形計算ライブラリの実現に向けた基礎研究を行うことであった.本年度は主として,GPUにおける複数の演算精度に対応した線形計算ライブラリの効率的な実装手法に関する研究を行った,その結果として,複数のNVIDIA GPUアーキテクチャに対応した高速な行列ベクトル積ルーチン(GEMV)の実装手法を開発した.本実装ではGPUにおけるプログラムの実行メカニズムをモデル化し,実行効率が最大となるようなスレッドブロックサイズを自動的に決定するオンライン自動チューニングを採用する.これにより既存の実装と比べ,実行環境や問題サイズに依存して生じる性能の変動を防ぎ,常に高い性能を維持できる.本手法は,ある線形計算を行うプログラム(例えばBLASルーチンなど)において演算精度が異なる複数バージョンを実装・最適化する上で有効であると考えられる.またこの他に,4倍精度演算手法の応用として,倍精度演算性能が単精度演算性能の1/32であるNVIDIA社の最新GPUにおいて,ソフトウェアエミュレーションによる疑似倍精度演算を実装し,倍精度行列積ルーチン(DGEMM)においてハードウェア処理による実装を上回る性能が得られることを示した.本年度に開発したGPU向けソフトウェアの一部は,オープンソースのライブラリとしてウェブ上で公開しており,今後も開発を継続する予定である.
期刊论文(0)
专著(0)
科研奖励(0)
会议论文
登录
查看更多内容
Linear Algebra Operations using Quadruple-precision Arithmetic on GPU
在 GPU 上使用四精度算术的线性代数运算
DOI:
--
发表时间:
2014
期刊:
影响因子:
--
作者:
[Daichi Mukunoki, Daisuke Takahashi]
通讯作者:
Daisuke Takahashi
Using Quadruple Precision Arithmetic to Accelerate Krylov Subspace Methods on GPUs
使用四精度算术在 GPU 上加速 Krylov 子空间方法
DOI:
10.1007/978-3-642-55224-3_59
发表时间:
2014
期刊:
Parallel Processing and Applied Mathematics-PPAM 2013, Part I, LNCS 8384
影响因子:
--
作者:
[Daichi Mukunoki, Daisuke Takahashi]
通讯作者:
Daisuke Takahashi
MaxwellアーキテクチャGPUにおける擬似倍精度演算を用いたDGEMMの実装と評価
Maxwell架构GPU上伪双精度DGEMM的实现与评估
DOI:
--
发表时间:
2014
期刊:
情報処理学会研究報告:ハイパフォーマンスコンピューティング
影响因子:
--
作者:
[Shinji Bono, Yoich Takanishi and Jun Yamamoto, 濱田雄太, 椋木大地,今村俊幸]
通讯作者:
椋木大地,今村俊幸
Kepler・MaxwellアーキテクチャGPUにおける性能が行列形状に依存しない高速なGEMVの実装
在Kepler/Maxwell架构GPU上实现性能不依赖于矩阵形状的高速GEMV
DOI:
--
发表时间:
2015
期刊:
影响因子:
--
作者:
[西上幸範, 伊藤弘明, 市川正敏, 椋木大地,今村俊幸,高橋大介]
通讯作者:
椋木大地,今村俊幸,高橋大介
DOI:
10.1109/pdp.2015.66
发表时间:
2015-03
期刊:
2015 23rd Euromicro International Conference on Parallel, Distributed, and Network-Based Processing
影响因子:
--
作者:
[Daichi Mukunoki;Toshiyuki Imamura;D. Takahashi]
通讯作者:
Daichi Mukunoki;Toshiyuki Imamura;D. Takahashi
共 7 条
Accurate matrix computations with numerical validation for next generation computers
-
批准号:20KK0259
-
项目类别:Fund for the Promotion of Joint International Research (Fostering Joint International Research (A))
-
资助金额:$5.91万
-
财政年份:2022
-
负责人:椋木 大地
-
依托单位:
海外基金