面向众核负载聚集模式的动态区域化层次一致性协议研究
批准号:
61572508
项目类别:
面上项目
资助金额:
65.0 万元
负责人:
王志英
依托单位:
学科分类:
计算机系统结构与硬件技术
结题年份:
2019
批准年份:
2015
项目状态:
已结题
项目参与者:
马胜、刘真、刘芸、张光达、苏博、任珊珊、王琼、王鹏、赵夏
中文摘要
负载聚集模式给众核处理器结构,尤其是cache一致性协议的设计,带来了诸多挑战。高效一致性协议必须充分利用负载聚集模式的数据共享特性,在虚拟机内部提供低延迟的数据共享,在虚拟机之间提供低开销的数据共享,同时还应支持虚拟机动态迁移和区域隔离。区域化层次一致性协议具备满足这些需求的潜力,但现有设计只关注上层协议层,忽略了底层片上网络,导致它们在延迟、开销和支持虚拟机动态迁移及区域隔离等方面存在较大缺陷。本项目从协同设计一致性协议和片上网络的角度出发,充分利用片上网络的特性设计动态区域化层次一致性协议,在区域内研究监听协议以降低事务延迟,在区域间研究目录协议以优化带宽开销,将在面向负载聚集模式的一致性协议框架、基于无序网络的带宽优化监听协议、低开销低延迟的目录协议、片上网络对聚合通信和区域隔离的硬件支持等方面取得创新研究成果。这些成果可直接用于众核处理器设计,具有重要的理论意义和实用价值。
英文摘要
Workload Consolidation brings several challenges to the design of many-core architecture, especially the cache coherence protocol. An efficient coherence protocol must take full advantage of the data sharing characteristics of workload consolidation; it must provides low latency data sharing within a virtual machine (VM), and supports low cost data sharing between several VMs. Besides, the coherence protocol should allow the VM migration and provide region isolation. The hierarchical coherence protocol with dynamic regions has potential to meet these requirements. Yet, since existing work mainly focuses on protocol-level issues and ignores networks-on-chip (NoCs), it has significant limitations in the latency, cost, the support for VM migration and VM isolation and etc.. .We address these limitations by co-designing the coherence protocol and network-on-chip. We will make full use of the network-on-chip to design efficient hierarchical coherence protocols with dynamic regions. For the protocol maintaining coherence within a VM, we will research snoopy protocols to reduce the transaction latency. For the protocol maintaining coherence between several VMs, we will study directory protocols to reduce the bandwidth cost. We will obtain several innovation outcomes including the coherence protocol framework for workload consolidation, bandwidth efficient snoopy protocols on unordered NoC, low cost and low latency directory protocols, the NoC support for collective communications and region isolation. They could be used directly in current design of many-core platforms, and have important theoretical meanings and practical values.
当前面向众核负载聚集模式cache一致性协议的研究局限在上层一致性协议的实现,而忽略了底层片上网络的特性,这使得现有设计存在重大缺陷。本课题主要研究面向众核负载聚集模式的动态区域化层次一致性协议的关键技术,项目研究进展顺利,在向负载聚集模式的一致性协议框架、基于无序网络的带宽优化监听协议、低开销低延迟的目录协议、片上网络对聚合通信和区域隔离的硬件支持等方面取得了一些关键技术的突破和创新。在一致性协议框架方面提出了基于自更新的简单高效cache一致性协议来降低一致性协议的复杂性;提出了基于区域洪水路由的实时容错路由算法、高可靠性高性能路由器设计来提高路由算法以及路由器的容错性能;提出了自适应LLC设计来减少共享LLC设计带来的访问冲突。在无序网络上带宽优化的监听协议方面,提出了无冲突高带宽环链网络结构来消除互连网络中的报文冲突;提出了高带宽的层次交叉开关片上网络架构来解决全相连交叉开关的扩展性问题;提出了集群内访存合并机制来降低注入片上互连网络的报文数目。在低开销低延迟的目录协议方面,提出了低开销低延迟的无冲突片上网络来降低目录协议的延迟;提出了路由旁路机制、当值缓存机制和快速通道技术来缓解电源门控技术所造成的报文传输延迟增加的问题。在片上网络对聚合通信和区域隔离的硬件支持方面,提出了无缓存网络中区域化的路由算法来解决不同区域中的报文在传输过程中相互干扰的问题;提出了自适应的虚通道分配机制来解决静态划分机制不能适应流量变化的问题;提出了相同源节点的片上网络仲裁机制和面向目的节点的虚通道划分机制,有效地提高了存储控制器端接收到的访存通信请求的行缓存局部性。本课题的研究可以为众核负载聚集模式cache一致性协议的设计与实现奠定坚实的理论和技术基础,具有重要的理论意义和应用价值。本课题全面完成了研究计划。
期刊论文列表
专著列表
科研奖励列表
会议论文列表
专利列表
登录
查看更多内容
CGAcc: A Compressed Sparse Row Representation-Based BFS Graph Traversal Accelerator on Hybrid Memory Cube
CGAcc:混合内存立方体上基于压缩稀疏行表示的 BFS 图遍历加速器
DOI:
10.3390/electronics7110307
发表时间:
2018-11
期刊:
Electronics
影响因子:
2.9
作者:
[Cheng Qian, Bruce Childers, Libo Huang, Hui Guo, Zhiying Wang]
通讯作者:
Zhiying Wang
CD-Xbar: A Converge-Diverge Crossbar Network for High-Performance GPUs
CD-Xbar:适用于高性能 GPU 的收敛-发散交叉开关网络
DOI:
--
发表时间:
2019
期刊:
IEEE TRANSACTIONS ON COMPUTERS
影响因子:
3.7
作者:
[Xia Zhao, Sheng Ma, ZhiyingWang, Natalie Enright Jerger, Lieven Eeckhout]
通讯作者:
Lieven Eeckhout
DyCache: Dynamic Multi-Grain Cache Management for Irregular Memory Accesses on GPU
DyCache:针对 GPU 上不规则内存访问的动态多粒度缓存管理
DOI:
10.1109/access.2018.2818193
发表时间:
2018
期刊:
IEEE Access
影响因子:
3.9
作者:
[Guo Hui, Huang Libo, Lu Yashuai, Ma Sheng, Wang Zhiying]
通讯作者:
Wang Zhiying
FC-AMAT: factor-based C-AMAT analysis in memory system measurement
FC-AMAT:记忆系统测量中基于因子的 C-AMAT 分析
DOI:
10.1007/s11334-018-0313-x
发表时间:
2018-05
期刊:
Innovations in Systems and Software Engineering
影响因子:
1.2
作者:
[Qi Yu, Libo Huang, Cheng Qian, Jianqiao Ma, Zhiying Wang]
通讯作者:
Zhiying Wang
Improving the Efficiency of GPGPUWork-Queue Through Data Awareness
通过数据感知提高 GPGPUWork-Queue 的效率
DOI:
10.1145/3151035
发表时间:
2017
期刊:
ACM Transactions on Architecture and Code Optimization
影响因子:
1.6
作者:
[Huang Libo, Lu Yashuai, Shen Li, Wang Zhiying]
通讯作者:
Wang Zhiying
共 20 条
高效能众核异步微处理器设计关键技术研究
-
批准号:61272144
-
项目类别:面上项目
-
资助金额:80.0万元
-
批准年份:2012
-
负责人:王志英
-
依托单位:
片上众核集群体系结构关键技术研究
-
批准号:61070037
-
项目类别:面上项目
-
资助金额:33.0万元
-
批准年份:2010
-
负责人:王志英
-
依托单位:
多核异步数据触发微处理器设计关键技术研究
-
批准号:60873015
-
项目类别:面上项目
-
资助金额:37.0万元
-
批准年份:2008
-
负责人:王志英
-
依托单位:
异步微处理器设计关键技术研究
-
批准号:90407022
-
项目类别:重大研究计划
-
资助金额:40.0万元
-
批准年份:2004
-
负责人:王志英
-
依托单位:
网络中关键系统的灾难恢复技术
-
批准号:90104025
-
项目类别:重大研究计划
-
资助金额:20.0万元
-
批准年份:2001
-
负责人:王志英
-
依托单位:
支持面向对象处理的计算机体系结构研究
-
批准号:69073338
-
项目类别:面上项目
-
资助金额:3.0万元
-
批准年份:1990
-
负责人:王志英
-
依托单位:
国内基金
海外基金