Parallel Sequence Mining on Shared-Memory Machines
Parallel Sequence Mining on Shared-Memory Machines
复制标题
DOI:
10.1006/jpdc.2000.1695
复制
发表时间:
1999-08
期刊:
影响因子:
--
通讯作者:
Mohammed J. Zaki
中科院分区:
文献类型:
--
作者:
Mohammed J. Zaki
We present pSPADE, a parallel algorithm for fast discovery of frequent sequences in large databases. pSPADE decomposes the original search space into smaller suffix-based classes. Each class can be solved in main-memory using efficient search techniques, and simple join operations. Further each class can be solved independently on each processor requiring no synchronization. However, dynamic inter-class and intra-class load balancing must be exploited to ensure that each processor gets an equal amount of work. Experiments on a 12 processor SGI Origin 2000 shared memory system show good speedup and excellent scaleup results.