并行数据加载

并行数据加载可以引用可用于优化数据加载管道的五个阶段的并行线程处理方法。它还可以指同时导入多个数据文件。

在数据加载管道中并行化线程

并行数据加载的一个方面介绍了可以使用配置设置 DLTHREADSPREPAREDLTHREADSWRITE 实现的管道优化。虽然为数据加载分配的最小和默认线程数为 5(每个管道阶段一个线程),但通过这些设置,您可以将线程添加到管道中的选定阶段。例如,通过以下配置,可以将“准备和写入”阶段中使用的线程从 1 个增加到 4 个:


DLSINGLETHREADPERSTAGE Sample Basic FALSE
DLTHREADSPREPARE Sample Basic 4
DLTHREADSWRITE Sample Basic 4

通过上述配置,数据加载设置为使用 11 个线程运行。

注意:

并行数据加载操作不会动态创建线程,而是使用来自预创建的线程池的设定的线程数。您可以定制线程池的大小。有关详情,请参阅工作中心

并发导入数据文件

并行数据加载的另一个方面是将多个数据文件并发加载到 Essbase 多维数据集。使用大型数据集(例如,一组 10 个 2 GB 文件)时,并行加载数据源使您能够充分利用具有多个处理器和高性能存储子系统的现代服务器的 CPU 资源和 I/O 通道。

您还可以调整在多文件数据加载中使用的线程数。例如,在同时指定两个数据文件的同时指定上述配置会导致创建两个数据加载管道,每个管道具有 11 个线程。

要并行加载数据,请选择一个选项:

  • Essbase Web 界面中使用作业。请参阅加载数据

  • 使用多维数据集设计器。请参阅在多维数据集设计器中加载数据

  • 使用 MaxL ,通过使用通配符(* 和/或 ?)来匹配要使用的所有数据源文件,为 import data 语句指定多个数据文件。如有必要,使用 using max_threads 子句控制并行数据加载产生的线程数。