Combinaciones de miembros dispersos de grupo

Para mejorar el rendimiento de la carga de datos de almacenamiento de bloques (BSO) de Essbase, puede estructurar los datos para minimizar la cantidad de E/S de disco necesaria (lecturas y escrituras).

Esta sección no se aplica a los cubos de almacenamiento agregado.

La estrategia más eficaz para mejorar el rendimiento es minimizar el número de E/S de disco que Essbase debe realizar al leer o escribir en el cubo. Debido a que Essbase carga bloques de datos por bloque, la organización de los datos de origen para que se correspondan con la organización de bloques físicos reduce el número de E/S de disco físico que debe realizar Essbase.

Organice los datos de origen para que los registros con la misma combinación única de dimensiones dispersas se agrupen. Esta disposición corresponde a bloques de la base de datos.

Los ejemplos de este capítulo ilustran las formas en que se pueden organizar los datos siguiendo esta estrategia. Estos ejemplos utilizan un subconjunto del cubo Sample.Basic, como se describe a continuación:

Tabla 33-1 Dimensiones y valores para ejemplos

Dimensiones dispersas, sin atributos Dimensiones densas

Escenario (presupuesto, real)

Medidas (ventas, margen, costo de fabricación, ganancias)

Producto (cola, cerveza de raíz)

Año (Ene, Feb)

Mercado (Florida, Ohio)

 

Note:

Puesto que no carga datos en dimensiones de atributo, no son relevantes para esta discusión, aunque son dispersos.

Considere el siguiente origen de datos. Debido a que no se agrupa por combinaciones de miembros de dimensión dispersa, estos datos no se han ordenado de manera óptima. A medida que Essbase lee cada registro, debe tratar con diferentes miembros de las dimensiones dispersas.

Jan
Actual    Cola          Ohio      Sales    25
Budget    "Root Beer"   Florida   Sales    28
Actual    "Root Beer"   Ohio      Sales    18
Budget    Cola          Florida   Sales    30

El origen de datos anterior se carga lentamente porque Essbase accede a cuatro bloques en lugar de a uno.

El siguiente origen de datos, más organizado de forma óptima para el mismo cubo de Sample Basic, tiene registros ordenados por una combinación única de miembros de dimensión dispersa: Actual -> Cola -> Ohio. Essbase solo accede a un bloque para cargar estos registros:

Actual     Cola    Ohio    Jan   Sales     25
Actual     Cola    Ohio    Jan   Margin    18
Actual     Cola    Ohio    Jan   COGS      20
Actual     Cola    Ohio    Jan   Profit     5

Para optimizar los datos de origen y permitir la importación de muchas celdas por registro,

  1. Asegúrese de que los registros se agrupan por combinaciones únicas de miembros de dimensión dispersa.

  2. Ordene los registros para que la dimensión del registro para la que proporciona varios valores sea una dimensión densa.

En el siguiente ejemplo se utiliza un registro de cabecera para identificar los miembros de la dimensión Measures, que es densa. Los datos se ordenan primero por miembros de la dimensión densa Year y, a continuación, se agrupan jerárquicamente por miembros de las otras dimensiones. En cada registro se proporcionan varios valores para la dimensión Measures.

                                 Sales  Margin   COG  Profit
Jan Actual  Cola         Ohio       25      18    20       5
Jan Actual  Cola         Florida    30      19    20      10
Jan Actual  "Root Beer"  Ohio       18      12    10       8
Jan Actual  "Root Beer"  Florida    28      18    20       8

Observe que la cabecera y la primera línea de datos que requieren dos líneas en este ejemplo; el ejemplo anterior necesita cuatro líneas para los mismos datos.