시작하기 전에
이 15분 자습서에서는 Oracle Analytics에서 보고 및 분석을 위해 선별된 두 개의 데이터 집합으로 데이터 플로우를 생성하는 방법을 보여줍니다.
배경
이 자습서에서는 두 개의 스프레드시트 파일에서 생성된 데이터 집합을 사용하여 데이터 플로우를 생성합니다. 소스 데이터 집합을 변환 및 수정하여 선별된 데이터 집합을 생성하는 함수의 그래픽 표현을 사용하여 데이터 흐름에서 별도의 소스의 데이터를 결합하는 방법을 배웁니다.
데이터 플로우에서 변환 열을 사용하여 기부 데이터 집합을 수정하고, 열을 필터링, 추가하고, 열 단계를 선택합니다. zip stats 데이터 집합을 데이터 플로우에 추가하고 열을 변환하여 각 데이터 집합의 데이터를 조인합니다. 데이터 집합을 조인한 후 열 선택 단계를 사용할 필요가 없는 열을 제거합니다. Aggregate 단계를 추가하여 measure 열과 함께 사용되는 함수를 정의하고 표현식이 있는 열을 추가합니다. 모든 데이터 플로우는 데이터 집합 저장 단계로 끝납니다. 데이터 플로우를 실행하여 소스 데이터에서 데이터 집합을 생성합니다.
이 자습서는 Oracle Analytics Cloud에서 데이터 준비 및 분석 시리즈의 첫 번째 자습서입니다. 데이터 플로우를 사용하여 데이터 집합을 생성하는 방법을 배우려는 경우 첫번째 자습서 이후 시리즈를 종료할 수 있습니다. 자습서를 나열된 순서대로 읽습니다.
- 데이터 플로우 탐색
- 데이터 분석
- 집계된 데이터 집합 생성
필요 사항
- Oracle Analytics Cloud에 액세스
- 다음 소스 파일을 다운로드합니다.
데이터 집합 생성
이 절에서는 donation2024.xlsx 파일을 사용하여 데이터 세트를 만듭니다.
- Oracle Analytics에 사인인합니다.
- 홈 페이지에서 생성, 데이터 집합을 차례로 누릅니다.
- 데이터 집합 생성에서 여기에 데이터 파일 놓기 또는 눌러서 찾아보기를 누릅니다. 파일 업로드에서
donation2024.xlsx파일을 선택한 다음 열기를 누릅니다. - donation2024.xlsx의 데이터 집합 테이블 생성에서 확인을 누릅니다.
- 저장을 누릅니다
. 다른 이름으로 데이터 집합 저장에서 이름에 donations2024을 입력한 다음 확인을 누릅니다.
그림 donation_dataset.png에 대한 설명 - donations2024 데이터 집합 페이지에서 뒤로 이동
을 누릅니다.
두 번째 데이터 세트 추가
이 절에서는 donations2024 데이터 세트에 대한 인구 통계를 제공하는 데이터 세트를 만듭니다.
- 홈 페이지에서 생성, 데이터 집합을 차례로 누릅니다.
- 데이터 집합 생성에서 여기에 데이터 파일 놓기 또는 눌러서 찾아보기를 누릅니다. 파일 업로드에서
zip_stats.xlsx파일을 선택한 다음 열기를 누릅니다. - zip_stats.xlsx의 데이터 집합 테이블 생성에서 확인을 누릅니다.

그림 zip_stats_join_diagram.png에 대한 설명 - 저장을 누릅니다
. 다른 이름으로 데이터 집합 저장에서 이름에 zip stats을 입력한 다음 확인을 누릅니다. - 뒤로 이동
을 누릅니다.
데이터 플로우 생성
이 섹션에서는 데이터 플로우를 생성하고 데이터를 수정하는 단계를 추가합니다. 또한 데이터 집합에서 NULL 값을 제거하는 필터를 생성합니다.
- 홈 페이지에서 생성, 데이터 흐름을 차례로 누릅니다.
- 데이터 추가에서 donations2024 데이터 세트를 선택한 다음 추가를 누릅니다.
데이터 플로우가 첫번째 노드로 donations2024를 사용하여 열립니다.

그림 df_first_node.png에 대한 설명 - donations2024 노드에서 단계 추가(
)를 누릅니다. 필터
를 선택합니다. - 필터에서 필터를 추가하려면 여기를 누르거나 필터를 끄십시오를 선택합니다. 사용 가능한 데이터에서 DATE_COMPLETED을 선택합니다.
- DATE_COMPLETED의 일자 범위 아래에서 범위를 값으로 유지합니다. 첫번째 필드에 시작 날짜로
1/1/2019를 입력합니다. 두번째 필드에 종료 날짜로10/31/2023를 입력한 다음 대화상자 외부를 누릅니다.필터는 일자 완료 값이 없는 레코드를 제거합니다.

그림 date_completed_filter.png에 대한 설명 - Save를 누릅니다. 다른 이름으로 데이터 플로우 저장에서
School Donations을 입력한 다음 확인을 누릅니다.
표현식으로 열 추가
이 섹션에서는 표현식을 정의하여 열을 생성합니다. 이 자습서에서 복사하는 대신 수동으로 표현식을 입력합니다.
- 데이터 플로우 단계에서 열 추가를 끌어 필터 노드에서 단계 추가
를 수행합니다. 이름에 SCH_STATE을 입력합니다. 표현식 필드에 다음을 입력합니다.SUBSTRING(SCH_STATEZIP FROM 1 FOR 2) - 검증, 적용 순으로 누릅니다.

그림 add_column_sch_state.png에 대한 설명 - [열 추가]에서 열
을 누릅니다. 이름에 SCH_ZIP을 입력합니다. 표현식 필드에 다음을 입력합니다.CAST(SUBSTRING(SCH_STATEZIP FROM 4) AS int) - 검증, 적용 순으로 누릅니다.
- 열 추가
를 누릅니다. 이름에 YR_COMPLETED을 입력합니다. 표현식 필드에 다음을 입력합니다.YEAR(DATE_COMPLETED) - 검증, 적용을 차례로 누릅니다.
- SCH_ZIP 열을 선택하고 옵션
을 누른 다음 텍스트로 변환을 선택합니다. - 검증을 누르고 적용을 누르십시오.
- YR_COMPLETED 열을 선택하고 옵션
을 누른 다음 텍스트로 변환을 선택합니다. 검증, 적용 순으로 누릅니다.
그림 add_columns.png에 대한 설명
데이터 플로우에 데이터 집합 추가
이 섹션에서는 데이터 플로우에 zip stats 데이터 집합을 추가합니다.
- 데이터 플로우 단계에서 데이터 추가를 두 번 누릅니다. 데이터 추가에서 zip stats, Add 순으로 누릅니다.
- 조인 노드를 누르고 입력 1 목록에서 모든 행을 선택합니다. 일치 열에서 PROJECTID를 누르고 입력 1 값에 대해 SCH_ZIP를 선택합니다.
- zip stats 노드를 누릅니다. Zip 열을 선택하고 옵션
을 누른 다음 텍스트로 변환을 선택합니다. - 검증을 누르고 적용을 누르십시오.
Zip 열을 텍스트로 변환하면 데이터 세트 간의 조인이 검증됩니다.

그림 join_transformation.png에 대한 설명
열 선택
이 섹션에서는 조인된 데이터 집합에서 사용할 열을 선택합니다.
- 데이터 플로우 단계에서 조인 노드의 열 선택을 단계 추가
로 끌어옵니다.
그림 select_columns.png에 대한 설명 - 열 선택 아래에서 모두 제거를 누릅니다. 다음 열을 선택하고 선택한 항목 추가를 누릅니다.
- 프로젝트 ID
- SCHOOL_ID
- PRIMARY_FOCUS_SUBJECT
- RESOURCE_TYPE
- POVERTY_LEVEL
- GRADE_LEVEL
- STUDENTS_REACHED
- TOTAL_DONATIONS
- NUM_DONORS
- SCH_STATE
- SCH_ZIP
- 연도 완료
- Median
- 인구
- 데이터 플로우 단계에서 집계를 두 번 눌러 [열 선택] 노드에 이 단계를 추가합니다.
- 그룹화 기준에서 PROJECTID 행 옆에 있는
제거를 누릅니다. - 집계 아래의 함수 목록에서 다음 행에서 평균을 선택합니다.
- STUDENTS_REACHED
- TOTAL_DONATIONS
- NUM_DONORS
- Median
- 인구
- 집계에서 집계 추가를 누르고 PROJECTID를 선택합니다. 함수 목록에서 개수를 선택한 다음 새 열 이름에
Number of Projects를 입력합니다. 중간값 행의 새 열 이름에Income을 입력합니다.
그림 aggregate_columns.png에 대한 설명
집계 정의
이 섹션에서는 집계 단계를 사용하여 데이터 집합의 측정 단위 열에 사용할 함수를 설정합니다.
- 데이터 플로우 단계에서 열 추가를 집계 노드의 단계 추가
로 끌어옵니다. - 이름에
Donation by Population을 입력합니다. - 표현식 필드에 다음을 입력합니다.
TOTAL_DONATIONS Average/Population Average - 검증을 누릅니다. 적용을 누릅니다.
- [열 추가]에서 열
을 누릅니다. 이름에 Average School Donation by Income을 입력합니다. - 표현식 필드에 다음을 입력합니다.
avg(TOTAL_DONATIONS Average by SCHOOL_ID)/Income - 검증을 누르고 적용을 누르십시오.

그림 new_columns_after_join.png에 대한 설명
데이터플로우 저장 및 실행
이 섹션에서는 데이터 플로우 실행 결과를 가져온 데이터 집합의 이름을 지정하고 새 데이터 집합의 열을 검사합니다. 다음 튜토리얼에서는 학교별 기부금 데이터 세트를 사용합니다.
- 데이터 플로우 단계에서 데이터 집합 저장을 두 번 누릅니다.
- 데이터 세트 저장에서 이름에
Donations by School을 입력합니다. [데이터 저장]에서 데이터 집합 저장 영역을 선택하여 Oracle Analytics에 데이터를 저장합니다. - 프로젝트 수 행의 일자 세트 저장에서 기본 집계 열의 합계를 누르고 개수를 선택합니다.
- 모집단별 기부금 및 평균 학교 기부금 행의 기본 집계 열에서 합계를 누르고 평균을 선택합니다.
- Save를 누릅니다.

그림 add_columns_after_join.png에 대한 설명 - 데이터 흐름 실행을 누릅니다
. - 데이터 플로우 실행이 성공적으로 완료된 후 뒤로 이동
을 누릅니다. - 홈 페이지에서 데이터를 누른 다음 학교별 기부 데이터 집합을 선택합니다. 작업
을 누른 다음, 검사를 선택합니다. - 데이터 집합 대화상자에서 데이터 요소를 눌러 열을 봅니다.

그림 donationsbysch_datase.png에 대한 설명
다음단계
더 알아보기
Oracle Analytics의 데이터 흐름 살펴보기
G34665-02
2026년 7월
데이터 플로우를 구성 및 실행하여 Oracle Analytics에서 데이터 집합을 생성하는 방법을 알아봅니다.
본 소프트웨어 및 관련 설명서는 사용 제한 및 기밀 유지 규정을 포함하는 라이센스 합의서에 의거해 제공되며, 지적 재산법에 의해 보호됩니다. 라이센스 합의서에 명시적으로 허용되어 있거나 법률에서 허용하는 경우를 제외하고는 어떠한 형태나 어떠한 수단으로도 임의적인 부분을 사용, 복사, 재생성, 변환, 브로드캐스트, 수정, 라이센스, 전송, 배포, 공개, 수행, 게시 또는 표시할 수 없습니다. 상호 운용을 위해 법령상 요청된 경우를 제외하고, 본 소프트웨어를 역 분석, 분해 또는 역 파일링하는 것은 금지됩니다.
만일 본 소프트웨어나 관련 문서가 미국 정부기관 혹은 미국 정부기관을 대신하여 라이센스한 개인이나 법인에게 배송되는 경우, 다음 공지사항이 적용됩니다.
U.S. GOVERNMENT END USERS: Oracle programs (including any operating system, integrated software, any programs embedded, installed or activated on delivered hardware, and modifications of such programs) and Oracle computer documentation or other Oracle data delivered to or accessed by U.S. Government end users are "commercial computer software" or "commercial computer software documentation" pursuant to the applicable Federal Acquisition Regulation and agency-specific supplemental regulations. As such, the use, reproduction, duplication, release, display, disclosure, modification, preparation of derivative works, and/or adaptation of i) Oracle programs (including any operating system, integrated software, any programs embedded, installed or activated on delivered hardware, and modifications of such programs), ii) Oracle computer documentation and/or iii) other Oracle data, is subject to the rights and limitations specified in the license contained in the applicable contract. The terms governing the U.S. Government’s use of Oracle cloud services are defined by the applicable contract for such services. No other rights are granted to the U.S. Government.
본 소프트웨어 혹은 하드웨어는 다양한 정보 관리 애플리케이션의 일반적인 사용을 목적으로 개발되었습니다. 본 소프트웨어 혹은 하드웨어는 개인적인 상해를 초래할 수 있는 애플리케이션을 포함하여 본질적으로 위험한 애플리케이션에서 사용할 목적으로 개발된 것이 아니며, 그러한 용도로 사용될 수 없습니다. 만일 본 소프트웨어 혹은 하드웨어를 위험한 애플리케이션에서 사용할 경우, 라이센스 사용자는 해당 애플리케이션의 안전한 사용을 위해 모든 적절한 비상-안전, 백업, 대비 및 기타 조치를 반드시 취해야 합니다. Oracle Corporation과 그 자회사는 본 소프트웨어 혹은 하드웨어를 위험한 애플리케이션에서 사용함으로 인하여 발생하는 어떠한 손해에 대해서도 책임을 부담하지 아니합니다.
Oracle과 Java는 Oracle Corporation 및/또는 그 자회사의 등록상표입니다. 기타 명칭들은 각 소속 회사의 상표일 수 있습니다.
Intel 및 Intel Inside는 Intel Corporation의 상표 내지 등록상표입니다. SPARC 상표 일체는 라이센스에 의거하여 사용되며 SPARC International, Inc.의 상표 내지 등록상표입니다. AMD, Epyc, 및 AMD 로고는 Advanced Micro Devices의 상표 내지 등록상표입니다. UNIX는 The Open Group의 등록 상표입니다.
본 소프트웨어 혹은 하드웨어와 관련문서(설명서)는 제3자 컨텐츠, 제품 및 서비스에 대한 접속 내지 정보를 제공할 수 있습니다. 사용자와 오라클 간의 합의서에 별도로 규정되어 있지 않는 한 Oracle Corporation과 그 자회사는 제3자의 컨텐츠, 제품 및 서비스와 관련하여 어떠한 책임도 지지 않으며 그에 대한 일체의 보증을 명시적으로 부인합니다. Oracle Corporation과 그 자회사는 제3자의 컨텐츠, 제품 및 서비스에 접속 내지 이를 사용함으로 인해 초래되는 어떠한 손실, 비용 또는 손해에 대해 어떠한 책임도 부담하지 않습니다. 단, 사용자와 오라클 간의 합의서에 규정되어 있는 경우는 예외입니다.