플랫 파일을 업로드하는 방법 SAP HANA: CSV, XLS 및 XLSX

⚡ 스마트 요약

플랫 파일 업로드 SAP HANA는 ETL 도구 없이 클라이언트 컴퓨터에서 CSV, XLS 및 XLSX 데이터를 직접 로드합니다. HANA Studio는 열 이름과 데이터 형식을 제안한 다음 소스 열을 새 테이블 또는 기존 테이블에 매핑합니다.

  • 📄 지원되는 형식 : 클라이언트 시스템에 저장된 CSV, XLS 및 XLSX 파일을 직접 불러올 수 있습니다.
  • 🛠️ ETL 작업이 필요 없습니다. 이 기능은 기존의 제어 파일 및 SLT, BODS 또는 DXC 요구 사항을 제거합니다.
  • 🧱 테이블 요구 사항: 테이블은 이미 존재하거나 가져오기 과정에서 생성되어야 합니다. 기존 테이블에는 레코드가 추가됩니다.
  • 🧭 진입 지점: 빠른 보기, 가져오기 순으로 진행 SAP 로컬 파일의 HANA 콘텐츠 및 데이터.
  • ⚙️ 파일 옵션: 헤더 행, 전체 데이터 또는 행 범위 가져오기, 앞뒤 공백 무시.
  • 🔗 지도ping 모드 : 일대일 매핑은 열 순서를 기준으로 하며, 이름으로 매핑은 열 이름을 일치시켜 수행합니다.
  • 완료 확인: 데이터가 신뢰할 수 있게 되려면 작업 로그 항목에 "성공적으로 완료됨"이라고 표시되어야 합니다.

SAP HANA 플랫 파일 업로드 CSV XLSX

SAP HANA는 ETL 도구(SLT, BODS 및 DXC) 없이 파일에서 데이터 업로드를 지원합니다. HANA Studio의 새로운 기능입니다. Revision 28(SPS04)입니다.

SAP HANA는 클라이언트 시스템에서 사용할 수 있는 다음과 같은 유형의 파일을 지원합니다.

  • .CSV(쉼표로 구분된 값 파일)
  • . XLS
  • .XLSX

이 옵션을 사용하기 전에 사용자는 제어 파일(.CTL 파일)을 생성해야 합니다. 데이터를 업로드하려면 SAP HANA, 테이블이 존재해야 합니다. SAP HANA 환경에서, 테이블이 이미 존재하는 경우 레코드는 테이블 끝에 추가되고, 테이블이 없는 경우 테이블을 생성해야 합니다.

이 애플리케이션은 새 테이블에 대한 열 이름과 데이터 유형을 제안합니다.

업로드 전: 파일 준비 체크리스트

대부분의 업로드 실패는 HANA 문제가 아니라 파일 자체의 문제로 발생하며, 이러한 문제는 부분 로드 후에 해결하는 것보다 시작하기 전에 해결하는 것이 비용이 훨씬 적게 듭니다.

  • 헤더 행 하나만 있고, 셀 병합은 없습니다. 마법사는 머리글에서 열 이름을 제안합니다. 병합된 셀, 머리글 위에 있는 제목 행 또는 첫 번째 행이 비어 있는 경우에는 의미 없는 열 이름이 생성됩니다.
  • 열 이름에는 공백이나 특수 문자를 사용하지 마십시오. 제안된 테이블 열은 헤더 텍스트를 상속합니다. Sales Org와 같은 이름은 나중에 모든 쿼리에서 큰따옴표를 사용해야 하는 어색한 식별자가 됩니다.
  • 각 열의 데이터 형식이 일관적입니다. 숫자와 하나의 텍스트 항목이 포함된 열이 문자로 처리될 경우, 이후의 모든 계산에 변환이 필요합니다.
  • 날짜는 모호하지 않은 형식으로 표시됩니다. YYYY-MM-DD 형식은 로드 과정에서 조용히 오류를 발생시키는 날짜와 월의 모호함을 제거합니다.
  • 숫자 열에 천 단위 구분 기호를 사용하지 마십시오. 1,000이라는 값은 숫자가 아닌 텍스트로 읽힙니다.
  • CSV 파일의 인코딩이 올바릅니다. UTF-8은 비ASCII 문자를 그대로 유지합니다. 다른 인코딩 방식은 이러한 문자를 나중에 수정하기 어려운 대체 문자로 변환합니다.
  • 데이터가 있는 워크시트는 하나뿐입니다. XLSX 파일의 경우, 추가 시트와 숨겨진 행으로 인해 행 수 계산이 혼란스러워지는 경우가 많습니다.

해당 파일을 몇 분 동안 살펴보면 HANA가 볼 수 있는 값에서 각 열을 추론하기 때문에 유형 제안이 더 정확해집니다. 유형 동작에 대한 자세한 내용은 다음을 참조하십시오. SAP HANA 데이터 유형.

플랫 파일에서 다음으로 데이터를 업로드하는 방법 SAP HANA

플랫 파일에서 데이터를 업로드하는 단계 SAP HANA는 아래와 같습니다.

  • 다음에서 테이블을 생성합니다. SAP HANA
  • 로컬 시스템의 데이터로 파일 생성
  • 파일을 선택하십시오
  • 지도 관리하기pings
  • 데이터로드

다음에서 테이블을 생성합니다. SAP HANA

테이블이 존재하지 않는 경우 SAP HANA를 사용하면 다음과 같이 테이블을 만들 수 있습니다. SQL 스크립트 또는 이 프로세스를 선택하여 "새로운" 옵션을 선택합니다.

새 테이블을 생성하려면 “NEW” 옵션을 사용하겠습니다.

로컬 시스템의 데이터로 파일 생성

판매 조직 마스터 데이터를 업로드할 예정입니다. 따라서 로컬 시스템에 .csv 파일과 .xls 파일을 만듭니다.

SalesOrg.xlsx 파일을 업로드하겠습니다. SAP HANA이므로 로컬 시스템에 SalesOrg.xlsx 파일을 생성했습니다.

판매 조직 이름 환율 CoCode 주소 국가 Ref_Sorg
1000 ABC Pvt. 주식회사 USD 1000 뉴욕 USA 1000
2000 ABC 기업 INR 2000 인도 인도 2000

파일을 선택하십시오

단계 1) 모델러 관점을 열고 -> '메인 메뉴' -> '도움말' -> '빠른 보기'를 선택하세요(아래 그림 참조).

테이블 생성 SAP HANA

아래와 같이 Quick View 화면이 나타납니다.

테이블 생성 SAP HANA

빠른 보기에서 '가져오기' 옵션을 선택합니다. 가져오기 옵션에 대한 팝업이 표시됩니다.

테이블 생성 SAP HANA

가져오기 화면의 팝업이 표시됩니다. 이동 SAP HANA 콘텐츠 -> '로컬 파일의 데이터'.

테이블 생성 SAP HANA

[다음]을 클릭하세요. 파일 선택을 위한 팝업 창이 표시됩니다. 아래 단계를 따라 파일을 선택하세요.

  1. SalesOrg.xls 파일을 선택합니다.
  2. "열기"버튼을 클릭하십시오.

테이블 생성 SAP HANA

가져올 파일을 선택하는 화면이 표시되며, 이 화면에서 로컬 시스템에서 데이터를 불러올 파일을 선택할 수 있습니다. SAP HANA 데이터베이스.

사용 가능한 옵션은 세 가지 주요 영역으로 분류될 수 있습니다.

  • 소스 파일 섹션
  • 파일 세부 정보 섹션
  • Target 작업대

단계 2) 이 단계에서는 다음 세부 정보를 입력해야 합니다.

  1. 파일 선택 – 선택된 파일 경로가 여기에 표시됩니다.
  2. 헤더 행이 존재합니다 – SalesOrg.xls 파일에 헤더(열 이름)가 있는 경우. 그래서 우리는 그것을 체크했습니다.
  3. 모든 데이터 가져오기 – 파일에서 모든 데이터를 가져오려면 이 옵션을 선택하고, 그렇지 않으면 파일에서 특정 데이터를 로드할 시작 줄과 끝 줄을 언급하세요.
  4. 선행 및 후행 공백 무시 파일의 앞뒤 공백을 무시하려면 이 옵션을 선택하세요.
  5. Target 테이블 – 신규테이블이 존재하지 않는 경우 SAP HANA를 선택하려면 이 옵션을 선택하고 기존 스키마 이름과 생성할 테이블 이름을 제공하십시오.
  6. Target 표 – 기존테이블이 존재하는 경우 SAP HANA을 탭한 다음 이 옵션을 선택하십시오. 스키마 이름과 테이블을 선택합니다. 데이터는 테이블 끝에 추가됩니다.
  7. "다음"버튼을 클릭하십시오

테이블 생성 SAP HANA

지도 관리하기pings

지도ping 지도를 실행하는 데 화면이 사용됩니다.ping 소스 열과 대상 열 사이.

지도에는 두 가지 유형이 있습니다.ping 사용 가능합니다. 클릭하면 테이블 생성 SAP HANA 아래와 같이 두 가지 옵션이 제공됩니다.

  • 1-1: 이 옵션을 사용하면 순서에 따라 열과 열을 매핑할 수 있습니다. 모든 열이 순서대로 되어 있다는 것을 알고 있는 경우 이 옵션을 사용할 수 있습니다.
  • 이름별 지도: 이 옵션을 사용하면 이름을 기준으로 소스 컬럼과 대상 컬럼을 매핑할 수 있습니다. 열 이름이 동일하다는 것을 알고 있는 경우 사용할 수 있습니다.

지도ping 출처에서 Target - 여기서 소스 파일 열을 다음으로 매핑하겠습니다. Target 테이블뿐만 아니라 대상 테이블 정의도 변경할 수 있습니다.

  1. 소스 파일에서 제안된 테이블 구조 - 테이블 열 이름은 Excel 파일 열 이름(헤더)에서 가져온 것입니다.
  2. Target 테이블 구조 : Target 기본적으로 테이블 저장소 유형은 열 저장소로 선택됩니다.
  3. 파일 이름을 클릭하고 대상 필드로 드래그하면 파일이 매핑됩니다. 필드는 일대일 또는 이름으로 매핑하는 옵션을 사용하여 자동으로 매핑할 수 있습니다. 수동으로 매핑하는 것도 가능합니다.ping 위의 옵션으로 열 이름을 매핑할 수 없는 경우 드래그 앤 드롭 옵션을 사용합니다. 지도 관리하기pings
  4. 같은 화면의 파일 데이터 섹션에서 소스 파일의 모든 열에 대한 데이터가 어떻게 표시되는지 확인할 수 있습니다. 파일 데이터 섹션에는 SalesOrg 파일의 데이터가 표시됩니다.
  5. "다음"버튼을 클릭하십시오.

지도 관리하기pings

로컬 파일에서 데이터를 가져오기 위한 창이 나타납니다.

데이터로드

로딩 프로세스를 시작하기 전 마지막 화면입니다. 이 화면에서는 테이블에 이미 존재하는 데이터와 데이터를 로드할 테이블 및 스키마에 대한 정보가 표시됩니다.

  1. 세부 섹션이 섹션에서는 선택한 소스 파일 이름을 입력합니다. Target 테이블 이름 및 Target 스키마 이름 세부 정보가 표시됩니다.
  2. 파일의 데이터: 데이터가 표시됩니다.trac파일에서 가져온 테드.
  3. 파일 데이터 섹션에 표시된 데이터가 검증되면 '마침'을 클릭하여 테이블에 데이터 로드를 시작합니다.

데이터로드

가져오기 옵션이 성공적으로 완료되면 작업 로그 보기에서 '성공적으로 완료됨' 상태의 항목을 확인할 수 있습니다.

데이터로드

데이터 가져오기 작업이 성공하면

  1. 아래 그림과 같이 해당 스키마의 테이블을 선택하고 테이블을 마우스 오른쪽 버튼으로 클릭한 다음 '데이터 미리보기'를 선택하면 테이블의 데이터를 확인할 수 있습니다.
  2. 테이블의 데이터는 아래와 같이 데이터 미리보기 화면에 표시됩니다.

데이터로드

일반적인 플랫 파일 업로드 오류

마법사는 관대하지만, 이는 양날의 검과 같습니다. 어떤 문제는 명확한 오류를 표시하지만, 어떤 문제는 잘못된 결과를 조용히 출력합니다. 두 가지 유형의 오류 모두 여기에 나열되어 있습니다.

징후 원인 수정
열 이름은 COL1, COL2와 같이 표시됩니다. '머리글 행 존재' 옵션이 선택되어 있지 않습니다. 파일 세부 정보 화면으로 돌아가서 해당 항목을 선택하세요.
길이 오류로 인해 로드가 실패했습니다. 제안된 열 길이가 파일 아래쪽에 있는 값보다 짧습니다. 지도에서 열을 넓히세요ping 화면 로딩 전
Numbers 텍스트로 도착합니다 천 단위 구분 기호 또는 열에 잘못된 텍스트 값이 있는 경우 원본 열을 정리하고 다시 로드합니다.
날짜가 잘못되었거나 거부되었습니다. 날짜 형식이 모호하거나 지역별로 다릅니다. 파일 형식을 YYYY-MM-DD 형식으로 변경하세요.
행이 중복되었습니다 기존 항목이 선택되었고 로드가 반복되었습니다. 데이터는 추가되는 것이지 덮어쓰는 것이 아닙니다. 테이블을 비운 후 다시 로드하세요.
악센트가 있는 문자가 손상되었습니다. UTF-8이 아닌 인코딩으로 저장된 CSV 파일 UTF-8 형식으로 다시 저장하고 다시 로드하세요.
예상보다 적은 행이 로드되었습니다. 모든 데이터 가져오기 대신 시작 및 종료 줄이 설정되었습니다. 모든 데이터 가져오기를 선택하세요

중복 생성 사례가 특히 주의해야 할 부분입니다. 기존 테이블을 선택하면 항상 데이터가 추가되므로, 테이블을 비우지 않고 실패한 로드 작업을 다시 실행하면 데이터가 자동으로 두 배로 늘어납니다.

플랫 파일 업로드와 다른 프로비저닝 방식 비교

일반 파일 업로드는 가장 간단한 옵션이지만 가장 제한적인 옵션이기도 합니다. 이 옵션의 한계를 알면 예약 업로드 방식이 필요한 상황에서 일반 파일 업로드 방식이 사용되는 것을 방지할 수 있습니다.

매개 변수 플랫 파일 업로드 SLT 데이터 서비스
자동화 수동만 예약 또는 실시간 예약
반복 가능 아니요, 모든 작업은 수작업으로 진행됩니다. 가능 가능
변환 세로형 지도ping 만 간단한 규칙 풍부한 변화
음량 작은 파일 큰 테이블 크고 이질적인
설정 노력 없음 SLT 서버 데이터 서비스 환경
가장 좋은 프로토타입ping작은 참조 데이터 실시간 운영 데이터 여러 출처를 통합합니다

규칙은 간단합니다. 만약 동일한 파일이 다음 달에도 다시 로드될 예정이라면, 해당 로드는 다음 단계에 속합니다. 데이터 서비스 or SLT 마법사처럼 누군가가 실행을 기억해야 하는 것이 아니라, 모든 옵션이 비교됩니다. 데이터 프로비저닝 튜토리얼과 파일 메뉴 내의 해당 옵션은 다음과 같이 설명되어 있습니다. SAP HANA 가져오기 및 내보내기.

자주 묻는 질문

아니요, 데이터가 추가됩니다. 테이블을 비우지 않고 다시 로드를 실행하면 모든 행이 복제되는데, 이것이 업로드 후 예상치 못한 합계가 발생하는 가장 일반적인 원인입니다.

네, 지도상에서요.ping 로딩 전 화면입니다. 이 제안은 HANA에서 볼 수 있는 값을 기반으로 하므로 향후 파일에서 더 긴 값을 포함할 수 있는 모든 영역을 넓히십시오.

AI는 먼저 파일의 프로파일링을 수행하여 일관되지 않은 유형, 중복 키 및 인코딩 문제를 감지하므로 마법사가 이러한 문제를 해결하기 위한 구조를 제안하기 전에 문제가 수정됩니다.

예. 파일과 테이블의 이름이 다른 경우, 의미론적 매칭은 일대일 매칭이나 이름 기반 매핑으로는 찾을 수 없는 쌍을 제안하므로 예외 사항만 확인하면 됩니다.

아니요. 마법사는 대화형 방식이므로 사람이 직접 실행해야 합니다. 반복적인 파일 로드는 데이터 서비스 또는 이와 유사한 예약된 프로세스에서 수행해야 합니다.

이 게시물을 요약하면 다음과 같습니다.