Amazon RDS MS SQL Server へのデータのエクスポート

Amazon RDS MS SQL Server へのデータのエクスポート

お知らせ:当社は、お客様により充実したサポート情報を迅速に提供するため、本ページのコンテンツは機械翻訳を用いて日本語に翻訳しています。正確かつ最新のサポート情報をご覧いただくには、本内容の英語版を参照してください。


Zoho DataPrepでは、クラウドデータベースであるAmazon RDSにデータをエクスポートできます。Amazon RDSはAmazon Relational Database Serviceとも呼ばれ、データベースの設定、運用、拡張に役立ちます。

Amazon RDS MS SQL Serverにデータをエクスポートするには

1. 既存のパイプラインを開くか、新しいパイプラインを作成できます[ホーム]ページ、[パイプライン]タブ、または[ワークスペース]タブから)。50種類以上のデータソースからデータを取り込めます。

2. パイプラインビルダーページで、データフローの作成と各ステージへの必要な変換処理の適用が完了したら、ステージを右クリックし、[出力先を追加]を選択します。




3. [クラウドデータベース]カテゴリーから[Amazon RDS]を選択するか、検索ボックスで検索します。


メモ:Amazon RDSのデータ連携をすでに追加している場合は、保存済みのデータ連携セクションで既存のデータ連携を選択し、そのままエクスポートに進めます。

4. データに個人情報を含む列がある場合、個人情報の列セクションで、その一部またはすべての列を含めるか除外するかを選択できます。

個人情報を含む列を保護するために、以下のセキュリティ設定を適用することもできます。

A. データマスキング  
データマスキングでは、個人情報を保護するために、元のデータを「x」で隠します。

B. データトークン化 
データトークン化では、データ内の異なる値がそれぞれランダムな値に置き換えられます。出力内容は、統計的には元のデータと同一です。

C. なし
セキュリティ設定を使用しない場合は、[なし]を選択できます。





5. [次へ]をクリックし、[データベースサービス名]のドロップダウンで[Amazon RDS]を、[データベースの種類]のドロップダウンで[MS SQL Server]を選択します。

6. [データベース名][SQLサーバーのインスタンス名][エンドポイント]を入力し、データベースとのデータ連携を認証するための[ユーザー名][パスワード]を指定します。

7. データベースサーバーがSSL経由で暗号化されたデータを提供するように設定されている場合は、[SSLを使用する]チェックボックスを選択することもできます。

8. [データ連携名]に重複しない名前を入力し、[連携する]をクリックします。

メモ:データベースに接続できない場合は、クラウドデータベースにデータをエクスポートできるように、アプリでZoho DataPrepのIPアドレスが許可リストに登録されていることを確認してください。 こちらをクリックすると、Zoho DataPrepのIPアドレスを確認できます。



メモ:今後データをエクスポートする際に使用できるように、データ連携の設定が保存されます。認証情報は安全に暗号化されて保存されます。

9. クラウドデータベースとのデータ連携が完了したら、データのエクスポート方法とエクスポート先を選択できます。

10. 既存のテーブルにデータをエクスポートする場合は、[既存のテーブル]を選択し、データベース内の利用可能なテーブルのリストから1つ選択します。既存のテーブルを選択した場合、新しい行をテーブルに追加する方法は2通りあります。
  1. 新しい行をテーブルに追加する場合は、[追加する]を選択します。
  2. 新しく追加する行で既存の行を置換する場合は、ドロップダウンから[上書き]を選択します。


11. 新しいテーブルを作成してデータをエクスポートする場合は、[新しいテーブル]を選択し、[スキーマ名][テーブル名]を入力して、新しい行をテーブルに追加する方法を選択します。
  1. 新しい行をテーブルに追加する場合は、[追加する]を選択します。
  2. 新しく追加する行で既存の行を置換する場合は、ドロップダウンから[上書き]を選択します。
メモ:予約実行およびバックフィル実行では、最初のエクスポートは新しいテーブルに対して行われ、それ以降は既存のテーブルに対して行われます。その際、新しい行を既存のテーブルに追加するために、この設定が使用されます。


12. [保存する]をクリックします。エクスポート先を追加したら、まずパイプラインを手動で実行してみることをお勧めします。手動での実行が正常に機能することを確認した後、パイプラインを自動化するための予約を設定できます。実行の種類については、こちらをご参照ください。

情報:各実行は処理として保存されます。パイプラインを実行すると、データソースから取得したデータに、各ステージで適用済みの一連の加工処理が行われ、その後、エクスポート先にデータがエクスポートされます。この処理全体は、[処理]ページに記録されます。

13. 手動での実行がエラーなく成功すると、データが正常にエクスポートされます。クラウドデータベース内の既存のテーブルにデータをエクスポートする際、手動での実行が以下のデータ構造の照合エラーにより失敗した場合は、データ構造の照合手順を完了することで修正できます。

データ構造の照合は、データモデルの不整合によるエクスポートの失敗を防ぐDataPrepの便利な機能です。

メモ:新しいテーブルにデータをエクスポートし、予約実行を使用してパイプラインを自動化した場合でも、データ構造の照合が適用されます。新しいテーブルとして扱われるのは最初の予約実行時のみです。それ以降のエクスポートでは既存のテーブルとして扱われ、データ構造の照合が適用されます。
 




クラウドデータベースへのエクスポート時のデータ構造の照合

データ構造の照合は、データがエクスポート先にエクスポートされる前に行われます。データ構造の照合は、データモデルの不整合によるエクスポートの失敗を防ぐDataPrepの便利な機能です。データ構造の照合では、対象のクラウドデータベースのテーブルを基準データとして設定し、元データのデータセットの列を基準データのテーブルに合わせることができます。これにより、高品質なデータをクラウドデータベースに円滑にエクスポートできます。

メモ:データ構造の照合の失敗は、エクスポートの失敗ではありません。データ構造の照合は、データが実際にエクスポート先にエクスポートされる前に行われます。これにより、エクスポートの失敗につながる可能性があるスキーマやデータモデルのエラーを事前に検出し、エクスポートの失敗を防止できます。

データ構造の照合チェックに失敗した場合

1. エクスポート時にデータ構造の照合チェックが失敗した場合は、DataPrep Studioページに移動し、右上にあるデータ構造の照合アイコンをクリックして、[基準データを表示する]を選択します。基準データのデータモデルが、既存の元データのデータセットの上部に表示されます。一致する列が見つかった場合、元データのデータセットの列が基準データのデータセットの列に合うように自動的に配置されます。




データ構造の照合では、一致する列と不整合がある列に、それぞれ異なるアイコンや候補が表示されます。候補をクリックすると、既存の列を基準データの列に合わせるための変更をすばやく行うことができます。エラーを修正しやすくするため、クラウドデータベース内の基準データのモジュールが、データの基準データとして関連付けられます。DataPrep Studioページでは、データとテーブルの対応付け、および不整合がある箇所のエラーを確認できます。エラーアイコンにカーソルを合わせると問題の内容を確認でき、アイコンをクリックすると各エラーを解決できます。

メモ:標準では、すべての列がグリッド表示に表示されます。ただし、[すべての列]リンクをクリックすると、必要な表示項目で絞り込むことができます。
2. データ構造の照合に関するエラーの概要を確認するには、[概要を表示する]リンクをクリックします。概要には、データモデルの照合に関する各エラーと、それぞれのエラーに関連する列数が表示されます。必要なエラーが発生した列をクリックし、[適用する]をクリックすると、特定のエラーが発生した列を絞り込むことができます。



データ構造の照合に関するエラーの概要

  1. データ構造の照合エラーの欄には、エラーと各エラーに関連する列数が表示されます。
  2. 上部の欄には、エラーのカテゴリーと各カテゴリーのエラー数が表示されます。
  3. カテゴリーをクリックすると、パネル内で各カテゴリーに関連するエラーを絞り込むことができます。
  4. 標準の表示では、すべての列が表示されます。エラーのカテゴリーをクリックして該当する列の詳細を確認したり、[エラーのみ表示する]チェックボックスを選択して、エラーが発生した列のみを表示したりできます。
  5. データ構造の照合に関するエラーの概要で選択したフィルターは、DataPrep Studioページのグリッド表示にも適用されます。

データ構造の照合エラー

データ構造の照合で発生するエラーについて、以下で説明します。
  1. 不整合がある列:元データと基準データの不整合がある列がすべて表示されます。

    メモ。
    1. 基準データ内の必須ではない列は、対応する元データの列がある場合はその列と照合するか、無視できます。
    2. 基準データに存在しない元データの列は、エクスポートを続けるために照合または削除する必要があります。

    不整合がある列を表示している場合、[必須の列のみ表示する]を有効にすると、基準データで必須に設定されている列があるかどうかを確認し、それらを含めることができます。必須列のみを修正して、エクスポートに進むこともできます。


  1. データの種類の不整合:基準データの列とデータの種類が一致しない元データの列が表示されます。
  2. データの形式の不整合:基準データと日付、日時、時間形式が異なる元データの列が表示されます。
  3. 制約の不整合:基準データの列に設定されているデータの種類の制約と一致しない列が表示されます。列に制約を追加する方法については、こちらをクリックしてください。
  4. 必須列の不整合:基準データでは必須に設定されているものの、元データでは必須に設定されていない列が表示されます。

    メモ:必須列は、照合して必須に設定するまでエクスポート先にエクスポートできません。列の上部にあるアイコンをクリックすると、列を必須に設定できます。また、データの種類の変更の加工処理にある[必須に設定する(値が必ず入力されているようにする)]チェックボックスを使用して、列を必須に設定することもできます。
  5. データサイズの超過に関する警告:基準データで許可されている最大サイズを超えるデータが含まれる列を絞り込みます。

3. エラーを修正した後、パイプラインの作成画面に移動し、パイプラインを実行してデータをエクスポートします。手動での実行が正常に機能することを確認した後、パイプラインを自動化するための予約を設定できます。実行の種類については、こちらをご参照ください