15:: 情報:パイプラインビルダーの上部にある16:: [データをインポート]
23:: メモ:Google ドライブの接続を以前に追加している場合は、左側のパネルから24:: [保存済みの接続]25:: カテゴリーをクリックし、インポートに進みます。保存済みの接続について詳しくは、26:: こちら27:: をクリックしてください。
30:: メモ:31:: 新しいGoogle ドライブアカウントを追加するには、32:: [新しく追加]33:: リンクをクリックします。Google ドライブの接続は、必要な数だけ作成できます。
34:: 4. Googleアカウントを認証します。初回は、DataPrepによるファイルへのアクセスを許可する必要があります。
36:: 5. インポートするファイルを選択し、37:: [インポート]38:: ボタンをクリックします。39:: [自分と共有]または[共有ドライブ]40:: タブからファイルを選択することもできます。41:: 詳細選択オプションを使用して、特定のパターンに一致するファイルをインポートすることもできます。42:: こちらをクリック43:: すると、詳細を確認できます。
70:: 8. 71:: インポートが完了したら、ETLパイプラインに変換を適用できます。72:: ステージを右クリックして73:: [データの準備]74:: オプションを選択し、75:: DataPrep Studioページでデータを準備することもできます。76:: こちら77:: から変換の詳細を確認できます。
81:: メモ:パイプラインに出力先を追加した後、82:: まず手動実行でパイプラインを実行してみることができます。手動実行が正常に動作することを確認したら、83:: スケジュール84:: を設定してパイプラインを自動化できます。実行タイプの違いについては85:: こちら86:: をご参照ください。
89:: 1. 90:: [詳細選択]91:: リンクをクリックします。
92:: 詳細選択を使用すると、正規表現に基づいて動的にファイルを選択できます。これにより、93:: Google ドライブのフォルダーから新規データや増分データを取得できます。指定したデータ間隔内に、ファイルパターンに一致する新規追加または変更されたファイルが、94:: Google ドライブのフォルダーから取得されます。95:: 増分取得の詳細については、96:: こちらをご参照ください。
101:: 2. 次の詳細を入力します。
102:: [フォルダー103:: の選択]104:: :データのインポート元の105:: フォルダーを選択します。
112:: 情報:113:: フォルダーのパス114::では、大文字と小文字が区別されます。
115:: [サブフォルダーを含める]116:: :ファイルの検索時にサブフォルダーも対象にする場合は、117::[サブフォルダーを含める]118::チェックボックスを選択します。119:: こちらをクリック120::すると、このオプションの制限事項を確認できます。
124:: 情報:125:: ファイルパターンでは、大文字と小文字が区別されます。
126:: メモ:127:: ファイルパターンの照合には、単純な正規表現形式が使用されます。たとえば、128:: 次のようなファイル名のファイルを取得するには、129:: Sales_2022.csv、Sales_2023.csv、Sales_2024.csv130:: 、パターンとして131:: Sales_.*を入力します。
132:: 同様に、次のようなファイルを取得するには、133:: PublicData1.csv、PublicData2.csv、PublicData3.csv134:: 、135:: Public.*を使用します。
136:: 1件のファイルのみをインポートする場合は、137::完全なファイル名をパターンとして指定します。
138:: 例:139:: leads_jan_2022.*
140:: [ファイルのパスワード]:141:: ファイルがパスワードで保護されている場合は、パスワードを入力します。
144:: このオプションを使用すると、インポート後にユニオンを実行することなく、インポート時にファイルを統合できます。
145:: 情報:146:: このオプションで一度に統合できるファイルは、最大5件です。
147:: メモ:148:: このチェックボックスを選択しない場合、一度に取得されるファイルは1件のみです。
169:: メモ:170:: このチェックボックスを選択しない場合、一度に取得されるシートは1件のみです。
180:: ファイル解析181:: とは、インポート時にファイルを読み取って構造化し、処理できるようデータを行と列に正しく整理するプロセスです。
182:: 183:: ファイル解析184:: には、185:: 自動解析186:: と187:: カスタム解析188:: の2つのオプションがあります。
193:: カスタム解析194:: には、次のオプションがあります。
195:: [ファイルの文字コード]:196:: [ファイルの文字コード]オプションで、UTF-8などの197:: 文字コード方式198:: を使用してファイルをエンコードできます。
199:: [テキスト修飾子]:200:: 単一引用符(')や二重引用符(')など、テキスト項目の開始位置と終了位置を示す文字を指定できます。
201:: [区切り文字]:202:: コンマ(,)、セミコロン(;)、スペース、タブ、パイプ(|)などの区切り文字を使用して、データを分割できます。独自の区切り文字を指定できる203:: [カスタム区切り文字]204:: オプションもあります。
205:: [先頭行をスキップ]:206:: ファイルの先頭から指定した行数を解析対象から除外します。
207:: [コメント文字]:208:: コメント行の先頭文字を指定します。コメント行はインポート時にスキップされます。
209:: [エスケープ文字]:210:: 区切り文字や引用符を通常のテキストとして扱うために使用するエスケープ文字を指定します。使用可能なオプションには、二重引用符(')、バックスラッシュ()、パイプ(|)、キャレット(^)、チルダ(~)があります。
211:: [スペースを自動的に削除]:212:: データのインポート時に、すべての列の先頭と末尾にある空白を削除します。
213:: [データに見出しを含む]:214:: 列見出しとして使用する行番号を指定します。
218:: 1.219:: [220:: サブフォルダーを含める221:: ]オプションを使用すると、222:: 1つのサブフォルダー、または223:: [224:: マイドライブ225:: 自分と共有、226:: または227:: 共有ドライブ228:: ]フォルダー全体のすべてのサブフォルダーからのみ、ファイルを取得できます。229:: 特定の230:: フォルダー内のすべてのサブフォルダーからファイルを取得することは231:: できません。
232:: 2. 233:: 1つの234:: サブフォルダー235:: からファイルを取得するには236:: 、[フォルダーのパス]に237:: サブフォルダーの正確なパスを入力します。238:: 例:239:: 2023/jan240:: /. 241:: 必須項目を入力します。指定したファイルパターンに一致するファイルが、指定したフォルダーから取得されます。
255:: 関連情報
258:: クラウドデータベースからデータをインポートするには
259:: 保存済みのデータ接続からデータをインポートするには