SnapLogic を使用して Amazon S3 を外部サービスと連携
SnapLogic は、ノーコードでデータ連携フローを作成できる iPaaS(Integration Platform as a Service)です。CData JDBC Driver と組み合わせることで、Amazon S3 を含む250を超える SaaS、ビッグデータ、NoSQL ソースのリアルタイムデータに SnapLogic ワークフローからアクセスできます。
CData JDBC Driver は、最適化されたデータ処理機能を内蔵しており、リアルタイム Amazon S3 のデータ とのやり取りにおいて比類ないパフォーマンスを発揮します。外部ツールから複雑な SQL クエリが発行されると、ドライバーはフィルタや集計などのサポートされている SQL 操作を Amazon S3 に直接プッシュし、サポートされていない操作(多くの場合、SQL 関数や JOIN 操作)は内蔵の SQL エンジンを使用してクライアント側で処理します。動的なメタデータクエリ機能により、ネイティブデータ型を使用して Amazon S3 のデータ を操作できます。
SnapLogic から Amazon S3 に接続
SnapLogic から Amazon S3 のデータ に接続するには、CData Amazon S3 JDBC Driver をダウンロードしてインストールします。インストールウィザードに従って進めてください。インストールが完了すると、JAR ファイルはインストールディレクトリ(デフォルトでは C:/Program Files/CData/CData JDBC Driver for Amazon S3/lib)に配置されます。
Amazon S3 JDBC Driver のアップロード
インストール後、Manager タブから SnapLogic 内の場所(例:projects/Jerod Johnson)に JDBC JAR ファイルをアップロードします。
接続の設定
JDBC Driver をアップロードしたら、Amazon S3 への接続を作成します。
- Designer タブに移動します
- Snaps から「JDBC」を展開し、「Generic JDBC - Select」snap をデザイナーにドラッグします
- Add Account をクリック(または既存のアカウントを選択)し、「Continue」をクリックします
- 次のフォームで、JDBC 接続プロパティを設定します:
- JDBC JARs に、先ほどアップロードした JAR ファイルを追加します
- JDBC Driver Class を cdata.jdbc.amazons3.AmazonS3Driver に設定します
JDBC URL を Amazon S3 JDBC Driver の JDBC 接続文字列に設定します。例:
jdbc:amazons3:AccessKey=a123;SecretKey=s123;RTK=XXXXXX;
注意:RTK はトライアルキーまたは製品キーです。詳細についてはサポートチームまでお問い合わせください。
組み込みの接続文字列デザイナー
JDBC URL の構築には、Amazon S3 JDBC Driver に組み込まれている接続文字列デザイナーを使用できます。JAR ファイルをダブルクリックするか、コマンドラインから JAR ファイルを実行してください。
java -jar cdata.jdbc.amazons3.jar
接続プロパティを入力し、接続文字列をクリップボードにコピーします。
Amazon S3 リクエストを認可するには、管理者アカウントまたはカスタム権限を持つIAM ユーザーの認証情報を入力します。AccessKey をアクセスキーID に設定します。SecretKey をシークレットアクセスキーに設定します。
Note: AWS アカウント管理者として接続できますが、AWS サービスにアクセスするにはIAM ユーザー認証情報を使用することをお勧めします。
尚、CData 製品はAmazon S3 のファイルの一覧表示やユーザー管理情報の取得用です。S3 に保管されているExcel、CSV、JSON などのファイル内のデータを読み込みたい場合には、Excel Driver、CSV Driver、JSON Driver をご利用ください。
アクセスキーの取得
IAM ユーザーの資格情報を取得するには:
- IAM コンソールにサインインします。
- ナビゲーションペインで「ユーザー」を選択します。
- ユーザーのアクセスキーを作成または管理するには、ユーザーを選択してから「セキュリティ認証情報」タブを選択します。
AWS ルートアカウントの資格情報を取得するには:
- ルートアカウントの資格情報を使用してAWS 管理コンソールにサインインします。
- アカウント名または番号を選択し、表示されたメニューで「My Security Credentials」を選択します。
- 「Continue to Security Credentials」をクリックし、「Access Keys」セクションを展開して、ルートアカウントのアクセスキーを管理または作成します。
AWS ロールとして認証
多くの場合、認証にはAWS ルートユーザーのダイレクトなセキュリティ認証情報ではなく、IAM ロールを使用することをお勧めします。RoleARN を指定することでAWS ロールを代わりに使用できます。これにより、CData 製品は指定されたロールの資格情報を取得しようと試みます。
(すでにEC2 インスタンスなどで接続されているのではなく)AWS に接続している場合は、ロールを引き受けるIAM ユーザーのAccessKey とSecretKey を追加で指定する必要があります。AWS ルートユーザーのAccessKey および SecretKey を指定する場合、ロールは使用できません。
SSO 認証
SSO 認証を必要とするユーザーおよびロールには、RoleARN およびPrincipalArn 接続プロパティを指定してください。各Identity Provider に固有のSSOProperties を指定し、AccessKey とSecretKey を空のままにする必要があります。これにより、CData 製品は一時的な認証資格情報を取得するために、リクエストでSSO 認証情報を送信します。
- 接続プロパティを入力したら、「Validate」をクリックし、「Apply」をクリックします
Amazon S3 のデータ の読み取り
接続の検証と適用後に開くフォームで、クエリを設定します。
- Schema name を「AmazonS3」に設定します
- Table name を Amazon S3 のテーブルに設定します。スキーマ名を使用して、例:「AmazonS3」.「ObjectsACL」(ドロップダウンで利用可能なテーブルの一覧を確認できます)
- テーブルから使用する各項目の Output fields を追加します
Generic JDBC - Select snap を保存します。
接続とクエリを設定したら、snap の末尾をクリックしてデータをプレビューします(下図でハイライト表示)。
結果が期待通りであることを確認したら、追加の snap を使用して Amazon S3 のデータ を別のエンドポイントに送信できます。
Amazon S3 のデータ を外部サービスにパイプ
この記事では、データを Google スプレッドシートに読み込みます。サポートされている任意の snap を使用するか、別の CData JDBC Driver と Generic JDBC snap を使用して、外部サービスにデータを移動できます。
- 「Worksheet Writer」snap を「Generic JDBC - Select」snap の末尾にドロップします。
- Google Sheets に接続するためのアカウントを追加します
- Worksheet Writer snap を設定して、Amazon S3 のデータ を Google スプレッドシートに書き込みます
これで、完全に設定されたパイプラインを実行して、Amazon S3 からデータを抽出し、Google スプレッドシートにプッシュできます。
詳細情報と無料トライアル
CData JDBC Driver for Amazon S3 を使用することで、SnapLogic で Amazon S3 のデータ を外部サービスと連携するパイプラインを作成できます。Amazon S3 への接続の詳細については、CData JDBC Driver for Amazon S3 ページをご覧ください。CData JDBC Driver for Amazon S3 の30日間無料トライアルをダウンロードして、今すぐお試しください。