SnapLogic を使用して Elasticsearch を外部サービスと連携

Jerod Johnson
Jerod Johnson
Senior Technology Evangelist
CData JDBC Driver を SnapLogic で使用して、Elasticsearch を外部サービスと連携する方法を説明します。

SnapLogic は、ノーコードでデータ連携フローを作成できる iPaaS(Integration Platform as a Service)です。CData JDBC Driver と組み合わせることで、Elasticsearch を含む250を超える SaaS、ビッグデータ、NoSQL ソースのリアルタイムデータに SnapLogic ワークフローからアクセスできます。

CData JDBC Driver は、最適化されたデータ処理機能を内蔵しており、リアルタイム Elasticsearch のデータ とのやり取りにおいて比類ないパフォーマンスを発揮します。外部ツールから複雑な SQL クエリが発行されると、ドライバーはフィルタや集計などのサポートされている SQL 操作を Elasticsearch に直接プッシュし、サポートされていない操作(多くの場合、SQL 関数や JOIN 操作)は内蔵の SQL エンジンを使用してクライアント側で処理します。動的なメタデータクエリ機能により、ネイティブデータ型を使用して Elasticsearch のデータ を操作できます。

Elasticsearch データ連携について

CData を使用すれば、Elasticsearch のライブデータへのアクセスと統合がこれまでになく簡単になります。お客様は CData の接続機能を以下の目的で利用しています:

  • SQL エンドポイントと REST エンドポイントの両方にアクセスでき、接続を最適化し、Elasticsearch データの読み書きに関してより多くのオプションを提供します。
  • v2.2 以降およびオープンソース Elasticsearch サブスクリプションを含む、ほぼすべての Elasticsearch インスタンスに接続できます。
  • SCORE() 関数を明示的に要求することなく、常にクエリ結果の関連性スコアを受け取ることができます。これにより、サードパーティツールからのアクセスが簡素化され、クエリ結果のテキスト関連性のランキングを簡単に確認できます。
  • 複数のインデックスを検索でき、クライアントマシンではなく Elasticsearch がクエリと結果の管理・処理を担当します。

ユーザーは、Crystal Reports、Power BI、Excel などの分析ツールと Elasticsearch データを統合し、当社のツールを活用して、Elasticsearch を含むすべてのデータソースへの単一のフェデレートアクセスレイヤーを実現しています。

CData の Elasticsearch ソリューションの詳細については、ナレッジベース記事をご覧ください:CData Elasticsearch Driver Features & Differentiators


はじめに


SnapLogic から Elasticsearch に接続

SnapLogic から Elasticsearch のデータ に接続するには、CData Elasticsearch JDBC Driver をダウンロードしてインストールします。インストールウィザードに従って進めてください。インストールが完了すると、JAR ファイルはインストールディレクトリ(デフォルトでは C:/Program Files/CData/CData JDBC Driver for Elasticsearch/lib)に配置されます。

Elasticsearch JDBC Driver のアップロード

インストール後、Manager タブから SnapLogic 内の場所(例:projects/Jerod Johnson)に JDBC JAR ファイルをアップロードします。

接続の設定

JDBC Driver をアップロードしたら、Elasticsearch への接続を作成します。

  1. Designer タブに移動します
  2. Snaps から「JDBC」を展開し、「Generic JDBC - Select」snap をデザイナーにドラッグします
  3. Add Account をクリック(または既存のアカウントを選択)し、「Continue」をクリックします
  4. 次のフォームで、JDBC 接続プロパティを設定します:
    • JDBC JARs に、先ほどアップロードした JAR ファイルを追加します
    • JDBC Driver Classcdata.jdbc.elasticsearch.ElasticsearchDriver に設定します
    • JDBC URL を Elasticsearch JDBC Driver の JDBC 接続文字列に設定します。例:

      jdbc:elasticsearch:Server=127.0.0.1;Port=9200;User=admin;Password=123456;RTK=XXXXXX;

      注意:RTK はトライアルキーまたは製品キーです。詳細についてはサポートチームまでお問い合わせください。

      組み込みの接続文字列デザイナー

      JDBC URL の構築には、Elasticsearch JDBC Driver に組み込まれている接続文字列デザイナーを使用できます。JAR ファイルをダブルクリックするか、コマンドラインから JAR ファイルを実行してください。

      java -jar cdata.jdbc.elasticsearch.jar

      接続プロパティを入力し、接続文字列をクリップボードにコピーします。

      Elasticsearch 接続プロパティの取得・設定方法

      接続するには、Server およびPort 接続プロパティを設定します。 認証には、User とPassword プロパティ、PKI (public key infrastructure)、またはその両方を設定します。 PKI を使用するには、SSLClientCert、SSLClientCertType、SSLClientCertSubject、およびSSLClientCertPassword プロパティを設定します。

      CData 製品は、認証とTLS/SSL 暗号化にX-Pack Security を使用しています。TLS/SSL で接続するには、Server 値に'https://' を接頭します。Note: PKI を 使用するためには、TLS/SSL およびクライアント認証はX-Pack 上で有効化されていなければなりません。

      接続されると、X-Pack では、設定したリルムをベースにユーザー認証およびロールの許可が実施されます。

  5. 接続プロパティを入力したら、「Validate」をクリックし、「Apply」をクリックします

Elasticsearch のデータ の読み取り

接続の検証と適用後に開くフォームで、クエリを設定します。

  • Schema name を「Elasticsearch」に設定します
  • Table name を Elasticsearch のテーブルに設定します。スキーマ名を使用して、例:「Elasticsearch」.「Orders」(ドロップダウンで利用可能なテーブルの一覧を確認できます)
  • テーブルから使用する各項目の Output fields を追加します

Generic JDBC - Select snap を保存します。

接続とクエリを設定したら、snap の末尾をクリックしてデータをプレビューします(下図でハイライト表示)。

結果が期待通りであることを確認したら、追加の snap を使用して Elasticsearch のデータ を別のエンドポイントに送信できます。

Elasticsearch のデータ を外部サービスにパイプ

この記事では、データを Google スプレッドシートに読み込みます。サポートされている任意の snap を使用するか、別の CData JDBC Driver と Generic JDBC snap を使用して、外部サービスにデータを移動できます。

  1. 「Worksheet Writer」snap を「Generic JDBC - Select」snap の末尾にドロップします。
  2. Google Sheets に接続するためのアカウントを追加します
  3. Worksheet Writer snap を設定して、Elasticsearch のデータ を Google スプレッドシートに書き込みます

これで、完全に設定されたパイプラインを実行して、Elasticsearch からデータを抽出し、Google スプレッドシートにプッシュできます。

外部データを Elasticsearch にパイプ

上記の通り、SnapLogic で Elasticsearch 用の JDBC Driver を使用して Elasticsearch にデータを書き込むこともできます。まず、Generic JDBC - Insert または Generic JDBC - Update snap をダッシュボードに追加します。

  1. 既存の「Account」(接続)を選択するか、新しいものを作成します
  2. クエリを設定します:
    • Schema name を「Elasticsearch」に設定します
    • Table name を Elasticsearch のテーブルに設定します。スキーマ名を使用して、例:「Elasticsearch」.「Orders」(ドロップダウンで利用可能なテーブルの一覧を確認できます)
  3. Generic JDBC - Insert/Update snap を保存します

これで、Elasticsearch にデータを書き込み、新しいレコードを挿入したり既存のレコードを更新したりする snap が設定されました。

詳細情報と無料トライアル

CData JDBC Driver for Elasticsearch を使用することで、SnapLogic で Elasticsearch のデータ を外部サービスと連携するパイプラインを作成できます。Elasticsearch への接続の詳細については、CData JDBC Driver for Elasticsearch ページをご覧ください。CData JDBC Driver for Elasticsearch の30日間無料トライアルをダウンロードして、今すぐお試しください。

はじめる準備はできましたか?

Elasticsearch Driver の無料トライアルをダウンロードしてお試しください:

 ダウンロード

詳細:

Elasticsearch Icon Elasticsearch JDBC Driver お問い合わせ

Elasticsearch 連携のパワフルなJava アプリケーションを素早く作成して配布。