Informatica Cloud で Presto のデータ を連携
Informatica Cloud は、クラウド上で抽出、変換、ロード(ETL)タスクを実行できるツールです。Cloud Secure Agent と CData JDBC Driver for Presto を組み合わせることで、Informatica Cloud から直接 Presto のデータ にリアルタイムでアクセスできます。本記事では、Cloud Secure Agent のダウンロードと登録、JDBC ドライバーを介した Presto への接続、そして Informatica Cloud のプロセスで使用可能なマッピングの作成方法をご紹介します。
Presto データ連携について
CData を使用すれば、Trino および Presto SQL エンジンのライブデータへのアクセスと統合がこれまでになく簡単になります。お客様は CData の接続機能を以下の目的で利用しています:
- Trino v345 以降(旧 PrestoSQL)および Presto v0.242 以降(旧 PrestoDB)のデータにアクセスできます。
- Trino または Presto インスタンスの基盤となるすべてのデータに対して読み取り・書き込みアクセスができます。
- 最大スループットのための最適化されたクエリ生成。
Presto と Trino により、ユーザーは単一のエンドポイントを通じてさまざまな基盤データソースにアクセスできます。CData の接続と組み合わせることで、ユーザーはインスタンスへの純粋な SQL-92 アクセスを取得し、ビジネスデータをデータウェアハウスに統合したり、Power BI や Tableau などのお気に入りのツールからライブデータに直接簡単にアクセスしたりできます。
多くの場合、CData のライブ接続は、ツールで利用可能なネイティブのインポート機能を上回ります。あるお客様は、レポートに必要なデータセットのサイズが大きいため、Power BI を効果的に使用できませんでした。同社が CData Power BI Connector for Presto を導入したところ、DirectQuery 接続モードを使用してリアルタイムでレポートを生成できるようになりました。
はじめに
Informatica Cloud Secure Agent
JDBC ドライバー経由で Presto のデータ に接続するには、Cloud Secure Agent をインストールします。
- Informatica Cloud の Administrator ページに移動します
- Runtime Environments タブを選択します
- 「Download Secure Agent」をクリックします
- Install Token をメモしておきます
- クライアントマシンでインストーラを実行し、ユーザー名と Install Token を使って Cloud Secure Agent を登録します
NOTE: Cloud Secure Agent のすべてのサービスが起動するまでに、しばらく時間がかかる場合があります。
Presto JDBC Driver への接続
Cloud Secure Agent のインストールと起動が完了したら、JDBC ドライバーを介して Presto に接続する準備が整いました。
Secure Agent マシンへの JDBC ドライバーの追加
- Secure Agent マシンの以下のディレクトリに移動します:
%Secure Agent installation directory%/ext/connectors/thirdparty/
- 設定するマッピングの種類に応じて、フォルダを作成しドライバーの JAR ファイル(cdata.jdbc.presto.jar)を追加します。
マッピングの場合は、以下のフォルダを作成してドライバーの JAR ファイルを追加します:
informatica.jdbc_v2/common
アドバンスドモードのマッピングの場合は、以下のフォルダも作成してドライバーの JAR ファイルを追加します:
informatica.jdbc_v2/spark
- Secure Agent を再起動します。
Informatica Cloud での Presto への接続
ドライバーの JAR ファイルをインストールしたら、Informatica Cloud で Presto への接続を設定します。Connections タブをクリックし、New Connection をクリックして、以下のプロパティを入力します:- Connection Name: 接続に名前を付けます(例:CData Presto Connection)
- Type:「JDBC_V2」を選択します
- Runtime Environment: Secure Agent をインストールしたランタイム環境を選択します
- JDBC Driver Class Name: JDBC ドライバークラス名を入力します:cdata.jdbc.presto.PrestoDriver
- JDBC Connection URL: Presto の JDBC URL を設定します。URL は以下のようになります:
jdbc:presto:Server=127.0.0.1;Port=8080;
Presto への接続には、まずはServer およびPort を接続プロパティとして設定します。それ以外の追加項目は接続方式によって異なります。
TLS/SSL を有効化するには、UseSSL をTRUE に設定します。
LDAP で認証
LDAP で認証するには、次の接続プロパティを設定します:
- AuthScheme: LDAP に設定。
- User: LDAP で接続するユーザー名。
- Password: LDAP で接続するユーザーのパスワード。
Kerberos 認証
KERBEROS 認証を使う場合には、以下を設定します:
- AuthScheme: KERBEROS に設定。
- KerberosKDC: 接続するユーザーのKerberos Key Distribution Center (KDC) サービス。
- KerberosRealm: 接続するユーザーのKerberos Realm 。
- KerberosSPN: Kerberos Domain Controller のService Principal Name。
- KerberosKeytabFile: Kerberos principals とencrypted keys を含むKeytab file。
- User: Kerberos のユーザー。
- Password: Kerberos で認証するユーザーのパスワード。
組み込みの接続文字列デザイナー
JDBC URL の作成には、Presto JDBC Driver に組み込まれている接続文字列デザイナーを使用できます。.jar ファイルをダブルクリックするか、コマンドラインから実行してください。
java -jar cdata.jdbc.presto.jar接続プロパティを入力し、接続文字列をクリップボードにコピーします。
- Username: プレースホルダー値を設定します(Presto はユーザー名を必要としないため)
- Password: プレースホルダー値を設定します(Presto はパスワードを必要としないため)
Presto のデータ のマッピングを作成
Presto への接続を設定したら、Informatica の任意のプロセスで Presto のデータ にアクセスできます。以下の手順では、Presto から別のデータターゲットへのマッピングを作成する方法を説明します。
- Data Integration ページに移動します
- New.. をクリックし、Mappings タブから Mapping を選択します
- Source Object をクリックし、Source タブで Connection を選択し、Source Type を設定します
- 「Select」をクリックして、マッピングするテーブルを選択します
- Fields タブで、マッピングする Presto テーブルのフィールドを選択します
- Target オブジェクトをクリックし、Target ソース、テーブル、フィールドを設定します。Field Mapping タブで、ソースフィールドをターゲットフィールドにマッピングします。
マッピングの設定が完了すると、Informatica Cloud でサポートされている任意の接続先と Presto のデータ のリアルタイム連携を開始できます。CData JDBC Driver for Presto の30日間無償トライアルをダウンロードして、Informatica Cloud で Presto のデータ の活用を今すぐ始めましょう。