JDBC で Presto データソースから Informatica マッピングを作成
Informatica は、データの転送と変換を行う強力でエレガントな手段を提供します。CData JDBC Driver for Presto を使用することで、業界で実績のある標準に基づいたドライバーにアクセスでき、Informatica の強力なデータ転送および操作機能とシームレスに統合できます。このチュートリアルでは、Informatica PowerCenter で Presto のデータ を転送および参照する方法を説明します。
Presto データ連携について
CData を使用すれば、Trino および Presto SQL エンジンのライブデータへのアクセスと統合がこれまでになく簡単になります。お客様は CData の接続機能を以下の目的で利用しています:
- Trino v345 以降(旧 PrestoSQL)および Presto v0.242 以降(旧 PrestoDB)のデータにアクセスできます。
- Trino または Presto インスタンスの基盤となるすべてのデータに対して読み取り・書き込みアクセスができます。
- 最大スループットのための最適化されたクエリ生成。
Presto と Trino により、ユーザーは単一のエンドポイントを通じてさまざまな基盤データソースにアクセスできます。CData の接続と組み合わせることで、ユーザーはインスタンスへの純粋な SQL-92 アクセスを取得し、ビジネスデータをデータウェアハウスに統合したり、Power BI や Tableau などのお気に入りのツールからライブデータに直接簡単にアクセスしたりできます。
多くの場合、CData のライブ接続は、ツールで利用可能なネイティブのインポート機能を上回ります。あるお客様は、レポートに必要なデータセットのサイズが大きいため、Power BI を効果的に使用できませんでした。同社が CData Power BI Connector for Presto を導入したところ、DirectQuery 接続モードを使用してリアルタイムでレポートを生成できるようになりました。
はじめに
ドライバーのデプロイ
ドライバーを Informatica PowerCenter サーバーにデプロイするには、インストールディレクトリの lib サブフォルダにある CData JAR ファイルと .lic ファイルを、次のフォルダにコピーします:Informatica インストールディレクトリ\services\shared\jars\thirdparty。
Developer ツールで Presto のデータ を使用するには、インストールディレクトリの lib サブフォルダにある CData JAR ファイルと .lic ファイルを、次のフォルダにコピーする必要があります:
- Informatica インストールディレクトリ\client\externaljdbcjars
- Informatica インストールディレクトリ\externaljdbcjars
JDBC 接続の作成
Informatica Developer から接続するには、次の手順に従います:
- Connection Explorer ペインで、ドメインを右クリックし、Create a Connection をクリックします。
- 表示される New Database Connection ウィザードで、接続の名前と ID を入力し、Type メニューで JDBC を選択します。
- JDBC Driver Class Name プロパティに、次のように入力します:
cdata.jdbc.presto.PrestoDriver
- Connection String プロパティに、Presto の接続プロパティを使用して JDBC URL を入力します。
Presto への接続には、まずはServer およびPort を接続プロパティとして設定します。それ以外の追加項目は接続方式によって異なります。
TLS/SSL を有効化するには、UseSSL をTRUE に設定します。
LDAP で認証
LDAP で認証するには、次の接続プロパティを設定します:
- AuthScheme: LDAP に設定。
- User: LDAP で接続するユーザー名。
- Password: LDAP で接続するユーザーのパスワード。
Kerberos 認証
KERBEROS 認証を使う場合には、以下を設定します:
- AuthScheme: KERBEROS に設定。
- KerberosKDC: 接続するユーザーのKerberos Key Distribution Center (KDC) サービス。
- KerberosRealm: 接続するユーザーのKerberos Realm 。
- KerberosSPN: Kerberos Domain Controller のService Principal Name。
- KerberosKeytabFile: Kerberos principals とencrypted keys を含むKeytab file。
- User: Kerberos のユーザー。
- Password: Kerberos で認証するユーザーのパスワード。
組み込みの接続文字列デザイナー
JDBC URL の構築には、Presto JDBC Driver に組み込まれている接続文字列デザイナーを使用できます。JAR ファイルをダブルクリックするか、コマンドラインから JAR ファイルを実行します。
java -jar cdata.jdbc.presto.jar
接続プロパティを入力し、接続文字列をクリップボードにコピーします。
一般的な接続文字列は次のとおりです:
jdbc:presto:Server=127.0.0.1;Port=8080;
Presto テーブルの参照
ドライバー JAR をクラスパスに追加し、JDBC 接続を作成したら、Informatica で Presto エンティティにアクセスできます。Presto に接続してテーブルを参照するには、次の手順に従います:
- リポジトリに接続します。
- Connection Explorer で、接続を右クリックし、Connect をクリックします。
- Show Default Schema Only オプションのチェックを外します。
これで、Data Viewer で Presto テーブルを参照できます。テーブルのノードを右クリックし、Open をクリックします。Data Viewer ビューで、Run をクリックします。
Presto データオブジェクトの作成
プロジェクトに Presto テーブルを追加するには、次の手順に従います:
- Presto でテーブルを選択し、テーブルを右クリックして Add to Project をクリックします。
- 表示されるダイアログで、各リソースに対してデータオブジェクトを作成するオプションを選択します。
- Select Location ダイアログで、プロジェクトを選択します。
マッピングの作成
マッピングに Presto ソースを追加するには、次の手順に従います:
- Object Explorer で、プロジェクトを右クリックし、New -> Mapping をクリックします。
- Presto 接続のノードを展開し、テーブルのデータオブジェクトをエディターにドラッグします。
- 表示されるダイアログで、Read オプションを選択します。
Presto カラムをフラットファイルにマッピングするには、次の手順に従います:
- Object Explorer で、プロジェクトを右クリックし、New -> Data Object をクリックします。
- Flat File Data Object -> Create as Empty -> Fixed Width を選択します。
- Presto オブジェクトのプロパティで、必要な行を選択し、右クリックして copy をクリックします。フラットファイルのプロパティに行を貼り付けます。
- フラットファイルデータオブジェクトをマッピングにドラッグします。表示されるダイアログで、Write オプションを選択します。
- クリック&ドラッグでカラムを接続します。
Presto のデータ を転送するには、ワークスペース内で右クリックし、Run Mapping をクリックします。
