Pentaho Data Integration でSalesforce Data Cloud のデータを連携
CData JDBC Driver for Salesforce Data Cloud を使用すると、データパイプラインからリアルタイムデータにアクセスできます。Pentaho Data Integration は、ETL(Extraction, Transformation, and Loading)エンジンであり、データをクレンジングし、アクセス可能な統一フォーマットでデータを格納します。この記事では、Salesforce Data Cloud のデータ に JDBC データソースとして接続し、Pentaho Data Integration で Salesforce Data Cloud のデータ をベースにしたジョブやトランスフォーメーションを構築する方法を説明します。
Salesforce Data Cloud への接続を設定
それでは、Salesforce Data Cloud への認証方法を設定していきましょう。Salesforce Data Cloud では、OAuth 標準による認証をサポートしています。
OAuth 認証
AuthScheme をOAuth に設定してください。
デスクトップアプリケーション
CData 製品では、デスクトップでの認証を簡略化する埋め込みOAuth アプリケーションを提供しています。
また、Salesforce Data Cloud コンソールで設定および登録するカスタムOAuth アプリケーションを介してデスクトップから認証することも可能です。詳しくは、ヘルプドキュメントのカスタムOAuth アプリの作成をご確認ください。
接続する前に、以下のプロパティを設定してください。
- InitiateOAuth:GETANDREFRESH。InitiateOAuth を使用すれば、繰り返しOAuth の交換を行ったり、手動でOAuthAccessToken を設定する必要がなくなります
- OAuthClientId(カスタムアプリケーションのみ):カスタムOAuth アプリケーションの登録時に割り当てられたクライアントID
- OAuthClientSecret(カスタムアプリケーションのみ):カスタムOAuth アプリケーションの登録時に割り当てられたクライアントシークレット
接続すると、CData 製品がデフォルトブラウザでSalesforce Data Cloud のOAuth エンドポイントを開きます。ログインして、アプリケーションにアクセス許可を与えてください。
以下のようにドライバーがOAuth プロセスを完了します。
- コールバックURL からアクセストークンを取得します
- 古いトークンの期限が切れた際は、新しいアクセストークンを取得します
- OAuthSettingsLocation にOAuth 値を保存し、接続間で永続化します
Web アプリケーションやヘッドレスマシンを含むその他のOAuth 認証方法については、ヘルプドキュメントをご確認ください。
組み込みの接続文字列デザイナー
JDBC URL の構築を支援するには、Salesforce Data Cloud JDBC Driver に組み込まれている接続文字列デザイナーを使用してください。JAR ファイルをダブルクリックするか、コマンドラインから JAR ファイルを実行します。
java -jar cdata.jdbc.salesforcedatacloud.jar
接続プロパティを設定し、接続文字列をクリップボードにコピーします。
JDBC URL を設定する際には、Max Rows 接続プロパティの設定も検討してください。これにより返される行数が制限され、レポートやビジュアライゼーションの設計時にパフォーマンスを向上させることができます。
一般的な JDBC URL は次のようになります:
jdbc:salesforcedatacloud:
接続文字列を保存して、Pentaho Data Integration で使用します。
Pentaho DI から Salesforce Data Cloud に接続
Pentaho Data Integration を開き、「Database Connection」を選択して CData JDBC Driver for Salesforce Data Cloud への接続を設定します。
- 「General」をクリックします。
- Connection name を設定します(例:Salesforce Data Cloud Connection)。
- Connection type を「Generic database」に設定します。
- Access を「Native (JDBC)」に設定します。
- Custom connection URL に Salesforce Data Cloud の接続文字列を設定します(例:
jdbc:salesforcedatacloud:
)。 - Custom driver class name を「cdata.jdbc.salesforcedatacloud.SalesforceDataCloudDriver」に設定します。
- 接続をテストし、「OK」をクリックして保存します。
Salesforce Data Cloud のデータパイプラインを作成
CData JDBC Driver を使用して Salesforce Data Cloud への接続が設定されたら、新しいトランスフォーメーションまたはジョブを作成する準備が整いました。
- 「File」>>「New」>>「Transformation/job」をクリックします。
- 「Table input」オブジェクトをワークフローパネルにドラッグし、Salesforce Data Cloud 接続を選択します。
- 「Get SQL select statement」をクリックし、Database Explorer を使用して利用可能なテーブルとビューを表示します。
- テーブルを選択し、必要に応じてデータをプレビューして確認します。
ここから、適切な同期先を選択し、レプリケーション中にデータを変更、フィルタリング、その他の処理を行うトランスフォーメーションを追加することで、トランスフォーメーションまたはジョブを続行できます。
無料トライアルと詳細情報
CData JDBC Driver for Salesforce Data Cloud の 30日間無料トライアルをダウンロードして、Pentaho Data Integration で Salesforce Data Cloud のデータ のリアルタイムデータを今すぐ活用しましょう。