Google スプレッドシートからSpark のリアルタイムデータに接続
Google スプレッドシートは、Web ベースのブラウザ上で動作する表計算アプリです。CData Connect AI と組み合わせることで、Google スプレッドシートからSpark のデータに即座にアクセスし、分析、共有、表計算などの用途に使用できます。この記事では、Connect AI でSpark に接続し、Google スプレッドシートでSpark のデータにアクセスする方法を説明します。
Connect AI からSpark への接続
CData Connect AI では、直感的なクリック操作ベースのインターフェースを使ってデータソースに接続できます。
- Connect AI にログインし、 Add Connection をクリックします。
- 「Add Connection」パネルから「Spark」を選択します。
-
必要な認証プロパティを入力し、Spark に接続します。
SparkSQL への接続
SparkSQL への接続を確立するには以下を指定します。
- Server:SparkSQL をホストするサーバーのホスト名またはIP アドレスに設定。
- Port:SparkSQL インスタンスへの接続用のポートに設定。
- TransportMode:SparkSQL サーバーとの通信に使用するトランスポートモード。有効な入力値は、BINARY およびHTTP です。デフォルトではBINARY が選択されます。
- AuthScheme:使用される認証スキーム。有効な入力値はPLAIN、LDAP、NOSASL、およびKERBEROS です。デフォルトではPLAIN が選択されます。
Databricks への接続
Databricks クラスターに接続するには、以下の説明に従ってプロパティを設定します。Note:必要な値は、「クラスター」に移動して目的のクラスターを選択し、 「Advanced Options」の下にある「JDBC/ODBC」タブを選択することで、Databricks インスタンスで見つけることができます。
- Server:Databricks クラスターのサーバーのホスト名に設定。
- Port:443
- TransportMode:HTTP
- HTTPPath:Databricks クラスターのHTTP パスに設定。
- UseSSL:True
- AuthScheme:PLAIN
- User:'token' に設定。
- Password:パーソナルアクセストークンに設定(値は、Databricks インスタンスの「ユーザー設定」ページに移動して「アクセストークン」タブを選択することで取得できます)。
- Create & Test をクリックします。
- 「Add Spark Connection」ページの「Permissions」タブに移動し、ユーザーベースのアクセス許可を更新します。
コネクションの設定が完了したら、Google スプレッドシートからSpark のデータへの接続準備ができました。
Spark のリアルタイムデータにGoogle スプレッドシートからアクセス
以下のステップでは、Google スプレッドシートからCData Connect AI に接続して新しいSpark のデータソースを作成する方法を説明します。
- Google スプレッドシートにログインして、新しいシートを作成、または既存のシートを開きます。
- 「拡張機能」をクリックして「アドオン」 -> 「アドオンを取得」と進みます(すでにアドオンをインストールしている場合は、ステップ5に進んでください)。
- CData Connect AI アドオンを検索してインストールします。
- アドオンにアクセスを許可します。
- Google スプレッドシートに戻って、「拡張機能」をクリックしてCData Connect AI アドオンを開きます。
- アドオンのパネルで、「Authorize」をクリックしてご利用のCData Connect AI インスタンスを認証します。
- Google スプレッドシートのCData Connect AI パネルで「IMPORT」をクリックします。
- コネクション(例:SparkSQL1)、テーブル(例:Customers)、カラムを選択してインポートします。
- オプションでFilters(フィルタ)、Sorting(ソート)、Limit(取得数制限)の設定を追加することもできます。
- 「Execute」をクリックしてデータをインポートします。
クラウドアプリケーションからSpark のデータへのライブアクセス
以上で、Google スプレッドシートワークブックからSpark のリアルタイムデータへのクラウド接続が実現します。データをさらに追加して表計算、集計、共有などの用途に使用できます。
クラウドアプリケーションから直接100を超えるSaaS 、ビッグデータ、NoSQL データソースへのリアルタイムデータアクセスを実現するには、CData Connect AI の14日間無償トライアルをぜひお試しください。