DBArtisan で Hive のデータ を JDBC データソースとして管理
CData JDBC Driver for Hive を使えば、Hive のデータ をデータベースとしてアクセスできるようになり、DBArtisan などのデータベース管理ツールとシームレスに連携できます。この記事では、DBArtisan で Hive の JDBC データソースを作成する方法を説明します。一度接続すれば、データを視覚的に編集したり、標準 SQL を実行したりすることができます。
Hive のデータ を DBArtisan プロジェクトに統合
以下のステップに従って、プロジェクトに Hive のデータ をデータベースインスタンスとして登録します。
- DBArtisan で、Data Source -> Register Datasource をクリックします。
- Generic JDBC を選択します。
- Manage をクリックします。
- 表示されたダイアログで、New をクリックします。ドライバーの名前を入力し、Add をクリックします。次に表示されるダイアログで、ドライバー JAR ファイルを指定します。ドライバー JAR はインストールディレクトリの lib サブフォルダ内にあります。
-
Connection URL ボックスに、資格情報やその他の必要な接続プロパティを JDBC URL 形式で入力します。
Apache Hive への接続を確立するには以下を指定します。
- Server:HiveServer2 をホストするサーバーのホスト名またはIP アドレスに設定。
- Port:HiveServer2 インスタンスへの接続用のポートに設定。
- TransportMode:Hive サーバーとの通信に使用するトランスポートモード。有効な入力値は、BINARY およびHTTP です。デフォルトではBINARY が選択されます。
- AuthScheme:使用される認証スキーム。有効な入力値はPLAIN、LDAP、NOSASL、およびKERBEROS です。デフォルトではPLAIN が選択されます。
- CData 製品においてTLS/SSL を有効化するには、UseSSL をTrue に設定します
組み込みの接続文字列デザイナー
JDBC URL の構成には、Hive JDBC Driver に組み込まれている接続文字列デザイナーを使用できます。JAR ファイルをダブルクリックするか、コマンドラインから JAR ファイルを実行します。
java -jar cdata.jdbc.apachehive.jar
接続プロパティを入力し、接続文字列をクリップボードにコピーします。
一般的な接続文字列は以下のとおりです。
jdbc:apachehive:Server=127.0.0.1;Port=10000;TransportMode=BINARY;
- ウィザードを完了して、Hive のデータ に接続します。Hive エンティティが Datasource Explorer に表示されます。
これで、他のデータベースと同じように Hive のデータ を操作できます。 Hive API でサポートされるクエリの詳細については、ドライバーのヘルプドキュメントを参照してください。