Elasticsearch へLogstash 経由でGoogle Campaign Manager 360 のデータをロードする方法

加藤龍彦
加藤龍彦
デジタルマーケティング
全文検索サービスElasticsearch のETL モジュール「Logstash」とCData JDBC ドライバを使って、Google Campaign Manager 360 のデータを簡単にロードする方法をご紹介。

Elasticsearch は、人気の分散型全文検索エンジンです。データを一元的に格納することで、超高速検索や、関連性の細かな調整、パワフルな分析が大規模に、手軽に実行可能になります。Elasticsearch にはデータのローディングを行うパイプラインツール「Logstash」があります。CData Drivers を利用することができるので、30日の無償評価版をダウンロードしてあらゆるデータソースを簡単にElasticsearch に取り込んで検索・分析を行うことができます。

この記事では、CData Driver for GoogleCM を使って、Google Campaign Manager 360 のデータをLogstash 経由でElasticsearch にロードする手順を説明します。

Elasticsearch Logstash でCData JDBC Driver for GoogleCM を使用

  • CData JDBC Driver for GoogleCM をLogstash が稼働するマシンにインストールします。
  • 以下のパスにJDBC Driver がインストールされます(2022J の部分はご利用される製品バージョンによって異なります)。後ほどこのパスを使います。この.jar ファイル(製品版の場合は.lic ファイルも)をLogstash に配置します。
    C:\Program Files\CData\CData JDBC Driver for GoogleCM 2022J\lib\cdata.jdbc.googlecm.jar
  • 次に、Logstash とCData JDBC ドライバをつなぐ、JDBC Input Plugin をインストールします。JDBC Plugin は最新のLogstash だとデフォルトでついてきますが、バージョンによっては追加する必要があります。
    https://www.elastic.co/guide/en/logstash/5.4/plugins-inputs-jdbc.html
  • CData JDBC ドライバの.jar ファイルと.lic ファイルを、Logstashの「/logstash-core/lib/jars/」に移動します。

Logstash でElasticsearch にGoogle Campaign Manager 360 のデータを送る

それでは、Logstash でElasticsearch にGoogle Campaign Manager 360 のデータの転送を行うための設定ファイルを作成していきます。

  • Logstash のデータ処理定義であるlogstash.conf ファイルにGoogle Campaign Manager 360 のデータを取得する処理を書きます。Input はJDBC、Output はElasticsearch にします。データローディングジョブの起動間隔は30秒に設定しています。
  • CData JDBC ドライバの.jar をjdbc driver ライブラリにして、クラス名を設定、Google Campaign Manager 360 への接続プロパティをJDBC URL の形でせっていします。JDBC URL ではほかにも詳細な設定を行うことができるので、細かくは製品ドキュメントをご覧ください。
  • Google Campaign Manager 接続プロパティの取得・設定方法

    Google Campaign Manager への接続には、OAuth 認証標準を使います。ユーザーアカウントまたはサービスアカウントで認証できます。組織全体のアクセススコープをCData 製品に許可するには、サービスアカウントが必要です。

    詳細はヘルプドキュメントの「はじめに」を参照してください。

                input {
                    jdbc {
                        jdbc_driver_library => "../logstash-core/lib/jars/cdata.jdbc.googlecm.jar"
                        jdbc_driver_class => "Java::cdata.jdbc.googlecm.GoogleCMDriver"
                        jdbc_connection_string => "jdbc:googlecm:UserProfileID=MyUserProfileID;InitiateOAuth=REFRESH"
                        jdbc_user => ""
                        jdbc_password => ""
                        schedule => "*/30 * * * * *"
                        statement => "SELECT Clicks, Device FROM CampaignPerformance"
                    }
                }
    
    
                output {
                    Elasticsearch {
                        index => "googlecm_CampaignPerformance"
                        document_id => "xxxx"
                    }
                }
            

Logstash でGoogle Campaign Manager 360 のローディングを実行

それでは作成した「logstash.conf」ファイルを元にLogstash を実行してみます。

        > logstash-7.8.0\bin\logstash -f logstash.conf
    

成功した旨のログが出ます。これでGoogle Campaign Manager 360 のデータがElasticsearch にロードされました。

例えばKibana で実際にElasticsearch に転送されたデータを見てみます。

        GET googlecm_CampaignPerformance/_search
        {
            "query": {
                "match_all": {}
            }
        }
    
Elasticsearch にロードされたGoogle Campaign Manager 360 のデータをクエリ

データがElasticsearch に格納されていることが確認できました。

Elasticsearch にロードされたGoogle Campaign Manager 360 のデータを確認

CData JDBC Driver for GoogleCM をLogstash で使うことで、Google Campaign Manager 360 コネクタとして機能し、簡単にデータをElasticsearch にロードすることができました。ぜひ、30日の無償評価版をお試しください。

はじめる準備はできましたか?

Google Campaign Manager 360 Driver の無料トライアルをダウンロードしてお試しください:

 ダウンロード

詳細:

Google Campaign Manager 360 Icon Google Campaign Manager 360 JDBC Driver お問い合わせ

Java ベースアプリケーションおよび帳票ツールのデータベースライクな使いやすいインターフェースで、DoubleClick Campaign Manager のリアルタイムデータ(Ads、Accounts、Creatives、Orders など)にアクセス。