製品をチェック

Azure Driver の30日間無償トライアルをダウンロード

 30日間の無償トライアルへ

製品の詳細

Azure Storage アイコン Azure JDBC Driver 相談したい

リアルタイムなAzure テーブルストレージデータを組み込んだパワフルなJava アプリケーションを短時間・低コストで作成して配布できます。

Elasticsearch へLogstash 経由でAzure Table データをロードする方法

全文検索サービスElasticsearch のETL モジュール「Logstash」とCData JDBC ドライバを使って、Azure Table データを簡単にロードする方法をご紹介。

加藤龍彦
デジタルマーケティング

最終更新日:2022-07-22
azure ロゴ

CData

jdbc ロゴ画像
Elasticsearch Logstash ロゴ

こんにちは!ウェブ担当の加藤です。マーケ関連のデータ分析や整備もやっています。

Elasticsearch は、人気の分散型全文検索エンジンです。データを一元的に格納することで、超高速検索や、関連性の細かな調整、パワフルな分析が大規模に、手軽に実行可能になります。Elasticsearch にはデータのローディングを行うパイプラインツール「Logstash」があります。CData Drivers を利用することができるので、30日の無償評価版をダウンロードしてあらゆるデータソースを簡単にElasticsearch に取り込んで検索・分析を行うことができます。

この記事では、CData Driver for AzureTables を使って、Azure Table のデータをLogstash 経由でElasticsearch にロードする手順を説明します。

Elasticsearch Logstash でCData JDBC Driver for AzureTables を使用

  • CData JDBC Driver for AzureTables をLogstash が稼働するマシンにインストールします。
  • 以下のパスにJDBC Driver がインストールされます(2022J の部分はご利用される製品バージョンによって異なります)。後ほどこのパスを使います。この.jar ファイル(製品版の場合は.lic ファイルも)をLogstash に配置します。
    C:\Program Files\CData\CData JDBC Driver for AzureTables 2022J\lib\cdata.jdbc.azuretables.jar
  • 次に、Logstash とCData JDBC ドライバをつなぐ、JDBC Input Plugin をインストールします。JDBC Plugin は最新のLogstash だとデフォルトでついてきますが、バージョンによっては追加する必要があります。
    https://www.elastic.co/guide/en/logstash/5.4/plugins-inputs-jdbc.html
  • CData JDBC ドライバの.jar ファイルと.lic ファイルを、Logstashの「/logstash-core/lib/jars/」に移動します。

Logstash でElasticsearch にAzure Table データを送る

それでは、Logstash でElasticsearch にAzure Table データの転送を行うための設定ファイルを作成していきます。

  • Logstash のデータ処理定義であるlogstash.conf ファイルにAzure Table データを取得する処理を書きます。Input はJDBC、Output はElasticsearch にします。データローディングジョブの起動間隔は30秒に設定しています。
  • CData JDBC ドライバの.jar をjdbc driver ライブラリにして、クラス名を設定、Azure Table への接続プロパティをJDBC URL の形でせっていします。JDBC URL ではほかにも詳細な設定を行うことができるので、細かくは製品ドキュメントをご覧ください。
  • Account プロパティをストレージアカウント名に設定し、ストレージアカウントのAccessKey を設定して接続します。これらの値を取得する方法は次のとおりです。

    ストレージをBackend として使用している場合(デフォルト)

    • Azure ポータルにログインし、左側の「サービス」メニューで「ストレージアカウント」を選択します。
    • ストレージアカウントがない場合は、「追加」ボタンをクリックしてアカウントを作成します。
    • 使用するストレージアカウントのリンクをクリックし、「設定」の「アクセスキー」を選択します。 「アクセスキー」ウィンドウには、ストレージアカウント名とCData 製品で使用するキー(接続にはkey1またはkey2のどちらかを使用できます)が含まれています。これらのプロパティは、それぞれAccount とAccessKey 接続プロパティにマッピングされます。

    Azure SQL への接続

    • Azure ポータルにログインし、左側の「サービス」メニューで「Azure Cosmos DB」を選択します。
    • 使用するCosmos DB アカウントのリンクをクリックし、「設定」の「接続文字列」を選択します。 「接続文字列」ウィンドウには、Cosmos DB アカウント名とCData 製品で使用する主キーが含まれています。これらのプロパティは、それぞれAccount とAccessKey 接続プロパティにマッピングされます。
                input {
                    jdbc {
                        jdbc_driver_library => "../logstash-core/lib/jars/cdata.jdbc.azuretables.jar"
                        jdbc_driver_class => "Java::cdata.jdbc.azuretables.AzureTablesDriver"
                        jdbc_connection_string => "jdbc:azuretables:AccessKey=myAccessKey;Account=myAccountName;"
                        jdbc_user => ""
                        jdbc_password => ""
                        schedule => "*/30 * * * * *"
                        statement => "SELECT Name, Price FROM NorthwindProducts"
                    }
                }
                    
                    
                output {
                    Elasticsearch {
                        index => "azuretables_NorthwindProducts"
                        document_id => "xxxx"
                    }
                }
            

Logstash でAzure Table のローディングを実行

それでは作成した「logstash.conf」ファイルを元にLogstash を実行してみます。

> logstash-7.8.0\bin\logstash -f logstash.conf

成功した旨のログが出ます。これでAzure Table データがElasticsearch にロードされました。

例えばKibana で実際にElasticsearch に転送されたデータを見てみます。

        GET azuretables_NorthwindProducts/_search
        {
            "query": {
                "match_all": {}
            }
        }
    
Elasticsearch にロードされたAzure Table データをクエリ

データがElasticsearch に格納されていることが確認できました。

Elasticsearch にロードされたAzure Table データを確認

CData JDBC Driver for AzureTables をLogstash で使うことで、Azure Table コネクタとして機能し、簡単にデータをElasticsearch にロードすることができました。ぜひ、30日の無償評価版をお試しください。

関連コンテンツ

トライアル・お問い合わせ

30日間無償トライアルで、CData のリアルタイムデータ連携をフルにお試しいただけます。記事や製品についてのご質問があればお気軽にお問い合わせください。