製品をチェック

無償トライアル:

無償トライアルへ

製品の情報と無償トライアルへ:

Apache Hive ODBC Driver

Hive ODBC Driver は、ODBC 接続をサポートする任意のアプリケーションからApache Hive データに直接接続できるパワフルなツールです。

ドライバーはSQL をHiveQL にマッピングして、標準SQL-92 で直接Apache Hive にアクセスできます。

データ連携でお困りですか?

お問い合わせ

SAS for Real-Time Reporting and Analytics でCData ODBC Driver for ApacheHive を使用


CData ODBC Driver for ApacheHive を使用してSAS からリアルタイムHive に接続します。


hive ロゴ画像
odbc ロゴ画像

ODBC

SAS ロゴ画像

SAS は、高度なアナリティクス、多変量解析、BI、データ管理、予測分析のためのソフトウェアです。SAS とCData ODBC Driver for ApacheHive を合わせて使うことで、SAS からライブHive データへデータベースライクにアクセスできるようになり、レポーティング、分析能力を向上できます。本記事では、SAS でHive のライブラリを作成し、リアルタイムHive に基づいたシンプルなレポートを作成します。

CData ODBC ドライバーは、ドライバーに組み込まれた最適化されたデータ処理により、SAS でライブHive データを送受信する場合に圧倒的なパフォーマンスを提供します。SAS からHive に複雑なSQL クエリを発行すると、ドライバーはフィルタや集計などのサポートされているSQL 操作をHive に直接プッシュし、組み込みSQL エンジンを利用して、サポートされていない操作(一般的にはSQL 関数とJOIN 操作)をクライアント側で処理します。組み込みの動的メタデータクエリを使用すると、SAS でHive を簡単にビジュアライズおよび分析できます。

ODBC Data Source としてHive に接続

以下は、Hive に接続するための情報と、Windows およびLinux 環境でDSN を構成するための様々なステップです。ODBC Driver for ApacheHive は、SAS System をホストしているマシンにインストールする必要があります。

Apache Hive への接続を確立するには以下を指定します。

  • Server:HiveServer2 をホストするサーバーのホスト名またはIP アドレスに設定。
  • Port:HiveServer2 インスタンスへの接続用のポートに設定。
  • TransportMode:Hive サーバーとの通信に使用するトランスポートモード。有効な入力値は、BINARY およびHTTP です。デフォルトではBINARY が選択されます。
  • AuthScheme:使用される認証スキーム。有効な入力値はPLAIN、LDAP、NOSASL、およびKERBEROS です。デフォルトではPLAIN が選択されます。
  • 本製品においてTLS/SSL を有効化するには、UseSSL をTrue に設定します

DSN を構成する際に、Max Rows プロパティを定めることも可能です。これによって返される行数を制限するため、ビジュアライゼーション・レポートのデザイン時のパフォーマンスを向上させるのに役立ちます。

Windows

未指定の場合は、初めにODBC DSN(data source name)で接続プロパティを指定します。ドライバーのインストールの最後にアドミニストレーターが開きます。Microsoft ODBC Data Source Administrator を使用して、ODBC DSN を作成および構成できます。

Linux

Linux 環境にCData ODBC Driver for ApacheHive をインストールする場合、ドライバーのインストールによりシステムDSN が事前定義されます。システムデータソースファイル(/etc/odbc.ini) を編集し、必要な接続プロパティを定義することで、DSN を変更できます。

/etc/odbc.ini

[CData ApacheHive Sys] Driver = CData ODBC Driver for ApacheHive Description = My Description Server = 127.0.0.1 Port = 10000 TransportMode = BINARY

これらの構成ファイルの使用に関する具体的な情報については、ヘルプドキュメントを参照してください。

SAS でHive ライブラリを作成

CData ODBC Driver for ApacheHive に基づくライブラリを追加することで、SAS でHive に接続します。

  1. SAS を開き、[Explorer]ペインで[Libraries]を展開します。
  2. [Active Libraries]ウィンドウで右クリックし、[New]を選択します。
  3. ライブラリに名前を付け(odbclib)、Engine としてODBC を選択し、ライブラリをセッション間で保持する場合は[Enable at startup]をクリックします。
  4. Data Source を以前構成したDSN に設定し、[OK]をクリックします。 Creating a library for Hive in SAS.

Hive クエリからビューを作成

SAS は、ローコードのポイントアンドクリッククエリツールを使用するか、PROC SQL とカスタムSQL クエリのプログラムを使うことで、データのクエリをネイティブにサポートします。SAS でビューを作成すると、ビューがクエリされるたびに定義クエリが実行されます。これは、レポート、チャート、分析について常にライブHive データにクエリを実行することを意味します。

クエリツールの使用

  1. SAS で[Tools]->[Query]と進みます。
  2. データをプルするテーブルソースとテーブルを選択し、[OK]をクリックします。 Selecting table(s) to visualize.
  3. カラムを選択し、右クリックしてフィルタリング、順序付け、グループ化などを追加します。 Selecting columns(s) to visualize and configuring the query.
  4. [SQL Query Tool]ウィンドウを右クリックして[Show Query]を選択し、[Create View]をクリックして、クエリの結果を含むローカルビューを作成します。ビューに名前を付け、[OK] をクリックします。 Create a local view to work with Hive data.

PROC SQL の使用

  1. SAS で、[Editor]ウィンドウに移動します。
  2. PROC SQL を使用してデータをクエリし、ローカルビューを作成します。
    Note:このステップにより、[Work]ライブラリにビューが作成されます。オプションとして、create view ステートメントでライブラリを指定できます。
    proc sql;
      create view customers_view as
      select 
        city, 
        companyname 
      from 
        odbclib.customers 
      where 
        Country = 'US';
    quit;
    
  3. [Run]->[Submit]とクリックしてクエリを実行し、ローカルビューを作成します。

SAS のHive データに関するレポートまたはビジュアライズ

ローカルビューを作成すると、パワフルなSAS 機能を使用してHive データをレポート、ビジュアライズ、またはその他の方法で分析できます。PROC PRINT を使用して簡単なレポートを印刷し、PROC GCHART を使用してデータに基づいた基本的なグラフを作成しましょう。

HTML を印刷

  1. SAS で、[Editor]ウィンドウに移動します。
  2. PROC PRINT を使用してHive Customers データのHTML レポートを印刷します。
    proc print data=customers;
      title "Hive Customers Data";
    run;
    
    A simple Hive data report.

チャートを印刷

  1. SAS で、[Editor]ウィンドウに移動します。
  2. PROC GCHART を使用してCustomers データのチャートを作成します。
    proc gchart data=customers;
      pie city / sumvar=companyname
          value=arrow
          percent=arrow
          noheading
          percent=inside plabel=(height=12pt)
          slice=inside value=none
          name='CustomersChart';
    run;
    
    A simple Hive data chart.