製品

ソリューション

コネクタ

サポート

価格

企業情報

お役立ち情報

ブログ

検索お問い合わせ

製品をチェック

Apache Hive ODBC Driver の30日間無償トライアルをダウンロード

30日間の無償トライアルへ

製品の詳細

Apache Hive ODBC Driver 相談したい

Hive ODBC Driver は、ODBC 接続をサポートする任意のアプリケーションからApache Hive データに直接接続できるパワフルなツールです。

ドライバーはSQL をHiveQL にマッピングして、標準SQL-92 で直接Apache Hive にアクセスできます。

Alteryx Designer でHive データを準備、ブレンディング、分析する

リアルタイムHive データにアクセスしてセルフサービスデータ分析を行うワークフローを構築します。

古川えりか
コンテンツスペシャリスト
最終更新日：2022-12-15

CData

こんにちは！ドライバー周りのヘルプドキュメントを担当している古川です。

CData ODBC Driver for ApacheHive はODBC 標準のHive からのリアルタイムデータへのアクセスを可能にし、使い慣れたSQL クエリを用いて、さまざまなBI、レポート、ETL ツールでHive データを直接扱うことができます。この記事では、Alteryx Designer でODBC 接続を使ってHive データに接続し、セルフサービスBI、データプレパレーション、データブレンディングから高度な分析までを実行する方法を紹介します。

CData ODBC ドライバーには最適化されたデータ処理が組み込まれており、Alteryx Designer でリアルタイムHive データを扱う上で高いパフォーマンスを提供します。Alteryx Designer からHive にSQL クエリを発行すると、CData ドライバーはフィルタや集計などのHive 側でサポートしているSQL 操作をHive に直接渡し、サポートされていない操作（主にSQL 関数とJOIN 操作）は組み込みSQL エンジンを利用してクライアント側で処理します。組み込みの動的メタデータクエリを使用すると、ネイティブのAlteryx データフィールド型を使ってHive データを可視化および分析できます。

CData ODBC ドライバとは？

CData ODBC ドライバは、以下のような特徴を持った製品です。

Hive をはじめとする、CRM、MA、会計ツールなど多様なカテゴリの270種類以上のSaaS / オンプレデータソースに対応
多様なアプリケーション、ツールにHive データを連携
ノーコードでの手軽な接続設定
標準SQL での柔軟なデータ読み込み・書き込み

CData ODBC ドライバでは、1.データソースとしてHive の接続を設定、2.Alteryx Designer 側でODBC Driver との接続を設定、という2つのステップだけでデータソースに接続できます。以下に具体的な設定手順を説明します。

CData ODBC ドライバのインストールとHive への接続設定

まずは、本記事右側のサイドバーからApacheHive ODBC Driver の無償トライアルをダウンロード・インストールしてください。30日間無償で、製品版の全機能が使用できます。

必要な接続プロパティの値がまだ未設定の場合は、データソース名（DSN）を設定します。組み込みのMicrosoft ODBC データソースアドミニストレーターを使ってDSN を構成できます。これは、ドライバーのインストールの最後のステップでも可能です。Microsoft ODBC データソースアドミニストレーターを使ってDSN を作成および設定する方法については、ヘルプドキュメントの「はじめに」を参照してください。

Apache Hive への接続を確立するには以下を指定します。
- Server：HiveServer2 をホストするサーバーのホスト名またはIP アドレスに設定。
- Port：HiveServer2 インスタンスへの接続用のポートに設定。
- TransportMode：Hive サーバーとの通信に使用するトランスポートモード。有効な入力値は、BINARY およびHTTP です。デフォルトではBINARY が選択されます。
- AuthScheme：使用される認証スキーム。有効な入力値はPLAIN、LDAP、NOSASL、およびKERBEROS です。デフォルトではPLAIN が選択されます。
- CData 製品においてTLS/SSL を有効化するには、UseSSL をTrue に設定します
DSN を構成する際、Max Rows 接続プロパティも設定することができます。これを設定すると返される行数が制限されるため、レポートやビジュアライゼーションを作成する際のパフォーマンスが向上します。

Alteryx Designer を開いて新しいワークフローを作成します。
新規のデータ入力ツールをワークフローにドラッグ＆ドロップします。

「ファイルまたはデータベースを接続」の下のドロップダウンをクリックし、続けて「データソース」タブを選択します。

ページの最後に移動し、「Generic connection」の下の「ODBC」をクリックします。
Alteryx で使用するために設定したDSN （CData Hive Source）を選択します。

ウィザードが開いたら、クエリを実行するテーブルを「クエリビルダ」ボックスにドラッグ&ドロップします。クエリに含めるチェックボックスをオンにしてフィールドを選択します。可能な場合、フィルタと集計によって生成されたクエリはHive に渡され、サポートされていない操作（SQL 関数とJOIN 操作を含む）は、コネクタに組み込まれたCData SQL エンジンによってクライアント側で管理されます。

データセットをさらにカスタマイズする場合は、SQL エディタを開いてクエリを手動で変更し、句や集計などの操作を追加して、必要なHive データを正確に取得できるようにします。

クエリを定義したら、Alteryx Designer でHive データを操作できるようになります。

Hive データに対してセルフサービス分析を実行

これで、Hive データを準備、ブレンディング、分析するためのワークフローを作成する準備ができました。CData ODBC ドライバは動的なメタデータ検出を実行し、Alteryx データフィールドタイプを使用してデータを表示し、Designer ツールを活用して必要に応じてデータを操作し、意味のあるデータセットを構築できるようにします。以下の例では、データをクレンジングして参照します。

データクレンジングツールをワークフローに追加し、「Nullの置換」の2つのチェックボックスをオンにして、null テキストフィールドを空白に、null 数値フィールドを0 に置き換えます。「不要な文字の削除」下のチェックボックスをオンにして、先頭と末尾の空白を削除することもできます。

閲覧ツールをワークフローに追加します。

クリックしてワークフローを実行します（Ctrl + R）。

結果ビューでクレンジングされたHive データを確認します。

高いパフォーマンスを発揮する組み込みのデータ処理により、Alteryx でHive データを迅速にクレンジング、変換、分析することができます。

トライアル・お問い合わせ

30日間無償トライアルで、CData のリアルタイムデータ連携をフルにお試しいただけます。記事や製品についてのご質問があればお気軽にお問い合わせください。

無償トライアルへ

お問い合わせ

CData Software は、データアクセスおよびデータ接続ソリューションのリーディングプロバイダーです。CData の標準コネクタはあらゆるツール・ミドルウェアからのSaaS やDB データの連携を簡単にします。

お問い合わせ

製品概要

データコネクタ

ETL/ ELT ソリューション

クラウド&API 接続

OEM & カスタムドライバー開発

お問い合わせ先

製品を知る

データ分析 & BI

企業情報

ニュース & 事例

ソリューション

開催予定のイベント