製品をチェック

Parquet ODBC Driver の30日間無償トライアルをダウンロード

 30日間の無償トライアルへ

製品の詳細

Parquet アイコン Parquet ODBC Driver 相談したい

Parquet ODBC Driver を使って、ODBC 接続をサポートするあらゆるアプリケーション・ツールからParquet にデータ連携。

Parquet データにデータベースと同感覚でアクセスして、Parquet データに使い慣れたODBC インターフェースで連携。

SAS でCData ODBC Driver for Parquet を使用

CData ODBC Driver を使用してSAS からリアルタイムParquet に接続します。

古川えりか
コンテンツスペシャリスト

最終更新日:2022-03-10
parquet ロゴ

CData

odbc ロゴ画像
SAS ロゴ

こんにちは!ドライバー周りのヘルプドキュメントを担当している古川です。

SAS は、高度なアナリティクス、多変量解析、BI、データ管理、予測分析のためのソフトウェアです。SAS とCData ODBC Driver for Parquet を合わせて使うことで、SAS からリアルタイムParquet データへデータベースライクにアクセスできるようになり、レポーティング、分析能力を向上できます。本記事では、SAS でParquet のライブラリを作成し、リアルタイムParquet に基づいたシンプルなレポートを作成します。

CData ODBC ドライバーは、ドライバーに組み込まれた最適化されたデータ処理により、SAS でリアルタイムParquet データを送受信する場合に圧倒的なパフォーマンスを提供します。SAS からParquet に複雑なSQL クエリを発行すると、ドライバーはフィルタや集計などのサポートされているSQL 操作をParquet に直接プッシュし、組み込みSQL エンジンを利用して、サポートされていない操作(一般的にはSQL 関数とJOIN 操作)をクライアント側で処理します。組み込みの動的メタデータクエリを使用すると、SAS でParquet を簡単にビジュアライズおよび分析できます。

CData ODBC ドライバとは?

CData ODBC ドライバは、以下のような特徴を持ったリアルタイムデータ連携ソリューションです。

  1. Parquet をはじめとする、CRM、MA、会計ツールなど多様なカテゴリの270種類以上のSaaS / オンプレミスデータソースに対応
  2. 多様なアプリケーション、ツールにParquet データを連携
  3. ノーコードでの手軽な接続設定
  4. 標準 SQL での柔軟なデータ読み込み・書き込み

CData ODBC ドライバでは、1.データソースとしてParquet の接続を設定、2.SAS 側でODBC Driver との接続を設定、という2つのステップだけでデータソースに接続できます。以下に具体的な設定手順を説明します。

CData ODBC ドライバのインストールとParquet への接続設定

まずは、本記事右側のサイドバーからParquet ODBC Driver の無償トライアルをダウンロード・インストールしてください。30日間無償で、製品版の全機能が使用できます。

以下は、Parquet に接続するための情報と、Windows およびLinux 環境でDSN を構成するためのステップです。

Parquet 接続プロパティの取得・設定方法

ローカルのParquet ファイルに接続するには、URI 接続プロパティをParquet ファイルへのパスに設定してください。

DSN を構成する際に、Max Rows プロパティを定めることも可能です。これによって返される行数を制限するため、ビジュアライゼーション・レポートのデザイン時のパフォーマンスを向上させるのに役立ちます。

Windows

未指定の場合は、初めにODBC DSN(data source name)で接続プロパティを指定します。ドライバーのインストールの最後にアドミニストレーターが開きます。Microsoft ODBC Data Source Administrator を使用して、ODBC DSN を作成および構成できます。

Linux

Linux 環境にCData ODBC Driver for Parquet をインストールする場合、ドライバーのインストールによりシステムDSN が事前定義されます。システムデータソースファイル(/etc/odbc.ini) を編集し、必要な接続プロパティを定義することで、DSN を変更できます。

/etc/odbc.ini

[CData Parquet Sys] Driver = CData ODBC Driver for Parquet Description = My Description URI = C:/folder/table.parquet

これらの構成ファイルの使用に関する具体的な情報については、ヘルプドキュメントを参照してください。

SAS でParquet ライブラリを作成

CData ODBC Driver for Parquet に基づくライブラリを追加することで、SAS でParquet に接続します。

  1. SAS を開き、[Explorer]ペインで[Libraries]を展開します。
  2. [Active Libraries]ウィンドウで右クリックし、[New]を選択します。
  3. ライブラリに名前を付け(odbclib)、Engine としてODBC を選択し、ライブラリをセッション間で保持する場合は[Enable at startup]をクリックします。
  4. Data Source を以前構成したDSN に設定し、[OK]をクリックします。 Creating a library for Parquet in SAS.

Parquet クエリからビューを作成

SAS は、ローコードのポイントアンドクリッククエリツールを使用するか、PROC SQL とカスタムSQL クエリのプログラムを使うことで、データのクエリをネイティブにサポートします。SAS でビューを作成すると、ビューがクエリされるたびに定義クエリが実行されます。これは、レポート、チャート、分析について常にリアルタイムParquet データにクエリを実行することを意味します。

クエリツールの使用

  1. SAS で[Tools]->[Query]と進みます。
  2. データをプルするテーブルソースとテーブルを選択し、[OK]をクリックします。 Selecting table(s) to visualize.
  3. カラムを選択し、右クリックしてフィルタリング、順序付け、グループ化などを追加します。 Selecting columns(s) to visualize and configuring the query.
  4. [SQL Query Tool]ウィンドウを右クリックして[Show Query]を選択し、[Create View]をクリックして、クエリの結果を含むローカルビューを作成します。ビューに名前を付け、[OK] をクリックします。 Create a local view to work with Parquet データ.

PROC SQL の使用

  1. SAS で、[Editor]ウィンドウに移動します。
  2. PROC SQL を使用してデータをクエリし、ローカルビューを作成します。
    Note:このステップにより、[Work]ライブラリにビューが作成されます。オプションとして、create view ステートメントでライブラリを指定できます。
    proc sql;
      create view sampletable_1_view as
      select 
        id, 
        column1 
      from 
        odbclib.sampletable_1 
      where 
        Column2 = 'SAMPLE_VALUE';
    quit;
    
  3. [Run]->[Submit]とクリックしてクエリを実行し、ローカルビューを作成します。

SAS のParquet データに関するレポートまたはビジュアライズ

ローカルビューを作成すると、パワフルなSAS 機能を使用してParquet データをレポート、ビジュアライズ、またはその他の方法で分析できます。PROC PRINT を使用して簡単なレポートを印刷し、PROC GCHART を使用してデータに基づいた基本的なグラフを作成しましょう。

HTML を印刷

  1. SAS で、[Editor]ウィンドウに移動します。
  2. PROC PRINT を使用してParquet SampleTable_1 データのHTML レポートを印刷します。
    proc print data=sampletable_1;
      title "Parquet SampleTable_1 Data";
    run;
    
    A simple Parquet データ report.

チャートを印刷

  1. SAS で、[Editor]ウィンドウに移動します。
  2. PROC GCHART を使用してSampleTable_1 データのチャートを作成します。
    proc gchart data=sampletable_1;
      pie id / sumvar=column1
          value=arrow
          percent=arrow
          noheading
          percent=inside plabel=(height=12pt)
          slice=inside value=none
          name='SampleTable_1Chart';
    run;
    
    A simple Parquet データ chart.

Parquet からSAS へのデータ連携には、ぜひCData ODBC ドライバをご利用ください

このようにCData ODBC ドライバと併用することで、270を超えるSaaS、NoSQL データをコーディングなしで扱うことができます。30日の無償評価版が利用できますので、ぜひ自社で使っているクラウドサービスやNoSQL と合わせて活用してみてください。

CData ODBC ドライバは日本のユーザー向けに、UI の日本語化、ドキュメントの日本語化、日本語でのテクニカルサポートを提供しています。

関連コンテンツ

トライアル・お問い合わせ

30日間無償トライアルで、CData のリアルタイムデータ連携をフルにお試しいただけます。記事や製品についてのご質問があればお気軽にお問い合わせください。