データ ドリリング(ドリルダウンとも呼ばれる) とは、表形式、リレーショナル、多次元データに対するさまざまな操作や変換を指します。この用語はさまざまなコンテキストで広く使用されていますが、主にデータ分析専用に設計された特殊なソフトウェアに関連付けられています。
一般的なデータドリル操作
データのドリルダウンを可能にするアプリケーションに共通する特定の操作があります。その中には次のようなものがあります。
クエリ操作:
- 表形式クエリ
- ピボットクエリ
表形式のクエリ
表形式のクエリ操作は、データ テーブルに対する標準操作で構成されます。
これらの操作には次のものがあります:
- 検索
- 選別
- フィルター(値による)
- フィルター(拡張機能または条件による)
- 変換する(例:列の追加や削除)
次の例を考えてみましょう。
フレッドとウィルマのテーブル(図001):
性別、姓、名、自宅 男性、フレッド、ショパン、ポーランド 男性、フレッド、フリントストーン、岩盤 男性、フレッド、ダースト、アメリカ 女性、ウィルマ、フリントストーン、ベッドロック 女性、ウィルマ、ルドルフ、アメリカ 女性、ウィルマ、ウェッブ、アメリカ 男性、フレッド、ジョンソン、米国
上記は、カンマ区切り値としてフォーマットされた単純なフラット ファイル テーブルの例です。テーブルには、fred や wilma という名前のさまざまな人物の名、姓、性別、出身国が含まれています。この例はこのようにフォーマットされていますが、表形式のクエリ操作 (およびすべてのデータ ドリル操作) は、基礎となるフォーマットに関係なく、考えられるすべてのデータ タイプに適用できることを強調することが重要です。唯一の要件は、使用中のソフトウェア アプリケーションでデータが読み取り可能であることです。
ピボットクエリ
ピボット クエリでは、異なるディメンションに従ってデータを複数の方法で表現できます。このクエリ タイプは表形式クエリに似ていますが、柔軟なユーザー選択階層に従って、データを要約形式で表現することもできます。このクラスのデータ ドリル操作は、正式には (そして大まかに)クロス集計クエリ、ピボット テーブル、データ パイロット、選択階層、相互連結性など 、さまざまな名前で知られています。
ピボット クエリ操作の基本を説明するために、Fred と Wilma のテーブル (図 001)を考えてみましょう。データをざっとスキャンすると、テーブルに冗長な情報があることがわかります。この冗長性は、アウトラインやツリー構造などを使用して統合できます。さらに、統合すると、データはさまざまな代替レイアウトを持つことができます。
単純なテキスト アウトラインを出力として使用すると、ピボット クエリで次の代替レイアウトが可能になります。
性別別にまとめる(図001):
女性
フリントストーン、ウィルマ
ルドルフ、ウィルマ
ウェッブ、ウィルマ
男
ショパン、フレッド
フリントストーン、フレッド
ダースト、フレッド
ジョンソン、フレッド
(ディメンション = 性別; 表形式フィールド = lname、fname;)
自宅、名前別にまとめます(図001):
岩盤
フリントストーン
フレッド
ウィルマ
ポーランド
ショパン
フレッド
アメリカ合衆国
...
(ディメンション = home、lname; 表形式フィールド = fname;)
用途
ピボット クエリ操作は、データの集合を複数の方法で要約し、同じ基本情報を異なる方法で表現するのに役立ちます。このタイプの操作はスプレッドシートやデスクトップデータベースソフトウェアでよく使用されますが、その柔軟性は十分に活用されていないと言えます。データの表現に「固定」階層のみを許可するアプリケーションは多く、これは大きな制限となります。
ドリルアップ
ドリルアップはドリルダウンの逆です。たとえば、ある製品の収益を確認するためにドリルダウンした場合、すべての製品の収益を確認するためにドリルアップが必要になる場合があります。[1]
参考文献
- ^ 「ドリルアップとドリルダウン」。IBM。2018年7月4日。 2020年5月5日閲覧。
