Loading article…
ワイドとナロー(時にはアンスタックとスタック、またはワイドとトール)は、表形式のデータの2つの異なる表現を説明するために使用される用語です。[1] [2]
広い
ワイドなデータ、つまりスタックされていないデータは、それぞれの異なるデータ変数が別々の列に表示されます。
狭い
狭い、積み重ねられた、または長いデータは、すべての値を含む 1 つの列と、値のコンテキストをリストする別の列で表示されます。
多くの場合、これは実装が簡単です。新しいフィールドを追加してもテーブルの構造を変更する必要はありませんが、ユーザーにとって理解しにくくなる可能性があります。
実装
多くの統計およびデータ処理システムには、これら 2 つの表現形式を変換する関数があります。たとえば、R プログラミング言語には、tidyr パッケージなどのパッケージがいくつかあります。Python の pandas パッケージは、この操作を「melt」関数として実装し、幅の広いテーブルを狭いテーブルに変換します。狭いテーブルを広いテーブルに変換するプロセスは、データ変換のコンテキストでは一般に「ピボット」と呼ばれます。「pandas」Python パッケージは、狭いテーブルから広いテーブルへの変換を可能にする「pivot」メソッドを提供します。
参照
参考文献
- ^ Thompson, ME (1997)、「サンプル調査の理論」、Chapman & Hall、ロンドン。ISBN 0-412-31780 -X
- ^ Chantala, K. (2006)「STATA を使用したサンプル調査データの分析」2001 年 10 月 1 日。UNC チャペルヒル、カロライナ人口センター。2006 年 10 月 1 日。
外部リンク
- https://tidyr.tidyverse.org/articles/pivot.html
- https://cran.r-project.org/web/packages/reshape
