Alluxio は、コンピューティング フレームワークと永続ストレージの間に位置するオープンソースの仮想分散ファイルシステム(VDFS)です。当初は研究プロジェクト「Tachyon」として、カリフォルニア大学バークレー校のAMPLabでHaoyuan Li氏の博士論文[ 2 ]として作成され、 Scott Shenker教授とIon Stoica教授が指導しました。Alluxio は、ビッグデータ分析スタックのコンピューティングとストレージの間に位置しています。コンピューティング フレームワークにデータ抽象化レイヤーを提供し、アプリケーションが共通のインターフェースを介して多数のストレージ システムに接続できるようにします。このソフトウェアはApache Licenseの下で公開されています。
データ分析、機械学習、AIなどのデータ駆動型アプリケーションは、Alluxioが提供するAPI(Hadoop HDFS API、S3 API、FUSE APIなど)を使用して、さまざまなストレージシステムのデータと高速にやり取りします。Alluxio上で動作する人気のフレームワークには、Apache Spark [ 3 ] Presto、TensorFlow、Trino [ 4 ] Apache Hive、PyTorchなどがあります。
Alluxioは、オンプレミス環境、クラウド環境( Microsoft Azure、AWS、Google Compute Engineなど)、またはハイブリッドクラウド環境にデプロイできます。ベアメタル環境、あるいはKubernetes、Docker、Apache Mesosなどのコンテナ環境で実行可能です。
Alluxioは、2013年にカリフォルニア大学バークレー校のAMPLabでHaoyuan Liによって最初に開始され、2014年にオープンソース化されました。Alluxioは2018年には1000人以上の貢献者を抱えており[ 5 ] 、データエコシステムで最も活発なプロジェクトの1つとなっています。
以下は、Alluxioを利用した、または現在利用している著名な企業のリストです。