Fooocusは、テキストプロンプトから画像を生成できるオープンソースの生成型人工知能プログラムです。[ 3 ] [ 4 ]画像機能のベースモデルとしてStable Diffusion XLを使用し、画像生成プロセスをより効率化するためのデフォルト設定とプロンプトのコレクションも備えています。[ 3 ] [ 4 ] [ 5 ]
Fooocusは、香港中文大学と蘇州大学で学んだスタンフォード大学の博士課程学生であるLvmin Zhangによって作成されました。[ 6 ] [ 7 ]彼はまた、 AUTOMATIC1111やComfyUIなど、他の多くのStable Diffusionインターフェースに採用されているControlNetの主要著者でもあります。[ 8 ] [ 6 ] [ 9 ] 2024年7月9日現在、このプロジェクトはGitHubで38.1kスターを獲得しています。[ 10 ]
Fooocusの主な特徴は、セットアップが簡単で、望ましい結果を得るためにユーザーがモデル パラメータを手動で構成する必要がないことです。[ 6 ] [ 3 ] [ 11 ]プロジェクトによると、GPT-2を使用して、ユーザーのプロンプトに詳細を自動的に追加します。[ 12 ]デフォルトでLCM低ランク適応などの一般的な拡張機能が含まれており、より高速な生成速度を実現します。[ 4 ] [ 13 ] Fooocus はデフォルトで写真スタイルを好み、定義済みのスタイルの一覧から選択できます。[ 3 ] [ 14 ] Fooocus はすぐに良い結果を提供することを目指していますが、ユーザーがカスタマイズできる「詳細」タブも含まれています。 [ 15 ]ユーザーインターフェイスはGradioに基づいています。[ 16 ]
このプロジェクトは1年以上更新されていないようです。Fooocusの最新のgit更新は2024年8月12日でした。[ 17 ]
採用しました。これは、私がPCで試した他のすべてのものの中で最も簡単なインストール手順でした。