| 会社種別 | プライベート |
|---|---|
| 業界 | |
| 設立 | 2016 |
| 創設者 |
|
| 本部 | 、 私たち |
主要人物 | ジョナサン・ロス(CEO)、アンドリュー・S・ラパポート(取締役)、チャマス・パリハピティヤ(投資家) |
| 製品 | 言語処理ユニット (LPU) |
| 収益 | 320万米ドル(2023年)[1] |
| 8,800万米ドル(2023年)[1] | |
従業員数 | 250(2023) |
| Webサイト | groq.com |
Groq, Inc. は、 AI ワークロードの推論パフォーマンスを高速化するために、言語処理ユニット (LPU) と呼ばれるAI アクセラレータ特定用途向け集積回路(ASIC) と関連ハードウェアを構築するアメリカの人工知能(AI ) 企業です。
GroqのLPUで実行されるAIワークロードの例として、大規模言語モデル(LLM)[2] [3] 画像分類[ 4] 異常検出[5] [ 6]予測分析[7] [8]などが挙げられます。
Groq はカリフォルニア州マウンテンビューに本社を置き、カリフォルニア州サンノゼ、ワシントン州リバティーレイク、カナダのトロント、イギリスのロンドンにオフィスを構え、北米とヨーロッパ全域にリモート従業員を擁しています。
歴史
Groqは、AIアクセラレータASICであるTensor Processing Unit (TPU)の設計者の一人であるジョナサン・ロスと、起業家でありGoogle X( X Developmentとして知られる)の元エンジニアで同社の初代CEOを務めたダグラス・ワイトマンが率いる元Googleエンジニアのグループによって2016年に設立されました。[9] [1]
Groqは、2017年にSocial CapitalのChamath Palihapitiyaから1,000万ドルのシード資金を受け取り[10]、その後すぐに追加資金を確保しました。
2021年4月、GroqはTiger Global ManagementとD1 Capital Partnersが主導するシリーズCラウンドで3億ドルを調達しました。[11]現在の投資家には、The Spruce House Partnership、Addition、GCM Grosvenor、Xⁿ、Firebolt Ventures、General Global Capital 、Tru Arrow Partnersが含まれ、 TDK Ventures、XTX Ventures、Boardman Bay Capital Management、Infinitum Partnersからの追加投資もあります。 [12] [13] GroqのシリーズC資金調達ラウンド後、評価額は10 億ドルを超え、このスタートアップはユニコーンになりました。[14]
2022年3月1日、Groqはデータフローシステム技術で知られるMaxeler Technologiesを買収した。[15]
2023年8月16日、Groqは、サムスンの4ナノメートル(nm)プロセスノードで次世代チップを製造するために、テキサス州テイラーにあるサムスン電子のファウンドリーを選択しました。これは、この新しいサムスンチップ工場での最初の注文でした。[16]
2024年2月19日、Groqは開発者プラットフォームGroqCloudをソフトローンチし、開発者にGroq APIの使用とチップへのアクセスのレンタルを促しました。[17] [1] 2024年3月1日、Groqはクラウドプラットフォームの支援のため、ビジネス指向のAIソリューションを幅広く提供していることで知られるスタートアップ企業Definitive Intelligenceを買収しました。[18]
Groqは2024年8月にブラックロック・プライベート・エクイティ・パートナーズが主導するシリーズDラウンドで6億4000万ドルを調達し、企業価値は28億ドルに達した。[1] [19]
言語処理ユニット

GroqのASICの最初の名前はTensor Streaming Processor (TSP)でしたが、後にTSPはLanguage Processing Unit (LPU)に改名されました。[2] [20] [21]
LPUは機能的にスライスされたマイクロアーキテクチャを特徴としており、メモリユニットがベクトルおよび行列計算ユニットとインターリーブされています。[22] [23]この設計により、AI計算グラフでのデータフロー局所性の活用が容易になり、実行パフォーマンスと効率が向上します。LPUは、次の2つの重要な観察に基づいて設計されました。
- AIワークロードは、専用のハードウェアにマッピングできる実質的なデータ並列性を示し、パフォーマンスの向上につながります。[22] [23]
- 決定論的なプロセッサ設計と生産者-消費者 プログラミングモデルを組み合わせることで、ハードウェアコンポーネントを正確に制御および推論できるようになり、パフォーマンスとエネルギー効率が最適化されます。[22] [23]
機能的にスライスされたマイクロアーキテクチャに加えて、LPUはシングルコアの決定論的アーキテクチャによっても特徴付けられます。[22] [24] LPUは、従来の反応型ハードウェアコンポーネント(分岐予測器、アービター、並べ替えバッファ、キャッシュ)の使用を回避し、すべての実行をコンパイラによって明示的に制御することで、決定論的な実行を実現し、LPUプログラムの実行における決定論を保証します。 [ 23 ]
第1世代のLPU(LPU v1)は、25×29 mmの14nmチップで、公称クロック周波数900MHzで動作し、シリコン1平方mmあたり1TeraOp/s以上の計算密度を実現します。[22]第2世代のLPU(LPU v2)は、サムスンの4nmプロセスノードで製造されます。[16]
パフォーマンス
Groqは、MetaのLlama2-70Bパラメータモデルを実行しながら、1秒あたり100トークンの生成速度を突破した最初のAPIプロバイダーとして登場しました。 [25]
Groqは現在、LPU上で実行されるさまざまなオープンソースの大規模言語モデルを一般公開しています。[26]これらのデモにはGroqのウェブサイトからアクセスできます。これらのオープンソースLLMを実行しているときのLPUのパフォーマンスは、他のLLMプロバイダーと比較して、ArtificialAnalysis.aiによって独立してベンチマークされています。[27] LPUの測定されたパフォーマンスを下の表に示します。
参照
参考文献
- ^ abcde Nieva, Richard (2024年8月5日). 「AIチップブームがこの小さなスタートアップを救った。今や時価総額28億ドル、Nvidiaに挑む」Forbes。
- ^ ab Williams, Wayne (2024年2月27日). 「『魔法のような気分!』:Groqの超高速LPUは、LLMネイティブプロセッサとしては初のものになる可能性があり、その最新デモはNvidiaとAMDに小切手を取り出すよう説得するかもしれない」。TechRadar Pro。TechRadar 。2024年4月19日閲覧。
- ^ Ward-Foxton, Sally (2023年9月12日). 「Groqが4年前のシリコンで高速LLMを実証」. EETimes . 2024年4月19日閲覧。
- ^ Ward-Foxton, Sally (2020年1月21日). 「GroqのAIチップがクラウドに登場」. EETimes . 2024年4月19日閲覧。
- ^ ムーアヘッド、パトリック。「米陸軍分析グループ – サイバーセキュリティの異常検出が1000倍高速化し、誤検知も減少」。Forbes 。 2024年4月19日閲覧。
- ^ アーサー・ハーマン「サイバーセキュリティはハイテク時代に突入」フォーブス。 2024年4月19日閲覧。
- ^ Heinonen, Nils. 「研究者がアルゴンヌのGroq AIプラットフォームで核融合研究を加速」アルゴンヌリーダーシップコンピューティング施設。 2024年4月19日閲覧。
- ^ Larwood, Mariah; Cerny, Beth. 「ArgonneがALCF AIテストベッドに新しいGroqシステムを導入し、世界中の研究者にAIアクセラレータへのアクセスを提供」。Argonne Leadership Computing Facility 。 2024年4月19日閲覧。
- ^ Levy, Ari (2017年4月21日). 「数人のGoogleエンジニアが、最も秘密主義的なAIプロジェクトの1つを離れ、ステルススタートアップを設立」CNBC . 2024年4月19日閲覧。
- ^ Clark, Kate (2018年9月6日). 「秘密主義の半導体スタートアップGroqがSocial Capitalから5200万ドルを調達」TechCrunch . 2024年4月19日閲覧。
- ^ キング、イアン(2021年4月14日)。「Tiger GlobalとD1がAIチップスタートアップGroqで3億ドルの資金調達をリード」ブルームバーグ。 2024年4月19日閲覧。
- ^ Wheatly, Mike (2021年4月14日). 「AIチップメーカーのGroqがシリーズCラウンドで3億ドルを調達」. Silicon Angle . 2024年4月19日閲覧。
- ^ McFarland, Alex (2021年4月14日). 「AIチップスタートアップのGroqがシリーズCの資金調達で3億ドルを調達」Unite.AI . 2024年4月19日閲覧。
- ^ Andonov, Kaloyan; Lavine, Rob (2021年4月19日). 「分析: Groqが3億ドルのシリーズCを計算」. Global Venturing . 2024年4月19日閲覧。
- ^ Prickett Morgan, Timothy (2022年3月2日). 「GROQがHPCとAIデータフローの専門知識を得るためにMAXELERを買収」. The Next Platform . 2024年4月19日閲覧。
- ^ ab Hwang, Jeong-Soo. 「Samsungの米国新チップ工場、Groqから初のファウンドリ受注」。韓国経済日報。 2024年4月19日閲覧。
- ^ Franzen, Carl (2024年3月). 「Groqが新たに買収したDefinitive Intelligenceとともに開発者向けプレイグラウンドGroqCloudを立ち上げ」Venture Beat 2024年4月19日閲覧。
- ^ Wiggers, Kyle (2024年3月). 「AIチップスタートアップGroqが新事業部を設立し、Definitive Intelligenceを買収」TechCrunch . 2024年4月19日閲覧。
- ^ Wiggers, Kyle (2024-08-05). 「AIチップスタートアップGroqが6億4000万ドルを調達しNvidiaに挑む」TechCrunch . 2024年8月26日閲覧。
- ^ Mellor, Chris (2024年1月23日). 「Grokking Groq's Groqness」. Blocks & Files . 2024年4月19日閲覧。
- ^ アプツ、デニス;ロス、ジョナサン。スパーリング、ジョナサン。ウォン・ヴァンハーレン、マーク。ベイカー、マックス。ホーキンス、トム。ベル、アンドリュー。トンプソン、ジョン。カサイ、テメスゲン。キンメル、ガーリン。ファン、ジェニファー。レスリー・ハード、レベッカ。さようなら、マイケル。クレスウィック、ER;ボイド、マシュー。ベニガラ、マヒタ。ラフォージ、エヴァン。パーディ、ジョン。カマス、プルショサム。マヘシュワリ、ディネシュ。バイドラー、マイケル。ロシール、ギアト。アフマド、オマル。ガガーリン、グレブ。リチャード・チェカルスキー。レーン、アシェイ。パルマル、サヒル。ヴェルナー、ジェフ。シュプロッハ、ジム。マシアス、エイドリアン。ブライアン・カーツ(2020年5月)。 「Think Fast:ディープラーニングワークロードを高速化する Tensor Streaming Processor (TSP)」(PDF)。2020 ACM/IEEE 第 47 回国際コンピュータアーキテクチャシンポジウム (ISCA)。pp. 145– 158。doi :10.1109/ISCA45697.2020.00023。番号 978-1-7281-4661-4。
- ^ abcdef Abts, Dennis; Kimmell, Garrin; Ling, Andrew; Kim, John; Boyd, Matt; Bitar, Andrew; Parmar, Sahil; Ahmed, Ibrahim; Dicecco, Roberto; Han, David; Thompson, John; Bye, Michael; Hwang, Jennifer; Fowers, Jeremy; Lillian, Peter; Murthy, Ashwin; Mehtabuddin, Elyas; Tekur, Chetan; Sohmers, Thomas; Kang, Kris; Maresh, Stephen; Ross, Jonathan (2022-06-11). 「大規模機械学習のためのソフトウェア定義テンソルストリーミングマルチプロセッサ」。第49回国際コンピュータアーキテクチャシンポジウムの議事録。pp. 567– 580。doi : 10.1145 /3470496.3527405。番号 978-1-4503-8610-4。
- ^ abcd Abts, Dennis; Kimmell, Garrin; Ling, Andrew; Kim, John; Boyd, Matt; Bitar, Andrew; Parmar, Sahil; Ahmed, Ibrahim; Dicecco, Roberto; Han, David; Thompson, John; Bye, Michael; Hwang, Jennifer; Fowers, Jeremy; Lillian, Peter; Murthy, Ashwin; Mehtabuddin, Elyas; Tekur, Chetan; Sohmers, Thomas; Kang, Kris; Maresh, Stephen; Ross, Jonathan (2022 年 6 月 11 日)。「大規模機械学習向けのソフトウェア定義テンソルストリーミングマルチプロセッサ」。第 49 回国際コンピュータアーキテクチャシンポジウムの議事録。pp. 567– 580。doi : 10.1145 /3470496.3527405。番号 978-1-4503-8610-4. 2024年3月18日閲覧。
- ^ Singh, Satnam (2022年2月11日)。「決定論の好循環: GroqのTensorストリーミングプロセッサのプログラミング」 。2022 ACM/ SIGDA国際フィールドプログラマブルゲートアレイシンポジウムの議事録。p. 153。doi :10.1145/ 3490422.3510453。ISBN 978-1-4503-9149-8. 2024年3月18日閲覧。
- ^ スミス・グッドソン、ポール。「Groqの記録破りの言語プロセッサが大規模なAIモデルで1秒あたり100トークンを達成」。Forbes 。2024年4月19日閲覧。
- ^ モリソン、ライアン(2024年2月27日)。「Groqをご覧ください。AIモデルを非常に高速に実行するように設計されたチップです」。Tom 's Guide 。 2024年4月19日閲覧。
- ^ 「Groq が新しい LLM ベンチマークで有望な結果を示し、業界平均を上回る」 HPCwire。2024 年 2 月 13 日。2024年 3 月 18 日閲覧。
- ^ 「Llama-2 Chat 70B プロバイダー」。artificialanalysis.ai 。 2024年3月18日閲覧。
- ^ 「Groq が新しい LLM ベンチマークで有望な結果を示し、業界平均を上回る」 Datanami. 2024 年 2 月 13 日。2024年 3 月 18 日閲覧。
- ^ 「Groq、4年前のシリコンで高速LLMをデモ」。EE Times。2023年9月12日。 2024年3月18日閲覧。
- ^ 「Mixtral 8x7B 指示プロバイダー」。artificialanalysis.ai 。2024年3月18日閲覧。
- ^ 「Gemma-7B モデルプロバイダー」。artificialanalysis.ai 。 2024年3月18日閲覧。
外部リンク
- 公式サイト
