Groq、Hugging Faceの推論プロバイダーとしてサポート開始
Groq on Hugging Face Inference Providers 🔥
GroqはHugging Face Hubでサポートされる推論プロバイダーとして追加されました。これにより、Hugging Face Hubのモデルページ上でサーバーレス推論の機能が強化されます。Groqは、MetaのLlama 4、QwenのQWQ-32Bなどの最新のオープンソースモデルを含む、幅広いテキストおよび会話モデルをサポートしています。Groqの基盤技術は、大規模言語モデル(LLM)のような計算集約的なアプリケーションにおいて最速の推論を提供する新しいエンドツーエンド処理ユニットシステムであるLPUTM(Language Processing Unit)です。LPUsは、GPUの推論における限界を克服するように設計されており、大幅に低いレイテンシと高いスループットを提供します。開発者は、Groqの推論APIをHugging Faceの推論プロバイダーとして利用でき、Hugging Faceトークンを使用してHugging Face経由でルーティングするか、自身のGroq APIキーを使用することができます。カスタムキーを使用する場合、請求は各プロバイダーに直接行われますが、HF経由でルーティングする場合は、Hugging Faceアカウントに請求されます。Hugging Face PROユーザーは毎月2ドルの推論クレジットが付与され、サインインした無料ユーザーには少量の無料推論が提供されます。
- GroqがHugging Face Hubの推論プロバイダーとして追加された
- GroqがMetaのLlama 4やQwenのQWQ-32Bなどの最新オープンソースモデルをサポート
GroqがHugging Faceの推論プロバイダーとして採用されたことは、同社のLPU(Language Processing Unit)技術が業界標準のプラットフォームで認知されつつあることを示す。Hugging FaceはAI開発者にとって最大のハブであり、そこに推論プロバイダーとして組み込まれることで、GroqのLPUはGPU代替としての認知度とユーザーベースを一気に拡大できる。特にLlama 4やQWQ-32Bといった最新モデルの推論を低レイテンシで提供可能である点は、AI推論のハードウェア市場においてGPU依存からの脱却が進む可能性を示唆しており、Groqの競合(NVIDIA、AMD、Intelなど)に対する投資インパクトを注視すべき。