HUGS:オープンモデルでAIをスケールさせるHugging Faceの新しいサービス
Introducing HUGS - Scale your AI with Open Models
Hugging Faceは、オープンモデルを活用したAIアプリケーション開発を簡素化・加速する「HUGS(Hugging Face Generative AI Services)」を発表しました。HUGSは、Text Generation InferenceやTransformersといったオープンソース技術を基盤とし、NVIDIA GPU、AMD GPU、そして今後AWS InferentiaやGoogle TPUなどの多様なハードウェア上で最適化された推論マイクロサービスを提供します。これにより、開発者は自社インフラ内でゼロコンフィギュレーションでLLMを効率的にデプロイ・スケールさせることが可能になります。HUGSはOpenAI互換APIを提供し、既存の生成AIアプリケーションとのシームレスな統合を可能にします。デプロイメントは、AWS、Google Cloud Platformのマーケットプレイス、DigitalOceanの1-Click Models、またはEnterprise Hub経由で利用可能です。2025年9月現在、HUGSのモデルデプロイメントコンテナの提供は終了しており、代わりにDell Enterprise HubやAzure AI FoundryのHugging Face Collectionの利用が推奨されています。HUGSは、Llama-3.1シリーズ、Hermes-3シリーズ、Mistralシリーズ、Gemma-2シリーズ、Qwen2.5など、13の主要なオープンLLMをサポートしています。
- Hugging Faceがオープンモデル推論マイクロサービス「HUGS」を発表
- HUGSがNVIDIA GPU、AMD GPU、AWS Inferentia、Google TPUなどマルチハードウェア対応を発表
- 2025年9月時点でHUGSのモデルデプロイメントコンテナ提供が終了し、Dell Enterprise HubやAzure AI Foundryでの提供に移行
Hugging FaceがHUGSを発表した点は、オープンモデルをエンタープライズ環境で容易にデプロイ・スケールさせるプラットフォームとしてのポジションを強化する動き。特にNVIDIA GPUに加えAMD GPUやAWS Inferentia、Google TPUなどマルチハードウェア対応を謳っている点が重要で、クラウドプロバイダー間のAI推論コスト競争が激化する中、顧客のベンダーロックインを防ぎつつHugging Faceのエコシステムを拡大する戦略と評価できる。ただし2025年9月時点ではHUGSのコンテナ提供が終了しており、DellやAzureとの協業に移行している点は、事業戦略の修正を示唆しており投資判断においては継続注視が必要。