Hugging Faceユーザー向けにGoogle Cloud TPUが利用可能に
Google Cloud TPUs made available to Hugging Face users
Hugging Faceは、AI開発者向けにGoogle Cloud TPU v5eをInference EndpointsとSpacesで利用可能にしたと発表しました。TPUはGoogleが開発したカスタムAIハードウェアで、コスト効率と高いパフォーマンスが特徴です。Inference Endpointsでは、3つのインスタンス構成(v5litepod-1: $1.375/時、v5litepod-4: $5.50/時、v5litepod-8: $11.00/時)が提供され、Gemma、Llama、Mistralなどのモデルをデプロイできます。また、Hugging Face Spacesでも同様のTPUインスタンスが利用可能になり、AIデモやアプリケーションの構築・共有が容易になります。これらの機能は、Googleとの協力により開発されたオープンソースライブラリ「Optimum TPU」を通じて提供され、Hugging FaceのコミュニティがTPUの性能とコスト効率を活用できるようになります。
- Hugging FaceがGoogle Cloud TPU v5eをInference EndpointsとSpacesで利用可能にしたと発表
Hugging FaceがGoogle Cloud TPU v5eをInference EndpointsとSpacesで利用可能にしたことで、AI開発者はGPU不足の代替手段としてTPUを活用できるようになった。特に、Google独自のTPUをHugging Faceのエコシステムでシームレスに使える点は、AI推論のコスト構造を変える可能性がある。価格帯($1.375/時〜)もGPU対比で競争力があり、AIモデルのデプロイコスト低下と選択肢拡大という観点で注目すべき発表である。Optimum TPUというオープンソースライブラリで実装された点も、今後のAIインフラのマルチベンダー化・標準化の流れを加速させる可能性がある。