Microsoft Foundry、Hugging Faceモデルのマネージドコンピューティング対応を発表
Hugging Face Models on Foundry Managed Compute
Microsoft Foundryは、エージェント型AIアプリケーション構築・運用プラットフォームとして、Microsoft、OpenAI、Meta、Hugging Faceなど多様なモデルを単一エンドポイントから利用可能にする。今回、オープンソースおよびカスタムモデル向けのマネージドGPUプラットフォームサービスであるFoundry Managed Computeを発表した。これにより、開発者はモデルのパラメータ数やコンテキスト長などの要素を指定するだけで、FoundryがGPUトポロジーを管理する。また、vLLM、SGLang、TensorRT-LLMなどの主要な推論ランタイムがサポートされ、Microsoftがコンテナ更新、ランタイムアップグレード、セキュリティパッチ適用を自動で行う。Hugging Face Collectionは、厳選されたオープンソースモデルをFoundryモデルカタログに統合し、毎週更新される。モデルはセキュリティスクリーニングを受け、SafeTensors形式で提供され、信頼性の高いランタイムと組み合わされる。デプロイはカタログから5ステップで完了し、統一されたFoundryエンドポイントを通じて利用できる。この連携により、Hugging Faceのエコシステムで公開・発見されたオープンモデルを、Microsoft Foundry上でエンタープライズグレードの運用環境で利用できるようになる。
- Microsoft FoundryがHugging Faceモデル向けマネージドGPUサービス「Foundry Managed Compute」を発表
- 開発者はパラメータ数やコンテキスト長を指定するだけでGPUトポロジーを自動管理、主要推論ランタイム(vLLM、SGLang、TensorRT-LLM)をサポート
- 厳選されたオープンソースモデルを統合する「Hugging Face Collection」をFoundryモデルカタログに追加、毎週更新
Microsoft FoundryがHugging FaceのオープンソースモデルをマネージドGPU環境でワンストップデプロイ可能にした点は、エンタープライズAIの導入障壁を大きく下げる。特にGPUトポロジーの自動管理やセキュリティパッチの自動適用により、運用コストが削減され、AIモデルの商用利用が加速する可能性がある。MicrosoftとHugging Faceのエコシステム連携が強固になることで、競合するAWS SageMakerやGoogle Vertex AIに対する差別化要因となり、MicrosoftのクラウドAI事業の成長ドライバーになり得る。