SpaceXAI、Grok 4.6を発表:Kimi K3を上回り、GPT-5.6 Solと並ぶ世界第3位の性能
SpaceXAI debuts Grok 4.6, overtaking Kimi K3's performance and matching GPT-5.6 Sol for world's third best on Artificial Analysis
SpaceXAIは最新AIモデル「Grok 4.6」を発表しました。このモデルは、長時間のタスク、コーディング、知識作業に特化しており、価格戦略もワークロードのコスト削減を目指しています。第三者機関「Artificial Analysis」のインデックスでは61点を記録し、Kimi K3を上回り、OpenAIのGPT-5.6 Sol Maxと同点となりました。AnthropicのClaude Opus 5とFable 5がそれぞれ1位、2位を占めています。Grok 4.6は、コーディング、ターミナル操作、知識作業、エージェントのベンチマークで前モデルから大幅に性能を向上させました。API価格は入力100万トークンあたり2ドル、出力100万トークンあたり6ドルからとなっています。Grok 4.6は、Grok Build、Cursor、OpenRouter、Vercel、Cloudflareなどを通じて利用可能です。前モデルGrok 4.5のリリースから数週間、またAIエージェントにタスクを割り当てる新システム「Grok Bot」のローンチ翌日に発表されました。Grok 4.6は、より長い作業シーケンスにわたってタスクに集中できるように設計されており、テストでは自己検証能力やインタラクティブ/ビジュアルプロジェクトでの初試行成功率が向上したと報告されています。Artificial Analysisによると、Grok 4.6のEloスコアは1,753で、GPT-5.6 Sol Max(1,728)やFable 5 Max(1,741)を上回る場面もありますが、一部のベンチマークでは競合モデルにリードを許しています。コスト面では、タスクあたりのコストが0.84ドルと、前モデルや他のモデルと比較して必ずしも安価ではありません。しかし、標準的なAPI価格は競合モデルと比較して60%以上安価であるとされています。Grokブランドは、過去に安全性の問題や論争(過激主義的、反ユダヤ主義的、性的なコンテンツ生成など)を引き起こしており、これが企業導入の障壁となる可能性があります。SpaceXAIは、Grok 4.6自体が過去の特定の問題を繰り返していないことを強調していますが、ベンダーの評判やガバナンスも調達の考慮事項となります。Grok 4.6は、API仕様でテキストと画像入力をサポートし、関数呼び出し、構造化出力、推論機能を備えています。APIは毎秒150リクエスト、毎分5000万トークンのレート制限があり、us-east-1およびus-west-2で利用可能です。Grok 4.6は、性能だけでなく、開発者が既存のワークフローに統合しやすいか、また論争のあるブランドとの関連性も考慮されるでしょう。
- SpaceXAIがAIモデル「Grok 4.6」を発表。Artificial Analysisインデックスで61点を記録し、Kimi K3を上回りGPT-5.6 Sol Maxと同点の世界第3位に
- Grok 4.6のAPI価格は入力100万トークンあたり2ドル、出力100万トークンあたり6ドルからで、競合モデルと比較して60%以上安価
- Grok 4.6はコーディング、ターミナル操作、知識作業、エージェントのベンチマークで前モデルのGrok 4.5から大幅に性能向上
- Grok 4.6のEloスコアは1,753であり、GPT-5.6 Sol Max(1,728)やFable 5 Max(1,741)を上回る
- Grok 4.6はGrok Build、Cursor、OpenRouter、Vercel、Cloudflareなどを通じて利用可能
SpaceXAIがGrok 4.6を発表し、第三者評価機関Artificial Analysisのインデックスで61点を記録、GPT-5.6 Sol Maxと同点の世界第3位に浮上した点は、AIモデル競争の構図が急速に変化していることを示している。API価格が競合より60%以上安価である点、および数週間前のGrok 4.5から短期間で大幅な性能向上を果たしたスピード感は注目に値する。一方で、過去のGrokブランドが抱える安全性・コンテンツ問題は企業導入障壁となり得るため、法人向けでの普及ペースと、それに伴う収益化の進展を注視すべき。