A.I.AI
SpaceXAIのGrok 4.6、人工分析知能指数で61点を獲得、GPT-5.6 Solと同等レベルに
SpaceXAI's Grok 4.6 Scores 61 on the Artificial Analysis Intelligence Index
YHacker News
AIが原文を翻訳・要約しています
SpaceXAIのGrok 4.6が人工分析知能指数で61点を獲得し、GPT-5.6 Solと同等のフロンティアに位置づけられた。これは、1ヶ月強でGrok 4.5から5点、Grok 4.3からは23点の上昇である。エージェント性能では、GDPval-AA v2 Eloで1753点を記録し、Claude Opus 5に次ぐ位置にいる。τ3-Bankingでは50.7%、Terminal-Bench v2.1では88.4%のスコアを示した。コスト面では、1Mトークンあたり入力$2/出力$6で、Claude Opus 5やGPT-5.6 Solと比較して大幅に安価である。長期間にわたる知識作業タスク(AA-Briefcase)では、Claude Opus 5ファミリーには及ばないものの、約53ターン、約0.5Bトークンでタスクを完了し、Claude Opus 5の約半分のターン数と4分の1のトークン数で同等の回答に到達する効率性を示している。コンテキストウィンドウは50万トークンで変更はない。
KEY POINTS要点記事から抽出した重要情報
- Grok 4.6が人工分析知能指数で61点を獲得し、GPT-5.6 Solと同等のフロンティア水準に到達した。1ヶ月強でGrok 4.5から5点、Grok 4.3からは23点の大幅な性能向上を記録。
- エージェント性能ではGDPval-AA v2 Eloで1753点を記録し、Claude Opus 5に次ぐ位置。τ3-Bankingでは50.7%、Terminal-Bench v2.1では88.4%のスコアを達成。
- コスト面では1Mトークンあたり入力$2/出力$6で、Claude Opus 5やGPT-5.6 Solと比較して大幅に安価な価格設定となっている。
- 長期間の知識作業タスク(AA-Briefcase)でClaude Opus 5の約半分のターン数と4分の1のトークン数で同等の回答に到達する効率性を示した。
CONTEXT文脈編集部による背景整理
Grok 4.6は人工分析知能指数で61点を獲得し、GPT-5.6 Solと同等のフロンティア水準に到達。特にコスト競争力(1Mトークンあたり入力$2/出力$6)がClaude Opus 5やGPT-5.6 Solと比較して大幅に低く、推論効率(少ないターン数・トークン数で同等の回答)も示しており、AIモデル市場における価格競争と効率性競争の激化を示す重要な指標となる。
原文を読むAnalyzed at 2026年8月13日 03:01