xAI / SpaceX 基盤モデル(LLM)

xAI、Grok 4.7 をリリース——コーディング性能は向上も、トップモデルとの差は残る

xAI、Grok 4.7 をリリース——コーディング性能は向上も、トップモデルとの差は残る
文字サイズ

イーロン・マスク氏率いる xAI は 2026 年 9 月 21 日、最新の AI モデル「 Grok 4.7 」を正式に公開しました。コーディング支援や調査・分析といった知的作業を得意とするモデルとして位置づけられており、約 40 日前にリリースされた前世代から大幅に強化されたトレーニングを経ています。

モデルの規模としては、パラメータ数が 2.1 兆と前世代の Grok 4.6( 1.5 兆)から約 40 % 増加しています。一度に処理できるテキスト量も 50 万トークンと大幅に拡大しており、長文ドキュメントや複雑なタスクへの対応力が高まっています。学習データの知識カットオフは 2026 年 5 月で、前世代より 3 ヶ月分新しい情報をカバーしています。

第三者評価機関である Artificial Analysis の総合スコアでは 46 点を記録し、前世代の 44 点から 2 点改善しました。ただし、現時点で首位を走る Claude Fable 5.1 と GPT-6 はいずれも 53 点であり、トップとの開きはまだ 7 点あります。一方、コーディング専門の評価では自社ツール Grok Build との組み合わせで 56 点(前世代比 +9 点)を達成し、全体 5 位に浮上しました。複数のステップにわたる長期的な調査・分析タスクでも、トップクラスのモデルと肩を並べる水準に到達しています。

気になる点としては、処理に際して消費するリソースの多さが挙げられます。最高設定での出力量は前世代の約 2 倍、競合の GPT-6 Astra と比較すると約 3 倍に達しており、処理時間もタスクあたり平均約 7 分かかります。ただし、 AI が誤った情報を生成してしまう「ハルシネーション(幻覚)」の発生率は 34 % から 29 % へと改善されており、信頼性は着実に向上しています。

価格面では競争力のある設定となっており、入力 100 万トークンあたり $2(約 300 円)、出力 100 万トークンあたり $6(約 900 円)です。 Claude Fable 5.1 の入力価格 $10(約 1,500 円)と比べると 5 分の 1 以下に抑えられており、コスト重視の用途では有力な選択肢になりえます。リリース当日には GitHub Copilot へのサポートも開始され、全プランで順次利用できるようになる予定です。

業界関係者の間では、今回のリリースは単なる性能向上にとどまらず、低価格と幅広いツール連携( Cursor 、 Grok Build 、 GitHub Copilot など)によって開発現場への普及を狙った戦略的な動きと見られています。マスク氏は Grok 4.8 、 Grok 4.9 、さらに Grok 5 のリリースも予告しており、開発ペースを早めてトップの座を目指しています。