xAIは9月20日、コスト効率に特化した推論モデル「Grok 4 Fast」を発表した。同社は、大規模強化学習により知能密度を最大化したと説明し、ベンチマーク上でGrok 4と同等の性能を平均40%少ない思考トークンで達成したと述べている。トークン単価の低下と合わせ、同一性能達成コストは98%削減されるとしている。
独立レビュー機関Artificial Analysisの検証により、同モデルは公開モデル中でSOTAの価格対知能比を示したと発表されている。また、200万トークンコンテキストウィンドウ、推論と非推論モードを統合したアーキテクチャ、ツール使用強化学習によるエージェント的検索能力を備えているとされている。
出典: Grok 4 Fast(HN 96pt・76コメント)(HN Search (backfill))