Elon Musk 氏は 7 月 18 日、Moonshot AI が最近リリースした Kim K3 に対応して、xAI の次期 2 兆パラメータ言語モデルである Grok 4.6 が来週初期トレーニングの実行を完了すると発表しました。 Musk 氏は、Grok 4.6 は、1.5 兆パラメータの基礎モデルに基づいた前世代の Grok 4.5 よりも優れていると主張しました。同氏は、新しいモデルは Grok 4.5 と同様の生成速度とトークン効率を維持しながら、Kimi K3 のパフォーマンスを超える可能性があると述べました。
Moonshot AI は 7 月 16 日に、2 兆 8,000 億のパラメーターを誇る Kimi K3 を発表しました。これは、これまでにリリースされた最大のオープンウェイト AI モデルです。キミ K3 の発売は、上海で開催される世界人工知能会議に先立って戦略的に計画され、モデルの全重量は 7 月 27 日に一般公開される予定です。
Artificial Analysis が実施したテストによると、インテリジェンス ベンチマークのスコアは、Grok 4.5 の 54 スコアと比較して、Kimi K3 のスコアは 57 でしたが、Grok 4.5 のタスクあたりのコストは約 0.31 ドルと大幅に低く、Kimi K3 の 0.94 ドルの約 3 分の 1 でした。 Musk 氏は、コスト上の利点を維持しながら、Grok 4.5 と Kim K3 の間のパフォーマンスの差を縮めることを目指しています。
BBC によると、独立した評価でも、Kimi K3 が米国の主要モデルと同等の性能を発揮し、Web インターフェイス エンジニアリングにおいて優れていることが確認されています。 Business Insider は、Moonshot AI の Kim K3 用 API の価格が、競合他社である OpenAI や Anthropic よりも安いと報じました。
6月28日に発表されたxAIのGrok 4.5は現在、SpaceXとTeslaで非公開ベータテスト中であり、Claude Opusに近いかそれを上回るパフォーマンスを示していると伝えられている。さらに、xAI は、Grok 5 とラベル付けされた 6 兆および 10 兆のパラメーター バージョンを含む、さらに大規模なモデルを開発中です。これらは、4 月の時点で複数のモデルがトレーニングされていた Colossus 2 スーパークラスターでトレーニングされています。
さらに、xAI は 5 月に発売された Grok Build コーディング エージェントの開発を進めています。このエージェントは端末から操作し、並列サブエージェントを通じてタスクを委任します。7 月 13 日にバージョン 0.2.101 に達し、月額 300 ドルの SuperGrok Heavy 層の加入者向けのベータ版のままです。








