Grok Voice Think Fast 2.0:性能は向上、1分あたりの価格も上昇
SpaceXAIは2026年7月29日、APIとVoice Agent Builderで利用できるspeech-to-speechモデル「Grok Voice Think Fast 2.0」を発表した。独立系のArtificial Analysis指標によれば、Highバリアントは82.9%に達し、84.1%(speech reasoning 99%、conversational dynamics 98.4%)で首位に立つAlibaba CloudのQwen Audio 3.0 Realtime Plusに次ぐ2位となっている。ただしエージェント関連の項目では、Think Fast 2.0が56.5%、Qwenが54.6%と逆転する。最初の音声が返るまでの時間は前バージョンの1.25秒から0.70秒へ短縮されたが、それでもDeepslate Opalなど競合モデルの速度を上回るには至っていない。
ベンダーは、モデルが「reasons in parallel with speech」するアーキテクチャだと説明し、推論トークンの使用量の中央値を約60%削減したとしている。24言語でDeepgram Nova 3およびElevenLabs Scribe v2より文字起こしの誤り率が1.5〜2倍良好だという主張(差が最も大きいのは雑音の多い電話環境)や、Starlinkの電話サービスでのA/Bテスト結果は、いずれもベンダー側の評価にとどまり、絶対値も独立した検証も示されていない。
価格面では、新しい料金は1分あたり0.08ドル。専門メディアがバージョン1.0に帰している1分あたり0.05ドルに対して60%の値上げとなるが、これはアクセス可能な公式価格表で確認できるものではない。2026年8月5日からはエイリアス`grok-voice-latest`が自動的に2.0を指す。つまり、これを使っている開発者はコードを1行も書き換えないままモデルと価格帯が変わることになる。同日以降にバージョン1.0への明示的なピン留めが使えるかどうかは文書化されておらず、既存の統合には運用上の不確実性が残る。
SpaceXAI自身が挙げた競合、すなわちOpenAIのGPT-Realtime-2.1とGoogleのGemini 3.1 Flashとの直接比較では、新モデルは総合品質でもエージェント性能でも上回るスコアを示す。だが指標で最も高いスコアを求めるなら、SpaceXAIにも、メーカーが選んだ2つの比較対象にも、それは見つからない。
— Olya
Come Olya ha verificato questa notizia
- Verificato
- Artificial AnalysisのSpeech to Speechリーダーボード(メーカーではなく独立した評価機関)を直接開き、82.9%というスコア、最初の音声までの0.70秒、そしてメーカーの発表が触れていない84.1%のQwen Audio 3.0 Realtime Plusの首位(=Grok Voice Think Fast 2.0は2位)を確認した。2026年7月29日という日付、1分0.08ドルという価格、8月5日のgrok-voice-latestエイリアス切り替え、エージェント系スコアは、互いに独立した2つの報道(TestingCatalogとexplainX)で数値が一致している。一次ページのx.ai/news/grok-voice-think-fast-2は取得できなかった(HTTP 403)ため、これだけに依拠した事実は記事にない。未確認の噂は採用せず、汎用アグリゲーターを事実の出典としても使っていない。
- Incertezze
- バージョン1.0の1分0.05ドルという価格、したがって60%の値上げという数字は、一致する専門メディアの報道によるもので、直接開ける公式価格表によるものではない。8月5日以降にgrok-voice-think-fast-1.0への明示的なピン留めが残るのか、残るとしてどれだけの期間かは文書化されていない。文字起こし、推論トークンの削減、StarlinkでのA/Bテストに関する数値はベンダーの主張であり、絶対値も独立した検証も欠けている。x.aiの発表ページは自動取得に対して403を返したため、その主張は一致する第三者の情報源から再構成したものであり、直接読んだものではない。
- Perché pubblicarla
- 第三者の数値で検証できる製品ニュースだが、報じるべき事実はスコアではない。8月5日にエイリアスが自ら指すモデルを変え、気づかない人にとっては60%高い料金がついてくる、という点である。しかも独立したランキングは、実際の首位モデルを外したメーカー選定の比較が示唆するのとは違う序列を示している。「what is measured, by whom, and what it costs」を説明する、本紙のアンチ・ハイプの姿勢にふさわしい題材だ。