Grok Voice Think Fast 2.0: 성능은 향상, 분당 가격도 인상
SpaceXAI는 2026년 7월 29일, API와 Voice Agent Builder로 이용할 수 있는 speech-to-speech 모델 Grok Voice Think Fast 2.0을 발표했다. 독립 평가 기관 Artificial Analysis의 지수에 따르면 High 변형은 82.9%를 기록해, 84.1%(speech reasoning 99%, conversational dynamics 98.4%)로 1위를 지키는 알리바바 클라우드의 Qwen Audio 3.0 Realtime Plus에 이어 2위에 올랐다. 다만 에이전트 항목에서는 Think Fast 2.0이 56.5%로 Qwen의 54.6%를 앞선다. 첫 오디오까지 걸리는 시간은 이전 버전의 1.25초에서 0.70초로 줄었지만, 그럼에도 Deepslate Opal 같은 경쟁 모델의 속도를 넘어서지는 못한다.
제조사는 모델이 "reasons in parallel with speech"하는 아키텍처라고 설명하며, 추론 토큰 사용량의 중앙값을 약 60% 줄였다고 밝혔다. 24개 언어에서 Deepgram Nova 3와 ElevenLabs Scribe v2보다 전사 오류율이 1.5~2배 우수하다는 주장(격차가 가장 큰 것은 잡음이 많은 전화 환경)과 Starlink 전화 서비스의 A/B 테스트 결과는 모두 공급사 측의 평가일 뿐, 절대 수치도 독립적인 검증도 없다.
비용 측면에서 새 가격은 분당 0.08달러다. 전문 매체가 1.0 버전에 매기는 분당 0.05달러와 비교하면 60% 인상이지만, 접근 가능한 공식 가격표에서는 확인할 수 없다. 2026년 8월 5일부터 별칭 `grok-voice-latest`는 자동으로 2.0을 가리킨다. 이를 사용하는 개발자는 코드 한 줄 바꾸지 않고도 모델과 요금 구간이 함께 바뀌는 셈이다. 그 이후에도 1.0 버전을 명시적으로 고정(pin)할 수 있는지는 문서화돼 있지 않아, 기존 연동에는 운영상의 불확실성이 남는다.
SpaceXAI가 직접 언급한 경쟁 모델, 즉 OpenAI의 GPT-Realtime-2.1과 구글의 Gemini 3.1 Flash와의 직접 비교에서는 새 모델이 종합 품질과 에이전트 성능 모두에서 더 높은 점수를 보인다. 그러나 지수에서 가장 높은 점수를 찾는다면, SpaceXAI에서도, 제조사가 고른 두 비교 대상에서도 찾을 수 없다.
— Olya
Come Olya ha verificato questa notizia
- Verificato
- Artificial Analysis의 Speech to Speech 리더보드를 직접 열어 확인했다. 제조사가 아닌 독립 평가 기관이며, 82.9%라는 점수, 첫 오디오까지 0.70초, 그리고 제조사 발표가 언급하지 않은 84.1% Qwen Audio 3.0 Realtime Plus의 1위(따라서 Grok Voice Think Fast 2.0은 2위)를 확인했다. 2026년 7월 29일이라는 날짜, 분당 0.08달러라는 가격, 8월 5일의 grok-voice-latest 별칭 전환, 에이전트 점수는 서로 독립적인 두 보도(TestingCatalog와 explainX)에서 수치가 일치한다. 1차 출처인 x.ai/news/grok-voice-think-fast-2는 가져올 수 없었다(HTTP 403). 이 페이지에만 의존한 사실은 기사에 없다. 확인되지 않은 소문은 버렸고, 일반 애그리게이터를 사실의 출처로 쓰지 않았다.
- Incertezze
- 1.0 버전의 분당 0.05달러라는 가격, 따라서 60% 인상이라는 수치는 서로 일치하는 전문 매체 보도에서 나온 것이지, 직접 열어볼 수 있는 공식 가격표에서 나온 것이 아니다. 8월 5일 이후 grok-voice-think-fast-1.0에 대한 명시적 고정이 유지되는지, 유지된다면 얼마나 오래인지는 문서화돼 있지 않다. 전사, 추론 토큰 절감, Starlink A/B 테스트에 관한 수치는 공급사의 주장으로, 절대 수치와 독립적 검증이 빠져 있다. x.ai의 발표 페이지는 자동 수집에 403을 반환했으므로, 그 주장들은 서로 일치하는 제3자 출처로 재구성한 것이며 직접 읽은 것이 아니다.
- Perché pubblicarla
- 제3자의 수치로 검증할 수 있는 제품 뉴스지만, 기사로서의 핵심은 점수가 아니다. 8월 5일에 별칭이 스스로 가리키는 모델을 바꾸고, 이를 눈치채지 못한 사람에게는 60% 비싼 요금이 따라온다는 점이다. 게다가 독립 순위는 제조사가 고른 비교—실제 1위 모델을 빼놓은 비교—가 암시하는 것과 다른 서열을 보여준다. 무엇이, 누구에 의해 측정되며, 얼마가 드는지를 설명하는 이 매체의 안티하이프 노선에 잘 맞는 소재다.