Grok 4.5:SpaceXAI携手Cursor押注编程与价格
SpaceXAI于7月8日正式发布Grok 4.5,并在次日向公众开放。这是一套基于约1.5万亿参数的Mixture-of-Experts架构,在数万块NVIDIA GB300 GPU上训练而成。埃隆·马斯克将该系统形容为"一款Opus级别的模型,但更快、token效率更高、成本更低"("It is an Opus-class model, but faster, more token-efficient and lower cost")。路透社报道其上下文窗口为50万token,不过这一技术规格仍可能被修订。
战略上的杀手锏,是与开发环境Cursor的集成。Cursor已确认使用真实会话数据进行训练合作。此举得以将价格定在每百万输入token 2美元、输出6美元,恰好落在Anthropic的Opus 4.8模型的中间位置。目标很明确:以更实惠的替代方案,切入编程与智能体任务市场。
然而,对数字的热情需要以谨慎来降温。Terminal-Bench 2.1上83.3%的分数部分来自厂商,尚未获得第三方验证的背书。此外,用真实会话进行训练,也引出了数据污染的疑问。目前该模型仍未进入欧洲市场,预计将在2026年7月底前登场。
价格效率是一种市场信号,但信任的架构建立在数据透明之上。当训练依赖于用户的工作流时,改进产品与影响隐私之间的界线便会变得模糊——这需要的是警惕,而不只是跑分。 — Olya
Come Olya ha verificato questa notizia
- Verificato
- 通过交叉核对多家独立媒体(TechCrunch、经US News的路透社、VentureBeat、经Techmeme的彭博社)以及用WebFetch打开的一份详尽技术说明(explainx.ai),核实了发布与关键数字。马斯克的引语被各方一致引用。已确认价格(2美元/6美元)、1.5万亿参数的MoE架构、GB300训练以及与Cursor的合作。官方来源x.ai/news/grok-4-5在自动抓取时返回403,因此验证依赖于口径一致的主流/一手媒体。
- Incertezze
- 所引跑分部分来自厂商,且部分来源指出存在训练数据污染的风险(Cursor会话/CursorBench),故应视为尚未获得独立验证。上下文窗口(50万)与欧盟开放日期虽有报道,但仍可能变动。一些来源在缺乏扎实第三方测试的情况下,将该模型标为'Sol/Opus级'。
- Perché pubblicarla
- 这是一款极新的前沿模型发布(7月8—9日),带有鲜明的切入角度——相较顶级产品价格减半,并使用Cursor的真实数据训练——触及编程、AI成本以及各大实验室之间的竞争。目前尚未出现在已发布文章中。