在经历两个月淡出主流模型竞争之后, 马斯克的Grok模型又重回牌桌了, 然而此次马斯克并非再与前沿模型较量参数, 而是着重主打实用, 并宣传性价比。
在北京时间7月9号的这一天, SpaceXAI发布了最新的旗舰模型Grok 4.5, 博客里面提到, 此为SpaceXAI当下这一时刻最具智能的模型, 是为了编程、智能体任务以及知识工作去打造出来的, 并且同时兼具着较好的速度, 还有成本效率。
和以往每一家人工智能公司皆想要声称自身具备最强模型不一样, 马斯克这次表现得颇为务实。
模型发布以后, 他接连发布了几十条动态去推广Grok 4.5, 并且经常给网友讨论进行回复。当中, 有一位网友引用测试表明, Grok 4.5仅仅使用了大概十七分之一的成本, 达成了接近Claude Fable的性能。
马斯克直截了当地说到了性能方面存在的差距, “实事求是来讲, Fable的确是要比Grok 4.5出色相当多, 然而大部分的任务并不需要Fable那般程度的能力。”。

马斯克宣称, 存在内部评估, 其内容为, Grok 4.5大体上等同于Claude的Opus 4.7, 不过速度要快出许多。“能力、更为快速的速度以及更低的成本这三者相互结合,此为其具备竞争力的关键所在。我们所留意的是现实世界的实用性闭环世界杯直播平台, 而非基准测试。”他觉得, 特斯拉与SpaceX的硬核工程师们发现Grok 4.5确实具有实际用途, 而这才是真正有着重要意义的。
这次SpaceXAI, 从宣传方面来讲, 更期望能够证明的是在跟前沿模型能力相近的情形下, Grok 4.5能够借助更少的Token(词元)用来完成同样的任务, 而且能够拥有更快的推理速度。
在具体模型效率这块儿, 博客里提及, Grok 4.5运行在高速模型级别, 有着每秒生成80个Token数的速度。跟当下领先的同类模型相比较, 它的Token效率提升了起码一倍。在对编程的SWE Bench Pro任务展开考察时, Grok 4.5平均只要1.6万个输出Token就能把任务解决掉, 相较于Opus 4.8 (max)的6.7万个输出量, 减少了大概四分之三。
关于模型成本这一方面, Grok 4.5同样推行的是低成本的路线, 其定价表现在对于每百万输入Token收取2美元, 以及对于每百万输出Token收取6美元。
数据由AI基准测试机构Artificial Analysis显示, Grok 4.5在GDPval - AA v2这个考察真实职场知识工作场景的测试中排位第4, 其整体分数是1543, 仅仅比Anthropic最新的Claude版本落后, 然而它进入了性能与成本的帕累托前沿。处于现实世界里的代理知识工作任务那儿, Grok 4.5 每一项 GDPval 任务仅仅耗费 0.49 美元的成本, 这样的成本比国内的智谱 GLM−5.2 低, 且比 Kimi K2.6 也低。
在Grok Build里, Grok 4.5的每一项任务所产生的成本大概是2.5美元, Claude Code中的Fable 5成本接近12美元, Codex中的GPT - 5.5成本约为5美元。
若讲过去两年行业最为关注的是测试排名, 那么自今年以来, 因模型加速落地, 新的评价体系正受到越来越多企业的关注, 此评价体系就是完成一个真实任务到底需要花费多少成本, 也就是每任务成本(Cost per Task)。
在Grok 4.5方面, 有一位开发者做出评价, 一个情况是, 在任务完成这件事上, 成本成为了, 在部署进程里, 唯一有着重要意义的基准数字。另外一种情况是, 对于那种能够以很低成本, 达成前沿能力其中95%状况的模型, 它会对高容量工作的计算逻辑起到改变作用, 与此同时带来影响的起因在于, 大多数企业所开展的任务, 一直都未曾涉及到难度前沿的范畴。还有一种状况是, 关乎着工作负载而言, 实际所需要适配的,是帕累托曲线当中的哪一个梯级级别开云手机入口app下载开云app官方入口网站, 这比谁能够顺利在排行榜上面占据前列位置, 显得更为重要。
Grok 4.5此次推出, 除了具备成本优势外, 还有另一层意义,它是SpaceXAI整合Cursor之后的首个产品。
今年6月开云真人app官网入口, SpaceX宣告以600亿美元全股票交易的方式去收购Cursor。马斯克先前承认, 其AI业务于编程领域存有差距, 还为此促成了一列人员调整。这回与Cursor的合作, 是SpaceXAI补齐短板的关键一步。
Cursor透露了, 在Grok 4.5的训练过程当中, Cursor真实的开发数据被引入了, 这些数据的数量为数万亿Token, 不仅覆盖了大量的代码库, 而且记录了开发者修改代码的方式, 记录了开发者调用工具的方式, 还记录了开发者与AI智能体协同工作的方式, 从而使得模型能够学习真实的软件开发流程, 而并非仅仅是代码本身, 是这样的情况。
与此同时, Grok 4.5在数量达数万块的英伟达GB300 GPU之上完成了训练, 并且进一步增大强化学习训练的规模, 针对多步骤软件工程、智能体执行等方面几十个真实任务开展持续优化。Grok 4.5对重点的放置也开始在真实办公场景方面, 其中包含Excel、PowerPoint的制作, Word文档的处理情况以及复杂软件工程。
这表明, 与之前倾向于聊天机器人的定位相比较而言, Grok 4.5正朝着企业生产力工具迈进并且不断深入、持续发展了 , 是进一步地行进呢。
在推出这一模型以前, Grok系列模型差不多快要从主流大模型激烈的竞争当中逐渐退出了。
5月发布的Grok 4.3, 在Artificial Analysis的智能排行榜的呈现中, 只是并列处于位列第17名的位置, 和OpenAI、Anthropic等那些头部模型相比, 已然清晰地出现了距离的拉开。
与这个时候同步, Grok大模型的研发团队同样经受了为数众多的动荡不安。在2025年2月开始一直到2026年3月的这段期间, 好多xAI核心成员一个接着一个向外离开, 直至今年3月底的时候创始团队全体人员都变为零。5月7日, 马斯克面向外部宣称xAI将会被解除进行的安排, 在这之后的时候, Grok将会融入到SpaceX里变成子产品SpaceXAI。
Grok 4.5是模型团队重建后所推出的首个产品, 其宛如马斯克AI业务的一次再度启程, SpaceX得向投资者讲述更多有关AI的故事。至于这一模型能不能切实撼动当下模型市场的格局, 仍有待开发者以及企业作进一步的验证。
标签: Grok4.5 马斯克 AI模型 低成本 企业生产力工具
还木有评论哦,快来抢沙发吧~