1.grimes马斯克

马斯克的Grok 5偷偷藏不住了刚刚ARC-AGI榜单官宣出现新SOTA,用的还是Grok 4 程序合成技术微调好小汁,啥时候开始Grok都弯道超车了?OpenAI、Anthropic、谷歌一众明星模型都被压一头。

马斯克开始疯狂剧透Grok 5了(插图

2.马斯克gme

一石激起千层浪,网友纷纷发问,那等Grok5出来,岂不是……

马斯克开始疯狂剧透Grok 5了(插图1

3.doge 马斯克

马斯克也随即出来回应:我现在认为Grok 5能达到AGI。

马斯克开始疯狂剧透Grok 5了(插图2

4.马斯克 floki

顺便附赠了一堆有关Grok 5的爆料马斯克疯狂剧透Grok 5这事还得从Grok 4超越预期的表现说起,发布才两个月就登上多个榜单第一的宝座,而就在刚刚,ARC Prize发布了两个最新的ARC-AGI。

5.frodo 马斯克

榜单SOTA方案:都是开源的。都使用的是Grok 4作为基础模型。都实现了带测试自适应的程序合成外循环。

马斯克开始疯狂剧透Grok 5了(插图3

6.马斯克rococo

先简单介绍一下ARC-AGI排行榜,其旨在评估AI解决复杂难题的能力,类似于人类的智力测试,从而反映LLM的推理能力测试任务包含v1和v2版本,v2需要LLM完成更多的多步骤推理,一般来说,即使是最优秀的LLM也只能在v2中获得。

7.马斯克dojo

16%的准确率。

马斯克开始疯狂剧透Grok 5了(插图4

8.马斯克 kishu

GPT-5在二者上的得分依次是65.7%和9.9%,Claude Opus 4的得分是35.7%和8.6%,而Grok 4则是66.7%和16%Jeremy Berman的新方案则是在Grok 4基础上,用。

9.马斯克 l2

英语替代了传统的Python,最终得分来到79.6%和29.44%Eric Pang则在Jeremy的工作上,设计了一个受DreamCoder启发、LLM辅助的程序合成系统,能够通过从不断扩展的程序库中学习来解决越来越难的任务。

马斯克开始疯狂剧透Grok 5了(插图5

10.马斯克madog

虽然得分没有进一步升高(77.1%和26%),但是成功让每个任务的平均费用得以下降(v1:8.42美元→2.56美元;v2:30.4美元→3.97美元)当问及两位作者选择Grok 4的理由,他们均表示,这是他们测试下来效果最好的模型。

当中所体现出的AGI潜力,也让马斯克感到自豪,随即透露了一系列有关Grok 5的消息。老马表示,这才只是Grok 4,而Grok 5将很有可能达成AGI。

马斯克开始疯狂剧透Grok 5了(插图6

而这个可能性也许能达到10%或者更高,要知道他此前并不认为Grok版本会出现AGI。

马斯克开始疯狂剧透Grok 5了(插图7

与此同时,他表示Grok 5将会在几周之内开始训练。

马斯克开始疯狂剧透Grok 5了(插图8

加上此前他曾表示Grok 5将在今年年底前推出,或许我们将在不久后见证新的“LLM怪物”诞生所以为什么老马能对Grok 5抱以如此强烈的信心呢?训练数据及硬件资源的投入归根结底,是马斯克在Grok训练中投入之深。

据悉,Grok 5将拥有较之前代更多的训练数据。Grok 4的训练量是Grok 2的100倍、Grok 3的10倍,而Grok 5则只会更多。

马斯克开始疯狂剧透Grok 5了(插图9

马斯克拥有一整套的最新真实数据收集体系,其中xAI可以为其提供最新的直接数据,特斯拉可以定期利用FSD和摄像头捕获图像从而生成数据,而擎天柱机器人也能从现实世界中生成大量数据可以说,马斯克在当下数据为王的时代,最不缺的就是数据。

此外,xAI在硬件资源上也投入颇多,目标在5年内完成相当于5000万台H100 GPU同等算力的部署其专门为Grok系列打造的超级计算集群Colossus,已经部署了约23万张GPU其中包括3万张NVIDIA GB200(基于Nvidia的Blackwell架构),将会持续为Grok提供强大的算力支持。

马斯克开始疯狂剧透Grok 5了(插图10

不过Grok 5究竟能否真正实现AGI,网友们对此也提出了质疑:毕竟要成为AGI靠的可不仅仅是数据和马斯克的声明,一切还得看成品。

马斯克开始疯狂剧透Grok 5了(插图11

所以究竟谁才是能吃到第一只AGI螃蟹的AI公司,且让我们拭目以待。

声明:本站所有文章,如无特殊说明或标注,均为本站原创发布。任何个人或组织,在未征得本站同意时,禁止复制、盗用、采集、发布本站内容到任何网站、书籍等各类媒体平台。如若本站内容侵犯了原著者的合法权益,可联系我们进行处理。