2026-09-28 02:23:29
7月9日消息,吹牛马斯克创办了xAI是又次夜庆想跟OpenAI、Anthropic掰手腕,兑现k大登顶无奈之前发布的马斯模型Grok大模型一直达不到顶级水平,今天发布的克半Grok 4.5总算给马斯克挣回了面子,在编程领域甚至能做到第一。编程
美国时间还是吹牛深更半夜,马斯克就开始在X上转推有关Grok 4.5的又次夜庆消息了,RequestyAI也评测了多个大模型的兑现k大登顶代码测试能力,结果Grok 4.5以88分的马斯模型成绩位列第一,也是克半有史以来的最高分。
马斯克也迫不及待地转发了这个帖子,编程表示Grok 4.5 在至少几个基准测试中排名第1,吹牛比预期好。又次夜庆
对于Grok 4.5来说,兑现k大登顶论性能应该还是超不过Fable 5这种级别的大模型的,马斯克自己也承认,但他也提到了一个很有说服力的说法,那就是大部分任务也用不到Fable 5这样的大模型。
事实也是如此,就算Fable 5性能最出众,但它的定位和价格就注定了大部分开发者没法畅快使用,除了个别任务需要用到Fable 5之外,大部分任务有Opus级别大模型的能力都是超预期了。
如果是看OpenRoutor的调用量,大众需要的大模型,哪怕是开发者需要的代码能力也没那么高,DeepSeek V4 Flash这种用量才是最高的。
当然,大模型的顶级性能还是各大公司竞争的制高点,目前还是OpenAI和Anthropic领先一步,谷歌Gemini 3.5 Pro不能爆发一波的话,御三家的位置要被马斯克的Grok取代了。
国内这边智谱GLM-5.2在AI编程上领先,但DeepSeek V4正式版预计会追上来,后面还有月之暗面的Kimi K3和稀宇科技的MiniMax M3 Pro,参数量和能力都会再上一个台阶,追赶Opus级别的性能还是可以期待一下的。
2026-09-28 02:06
2026-09-28 01:56
2026-09-28 01:39
2026-09-28 01:35
她长得太漂亮从护士转行做演员,离婚11年未再嫁,如今46岁风韵犹存
2026-09-28 01:22
2026-09-28 01:16
2026-09-28 01:12
2026-09-28 01:07
英国4740万次年检数据证实:电动车越开越抗造 老电车故障率比油车低一半
2026-09-28 01:02
2026-09-28 00:47
2026-09-28 00:33
2026-09-28 00:28
“让企退人员闭嘴”翻车!千万人的民生事,凭什么不让人表达观点
2026-09-28 00:07
2026-09-28 00:04
2026-09-27 23:47
2026-09-27 23:45