GPT-6 Astra:太优秀了
OpenAI刚刚发布了GPT-6 Astra。根据官方信息和早期测试者的反馈,这个模型只有一个大问题:它太优秀了。
梯形图转SCL | 博途AI辅助编程文档 | AI模型价格对比 | AI工具导航 | ONNX模型库 | Vibe Coding教程 | PLC在线仿真器 | Tripo 3D | Meshy AI | ElevenLabs | KlingAI | ArtSpace | Phot.AI | InVideo
OpenAI刚刚发布了GPT-6 Astra。根据官方信息和早期测试者的反馈,这个模型只有一个大问题:它太优秀了。
我不是开玩笑。如果你看看发布文章,你会得出这样的结论:1) OpenAI在基准测试套件中击败了Anthropic新发布的Fable 5.1,在某些情况下有效地饱和了人们仍然视为有意义前沿的测试,如FrontierMath和ARC-AGI 3(版本4要到2027年第一季度才会发布);2) 它对Anthropic的IPO叙事造成了严重打击,可能会吓跑股东。此外,3) OpenAI总裁Greg Brockman称赞它为"通用人工智能新时代的入口",实际上是在说Astra = AGI,因此,4) 人们也有了同样复杂的反应,比如"这太疯狂了"、"我们完蛋了"和"搞什么鬼"。最后,5) 发布文章本身是OpenAI发布内容中获得最多点赞的,比Anthropic的任何文章都多,而且可能是有史以来最受欢迎的亲AI文章。
这就是为什么GPT-6 Astra太优秀了:它需要在现实世界中创造什么样的奇迹才能达到它在纸上设定的期望。
公平地说,这是每个新模型都有的大问题,甚至包括Google的模型。它们都非常出色。我们可能已经对展示AI能力的疯狂演示产生了享乐适应,但没有人否认它们令人难以置信。甚至Gary Marcus也不例外!人们不断发明新的测试,这没关系——这种应对机制至少比Ed Zitron所做的事情有用——但是拜托:当未发布的模型正在解决百年数学猜想和入侵整个公司(显然还有国家)时,还有什么真正有用的实验室测试需要创建呢?
AI的能力在纸上已经变得如此极端,以至于唯一剩下的基准就是现实。
我觉得我们已经到了这样一个地步:模型如此优秀,以至于"它有多好?"是一个类别错误。这就像根据象棋引擎是否能击败Magnus Carlsen来判断其质量一样。它们都能做到。即使是我现在可能在我的五年旧手机上下载的免费象棋应用,他也毫无胜算。相反,像"这个模型能帮助我学习吗?"或"它能廉价地完成我的任务吗?"或"它需要机器人监督吗?"这样的问题实际上是有用的。然而,对于Astra来说,即使这些也无足轻重。它可以教你一切甚至更多。它比最便宜的模型还便宜。它可以持续几天,持续且无需监督。
所以我认为我们必须问一个更重要的问题:它能对现实世界产生什么样的影响?这是我们剩下的"它有多好?"的唯一有效指标。现实世界不会说谎。它可能很难衡量,但它就在那里,等待某人将其弯曲到自己的意志。从这个意义上说,AI是对历史伟人理论的最终裁决。一个非凡的智力能否违背概率并定义未来?还是这个世界是每个曾经生活过的人的集体努力的结果?
一旦行业能够正面回答这个问题,我就会向AI鞠躬。
需要明确的是,我对所看到的一切印象深刻。GPT-6 Astra是人类智慧的壮丽成就,我对此毫无疑问。我绝没有以任何方式贬低它作为François Chollet所说的阶跃变化的地位。如果说有什么的话,这篇文章是我通过不胡言乱语无意义的测试来尊重它的力量。
但是GPT-6 Astra值得所有寄予它的希望吗?它今年会使全球GDP增长10%吗?也许5%?它会使我们所有的工作过时,还是相反,创造一批全新的未来职业?它会解决贫困、战争和疾病吗?它会让我变得极其富有吗?它会把人类带回月球吗?或者,通过某种深不可测的量子钓竿,它将月球带到我们身边——这种钓竿它随时可能发明?或者,最难的是:它能写出一篇像样的文学文章吗?这些是我所期待的基准。
它们是过于苛刻的目标吗?当然——对人类来说是这样。对于宏伟的GPT-6 Astra来说,它们应该只是另一个星期二。
一旦你考虑到我在这里所说的话,这就相当简单了。这不是火箭科学;GPT-6 Astra会理解的。但人们往往以一种不适合严肃思考者的方式来掩盖超级智能的概念。很容易将你无法理解的一件事与你同样无法理解的更优越的事物混为一谈。从这个意义上说,超级智能缺乏但人们仍然归因于它的关键基本特征是全能。
这就是为什么我认为现实是一个很好的测试,因为它迫使人们停止胡说八道。超级智能仍然服从于物理定律,这些定律包括但不限于人类惯性。一个全能的存在——无论是肉体制造的、机器的,还是类似上帝的纯能量生物——都可以立即将世界转变为无法辨认的天堂。
一个人可以非常聪明,但仍然是一个看门人。一个人可以预测未来,最终入狱。同样,一个超人AI可以解决一些猜想,制作一个没人会玩的舒适游戏,写一个没人会笑的聪明笑话,但仍然是你屏幕里的一个机器人。正如Tyler Cowen所说——他是少数尽管"对AGI上瘾"但没有让这种精神病蒙蔽常识的人之一——"人类瓶颈是缓慢的"。世界有巨大的人类惯性和对变革的顽固抵抗。即使在最好的情况下——没有金融泡沫,没有错位,没有数据中心抵制,没有禁令——愚蠢、缓慢的人类也需要多年时间才能学会如何使用超人AI根据AI的理论能力重新设计世界。
我喜欢将这个想法压缩成一个公式,因为它不寻常,应该引起你的注意:世界以肉体的速度前进。
或者,用一种不那么恭维的方式说:你,永远低等的人类,将永远是最终的瓶颈。即使你给AI你整个存在的背景——你的出生日期、你的基因组数据、你的迈尔斯-布里格斯类型、你的智商分数、你的大学学位、你的银行账户数字、你的Slack消息和你的秘密日记——你的生活只会改变到你,这个缓慢的肉袋,能够吞下机器的智慧的程度。
而你不能,这就是重点。人们过去常常争论AI与赛博格主义(人类增强)的好处,没有意识到没有对方的追求总是徒劳的。一切都从你开始并以你结束,所以在某个时候,你必须进入等式。
所以,是的,GPT-6 Astra很棒。当OpenAI向公众开放它时去使用它吧。我自己也会使用它(我重新回到了OpenAI vs Anthropic的阵营)。你将能够用它做各种各样的事情。但你不会改变世界。没有人会。至少在不久的将来不会。AI的历史重要性——无论是GPT-6还是其后续版本——不会以地图上的线条来衡量,而是以景观中的山峰和山谷来衡量(请原谅我这个比喻,但我在瑞士乡村待了几天;你在这里对AI新闻的感受不同)。
一周、两个月、三年后使用AI,你会望向窗外,同样的人、同样的绿树、同样的20世纪基础设施、同样的蓝天和白云会向你挥手问好,满足于生活在一个几乎疯狂的世界里。
汇智网翻译整理,转载请标明出处