拓冰建站拓冰建站
首页 / 资讯中心 / 正文

AGI竞赛白热化:英伟达、OpenAI、Anthropic谁能率先跨越门槛?

AGI实现之争老黄与奥特曼的不同声音AGI已经有人宣布实现了。就在本周三的财报电话会上老黄撂下一句对于许多任务来说我们可以说我们已经实现了AGI。而同一天一篇两个多小时的奥特曼长访谈也放了出来他给的日期是2026年底。对奥特曼来说这4个月不只是一场技术冲刺。明年上市之前他必须先把AGI这张牌打出来。打不出来等他敲钟的时候前面已经站着一个先上市、市值高出一倍、还在盈利的对手。这一仗OpenAI退无可退。老黄的观点与英伟达的成绩那场电话会上有人问老黄OpenAI这些公司这么玩命地追AGI他怎么看。老黄的回答是这问题现在没什么好争的。整个行业连「智能」到底是什么都没谈拢更别说拿哪把尺子去量AGI。他手里握着的是另一样东西。英伟达的AVO架构在一项专门考「智能体能不能长时间自己干活」的测试ARC - AGI - 3上拿到了100%满分。顺着这个成绩他抛出了一个野心极大的预测在不久的将来英伟达可能只需要维持4万名左右的人类员工但他们将拥有40万甚至400万名数字员工。满分卷背后的真相但那张满分卷拆开只有一层壳。众所周知ARC - AGI - 3的玩法相当「不讲武德」。把智能体直接扔进一个陌生游戏里规则和目标一概不给全靠自己按、自己看、自己猜。手里只有一块64×64的网格和几个按键每个环境至少六关第一关五步能过的到第六关得走五十步。人玩着都费劲模型更没好到哪去。关键在这儿AVO用的模型是Claude Opus 5。然后英伟达给它套了个壳。权重一个参数没动直接从30.16%跑到了满分。在这里真正起作用的是两样东西。一是持久记忆上下文满了记忆也不清零智能体从当前状态接着干不用把同样的坑再踩一遍。二是监督器它自己不干活只在旁边盯着整条搜索轨迹一发现原地打转就把主智能体拽向别的策略。不过严格来说这张满分卷其实并不算数。英伟达官宣三个多小时后ARC - AGI之父François Chollet发推表示在公开演示集上拿到100%不等于在ARC - AGI - 3基准上拿到100%。这就好比说你通关了一款电子游戏其实你只是清掉了新手教程关。按ARC Prize自己的说明公开集本来就不是用来打分的真正算数的是半私有集和私有集而AVO的成绩单上这两项都没有。更微妙的是这已经是六周内的第三张满分卷。Tycho在7月底率先拿下VISTA在8月5日又拿了一次AVO是第三个。三家的解法完全不同但驱动的模型清一色是Claude Opus 5。奥特曼的底气与OpenAI的成果宣布AGI的人越来越多但能造AGI的似乎还是那两家。而这张牌还没有人真正打出来。奥特曼凭什么敢说年底在专访中奥特曼信心十足到年底OpenAI内部会出现一个他愿意称之为AGI的系统。首席研究官Mark Chen则相对保守一些。在他看来OpenAI距离AGI还差20%。这话听着狂但他们手里确实是有点东西的。今年OpenAI内部定过一个非常明确的目标造出一个可以真正干活的自动AI研究实习生。而这个「AI自动化实习生」就是Astra。给Astra一个实验想法它能在OpenAI的代码库里自己写代码、跑实验、交结果。把一篇论文扔给它Astra可以完成过去一名顶级人类研究员一周左右的工作量。Astra的惊艳表现不久前的一场内部演示上几十位大客户高管亲眼见了一回。大屏幕上16个AI智能体把一道研究级数学题拆成一堆子问题。它们各自领活中途互相核对最后拼出一份完整的证明。这完全看着已经是一支配合默契的团队在开闭门会了。第二个演示更震撼。Astra打开常见的桌面软件在不同应用之间来回横跳建文件、改内容、调度任务快得根本不像人在敲键盘。看到的人无不感慨Astra这次彻底打通了「持久化智能体」。而奥特曼更是预言「我预计这会是第一个真正发明出重要新东西的模型。这是非常AGI的一件事」。注意「发明新东西」这个措辞它的意思是凭空造出全人类目前还不知道的东西。Astra助力芯片研发最近OpenAI首颗自研芯片「墨西哥辣椒」Jalapeño直接把老黄的旗舰GPU按在地上摩擦。这背后的头号功臣正是GPT - Astra。它直接上手从电路设计一路干到软件。芯片这头下场优化了底层电路。软件那头编写和优化了最底层的核心Kernel并且还顺手把三大开源模型调校了一遍。结果就是BF16乘法器性能暴涨56%矩阵单元面积反而缩小了10%。「注意力机制」和「MoE」这两个核心模块比人类专家手写的版本还要快1.5到1.8倍。各位AI这是在物理层面动电路啊。有意思的是英伟达那边干的是同一件事。AVO压根不是为打游戏做的它的主战场是给GPU写底层代码。今年3月英伟达发过一篇论文核心思路是把「改代码」这一步整个交给一个能自己干活的智能体。实测里它连续自主运行了7天全程无人干预探索超过500个优化方向最终提交40个有效内核版本。跑出来的核心代码比英伟达自家闭源的版本最快3.5%比业内最前沿的开源实现最快10.5%。AI造AI研发速度质变现在把这两件事连起来看奥特曼那句话就有底了。每一次模型迭代都要烧掉大量人类研究时间。但如果Astra开始接管这一环整个研发速度就会发生质变。这个循环一旦转起来剩下的就是速度问题。下一代模型进展与上市之争实际上我们在外面能用到的GPT - 5.6和Fable 5都是上一轮的产物。而爆料显示两边真正的下一代其实都已经练完了。OpenAI这边据长期追踪前沿模型动态的leo等人爆料今年的预训练排得相当密SpudSol3月完成预训练对应现在公开的GPT - 5.5、5.6系列Doug4到5月完成在它上面继续做强化学习等后训练就是即将登场的Astra也就是外界口中的GPT - 6Bel8月刚刚结束预训练总参数超过10万亿规模接近当年的GPT - 4.5。爆料称OpenAI内部把Bel视为「GPT - 6之后的基础模型」甚至有可能成为某个跨过AGI门槛的模型的基座。Anthropic这边有人在8月18日发现Claude网页版上一部分选了Fable 5的账号被悄悄切到了一个新模型上。这是Anthropic发布前的老规矩Fable 5自己当初也是这么灰度出来的。紧接着代号被扒了出来。claude - melon - eap疑似是Fable 5.1claude - marshmallow - eap疑似是Opus 5.1。并且两个新模型据称都已经在小范围跑起来随时可以推给所有人。至于为什么都压着不发网友的分析是谁先发谁就会在几天后被对方盖过去。尤其是Anthropic还被曝出将在2027年初直接拿下领先位置。有机构做过测算Anthropic有88%的概率先于OpenAI上市最可能的日期是今年10月26日而OpenAI最可能的日期是明年7月15日。上市首日的市值预估Anthropic 1.82万亿美元OpenAI 1.06万亿美元。OpenAI的CFO在8月的全员会上说公司会在2027年或更早上市前提是业务「继续拐头向上」。AGI技术里程碑与上市关键所以年底那个AGI就不只是一个技术里程碑。它是招股书里最「关键」的一页。交得出来OpenAI的故事就从「我们烧钱做模型」变成「我们已经站到了终点线上」估值逻辑整个换掉。交不出来明年7月敲钟的时候手里还是那个烧钱的故事。而这一仗之所以非打不可答案在递归自我改进这四个字里。老黄那句「4万人指挥400万AI Agent」OpenAI那句「AI已经在帮着造下一代AI」讲的是同一件事一旦AI能接管制造下一代AI的活进步就不再是线性的了。这就是为什么所有人都在赌超级智能ASI这场竞赛最后是赢家通吃。第一个把这个循环真正转起来的玩家会顺手拿走后面所有的东西。至于第二名可能连追的资格都没有。奥特曼身后已经没有地方可退了。
分享:

看完干货,该让你的企业上线了

免费需求沟通 · 48 小时内出具建站方案 · 河南本地可上门