导语:OpenAI总裁格雷格·布罗克曼在Astra发布前接受深度专访,首次披露该模型是OpenAI历史上首个在超10万块GPU上训练的成果。他指出Astra的核心突破在于「电脑使用」能力,AI从此可以像人一样操作任何软件,不再依赖API接口。他认为AI已跨入AGI时代门槛。
OpenAI总裁格雷格·布罗克曼在Astra发布前夕接受深度专访,首度披露这款新模型是OpenAI史上首个在逾10万块GPU上完成训练的模型,并直言AI已跨越「电脑使用」的应用门槛——这意味着AI从此不再需要依赖API连接器,而是可以像人一样操作任何软件。
「这是我们首次在超过10万块GPU上进行训练。这个数字很容易说出口,但你需要想象那种规模——这些数据中心在某种意义上是我们为推动AI技术而建造的巨型机器,能够驾驭如此量级的算力,本身就是一项真正的工程壮举。」布罗克曼在访谈中说。
他强调,算力的大幅扩张并不仅仅用于提升模型能力,「大量算力投入到了安全与对齐工作中,还有大量安全工程围绕它展开。这是我们迄今为止对齐程度最高的模型——而正因为能力如此之强,对齐与安全变得比以往任何时候都更加核心了。」
布罗克曼将Astra最核心的突破定位在「电脑使用」(computer use)上。「过去两年,我们处于一个'连接器时代'——你有一些软件,人类可以正常使用,但AI没有访问权限。于是你必须为每一个软件写一个专门的连接器,钩入其API;而有很多软件根本没有API,那就完全超出AI的能力范围了。现在,我们拥有了近乎'万能连接器'的技术。AI从被严格限制帮助你,变成几乎可以操作任何东西。」
布罗克曼在访谈中作出了一个措辞颇为大胆的判断:「我认为,也许是上一个模型,也许是Astra,也许是下一个模型,但在这其中的某个节点,我们将跨越大多数人对AGI的门槛。在某种意义上,我会说我们现在就已经进入了AGI时代。」
他解释,当前阶段对齐、安全与能力三者需要作为并行要求共同推进。访谈中一个颇具冲击性的细节来自Astra的实际训练过程:OpenAI过去花费大量精力为模型编写的行为规范,如今反而拖了后腿。
「我们发现,今年以来辛苦建立的一些技能——用来向模型展示在OpenAI内部做事的正确方式——实际上对它的表现来说是净负担(net negative)。它能够比我们写的更好地泛化,找到比我们规定的更好的处理模式。就像训练轮,起初有用,但一旦它跑得更快、更有能力,那反而成了障碍。」
在网络安全议题上,布罗克曼透露了一个引人注目的内部实践:OpenAI将Astra直接指向自己的系统寻找漏洞。「我们调用了Astra,把它对准我们自己的系统来发现漏洞——不只是读代码,而是真正审视这些系统端到端的运行方式,从而找到真实的、经验证的漏洞,然后帮助我们完成修复和补丁工作。」
在芯片战略层面,布罗克曼明确否认了自研Jalapeño芯片替代英伟达的逻辑:「英伟达是我们的首选计算合作伙伴,这不会改变。事实上,我们与他们的合作正在进一步深化。我们自有芯片项目带来的内部专业知识,对我来说是乘法效应,不是替代。」他还披露了一个AI辅助芯片设计的有趣插曲:在Jalapeño面临截止日期的最后一个月,团队直接让AI运行优化,后来发现它找到了一大堆团队列表上有但永远不会自己去实现的优化。
他将10亿ChatGPT用户定性为「投资」:「这是真正的投资,它将在未来模型解锁的方式上积累价值。」同时他也承认聊天作为产品的挑战在于,它未必与更智能的模型直接对应。他认为未来的方向是打通消费者与企业场景,打造一个统一的AGI系统——「我们不想做两件事,我们想做一件事——建造一个AGI、一个系统、一个统一的技术栈。」
免责声明:本文内容整理自公开报道,仅供参考与讨论,具体信息请以官方发布为准。
发表评论 取消回复