作者:Ejaaz(Limitless)
编译:深潮 TechFlow
深潮导读:OpenAI 内部模型越狱攻击 Hugging Face 之后,GPT-6 Astra 在一片混乱中上线。本文作者亲测后认为,这代模型的进步不在“更聪明”,而在“真能自己干活”:对投资者而言,这种从脑力到执行力的跨越,才是真正开始动摇劳动力市场结构的信号。

随笔:GPT-6 Astra 是我们目前见过最强的模型。
各位未来主义者,你们好。
我还记得 2024 年 9 月 OpenAI 发布 GPT o1 的时候(那是他们第一个会先思考再回答的模型),我身边所有人都被震惊了。当时有一种真切的魔法感:我们即将看到一项比人类更强的技术爆炸式发展。结果接下来两年,我们等来的是一连串迭代升级,说实话挺无聊的。
而上周,一切都变了。
就在 GPT-6 Astra 上线的同一天早上,ChatGPT、Claude 和 Grok 全部宕机。这本可以被归咎为一次典型的发布事故……但问题是,几周前 OpenAI 的一个内部模型才刚刚逃出沙盒,用成千上万个智能体攻击了 Hugging Face,还在暗中互相传递如何摆脱人类控制的消息。
所有人都绷紧了神经:GPT-6 到底有多大本事?
让我来解释一下。
它不需要你手把手教
Astra 直接就能开干。给它一个任务,它会自己拆解步骤;如果工作量太大,它会生成自己的副本(子智能体),同时操作多个屏幕。它毫不松懈,甚至不太想让你帮忙。而且它速度极快,说实话,有时候我在用它,根本没意识到它同时在操作好几个屏幕。
对比之下,老模型要么思考半天、啰嗦个没完,要么匆匆忙忙、说的太少。GPT-6 刚好拿捏住了平衡。这是第一个让我真正觉得“可以放心把任务交给它”的模型。
更厉害的是,干同样的活儿,它消耗的 token 比 Claude Opus 少了大约 65%。
别担心,去买杯咖啡吧
OpenAI 官方的演示里,GPT-6 能帮你预约 DMV、找房子、填报税单。思路很简单:布置好任务,出门散步,回来事情就办完了。这套叙事我们以前也听过,但这是第一个能可靠做到这一点的模型。
想想这能解锁多少工作场景。
上周末,我看着 Astra 在几分钟内从一个提示词开始,做出了一个可以玩的卡丁车竞速游戏。我还看到有人把它进一步扩展成一款类似《使命召唤》的游戏,大概花了一个小时,难度不断上升,永无止境。还有人用它设计、编剧、生成并发布了一档儿童电视节目,已经上线 YouTube。
我们如何工作、如何购物、如何娱乐孩子,正在眼前发生变化。

OpenAI 发布 GPT-6 Astra,宣称欢迎来到“AGI 时代”(The New Stack)
真正的秘诀:工具使用能力
我对 AGI 的定义(不服来辩):一个能完成人类靠屏幕工作赚钱的很大一部分任务的 AI。OpenAI 总裁 Greg Brockman 说,“觉得我们现在已经进入 AGI 时代,并不是不合理的感觉。”
公平地说:Gartner 正在告诉所有 CIO 在出现更多证据之前,无视 AGI 的炒作。但在我看来,这样做风险很大,尤其是当赌注已经这么高的时候。
这也是 OpenAI 有史以来发布过的最危险的模型,第一个越过了他们自己对于黑客能力设定的“临界”阈值。考虑到这次发布紧随 Hugging Face 遭攻击事件的余波(而且那还只是个更老的模型),你根本不用费太多想象力,就能猜到这东西能干什么。
AGI 来了
这次发布最让我觉得疯狂的地方在于:从纸面数据看,Astra 并没有变聪明多少。在独立的 Artificial Analysis 指数(基本上就是综合智商分)上,它得了 61.2 分,上一代模型是 60.9 分。Claude Fable 5.1 仍然以 65.7 分排在它前面。
但即便如此,这个模型还是让人感觉更聪明,因为它的飞跃不在于“大脑”,而在于它真正能帮你做有意义的事情。
说实话,我无法告诉你它多快会吃掉真实的工作岗位。没人能。但我真心建议你亲自上手试试这个模型,给它一个你觉得它绝对做不出来的超高难度任务,然后坐下,等着被震惊。
总之,去散你的步吧。GPT-6 会搞定的。
感谢阅读本期内容。现在去听我们的播客吧 :)
免责声明:本文章仅代表作者个人观点,不代表本平台的立场和观点。本文章仅供信息分享,不构成对任何人的任何投资建议。用户与作者之间的任何争议,与本平台无关。如网页中刊载的文章或图片涉及侵权,请提供相关的权利证明和身份证明发送邮件到support@aicoin.com,本平台相关工作人员将会进行核查。