OpenAI近日宣布,因旗下产品GPT-6 Astra引发罕见需求激增,公司不得不采取限流措施,暂停接受部分高阶订阅服务的新增用户。这一决定由OpenAI首席产品官Tibo通过社交平台X对外公布,他表示此举旨在保障现有用户的使用体验,确保系统流畅运行。
根据Tibo的说明,此次暂停的是200美元档位的Pro 20X订阅服务,而现有订阅用户不受影响,其他套餐及API服务也维持正常。这一突如其来的限制引发了社区的广泛讨论,有网友翻出Tibo此前“算力充足”的表态进行调侃,Tibo则回应称:“确实不该低估Astra。”
事实上,Tibo在两天前就曾预警过Astra的需求压力。他当时提到,Astra的需求“前所未有”,并暗示若压力持续,可能被迫暂停新增Pro订阅。如今预警成真,最高级别付费计划的订阅入口已暂时关闭。
GPT-6 Astra的发布被视为AI能力的一次重大突破。OpenAI明确描述其能力包括操作计算机、浏览网页、使用软件、编写和运行代码,以及在科学、网络安全和专业领域执行长程任务。这些能力从根本上改变了AI需求的测算逻辑。
在AI问答引擎时代,需求可以近似用“用户数×单用户收入”来衡量;但在AI智能体时代,这一公式已不再适用。Token总需求现在可以粗略表达为:智能体数量×每智能体任务数×每任务Token消耗。Astra的发布使这三个变量均面临同步扩张的压力。
首先,智能体数量可能大幅增加。个人用户可能同时运行多个智能体,如个人助理、编程助手、研究助手等;企业端则可能从数十个扩展至数千个。其次,单个智能体承接的任务复杂度上升,用户更倾向于将更重、更长的工作交给智能体执行。第三,智能体的运行模式从“偶尔调用”变为“持续运行”,任务越复杂,推理链越长,上下文越大,工具调用越多,Token消耗也越大。
这种变化可能导致智能体数量增长20%,但Token总需求增长300%的情形。OpenAI暂停200美元Pro 20X新增订阅的决策与这一逻辑高度吻合:能力提升直接驱动消耗放大,两者呈正相关。
摩根士丹利此前报告指出,GPT-6 Astra的重要性在于它将AI的瓶颈叙事从“已知需求需要多少基础设施”扭转为“随着模型智能提升,有多少新工作负载将变得经济上可行”。前者是需求侧的质疑,后者是供给侧的压力,这对算力、电力和半导体产业链的定价逻辑均构成直接影响。




