Codex 新功能要来了?OpenAI 新模王Astra 测试也被集中流出
原创 阿雅 2026-08-31 11:02 北京

OpenAI Codex 负责人 Tibo 又又又要准备重置了,并在 X 上喊话:
Codex 和 ChatGPT Work 使用额度将在太平洋时间下午6点重置。大家在重置之前尽可能把现有额度用掉,顺便探索一下最新上线的精彩功能。是时候开启
/fast模式了

家人们,这次不单单是 OpenAI 又一次给咱们“回血”,Tibo 还专门鼓励大家都开/fast模式把额度烧光,并且去体验最新功能。
没错,就在Tibo宣布重置前,一些Codex用户发现,新的Ultrafast模式似乎已经开始灰度推送。
用户@blueemi99在X上晒出了Codex界面,并询问其他人是否已经获得这一模式。

也是在同一时间前后,X 上突然出现了大量据称由 OpenAI 下一代模型 Astra 生成的测试案例。
更有爆料者称:Astra 可能最快在本周四发布。

如果爆料属实,OpenAI 下一代模型真的已经到了发布前夜。
只是,它会不会叫 GPT-6,目前仍然没有官方答案。
◈Astra 已经不再是一个传闻模型
今年早些时候,Astra 还只是媒体报道中的一个内部代号。现在,OpenAI 已经公开确认它的存在。
OpenAI 第一次正式介绍 Astra,因为它在安全评估中表现得过于强大,无法排除 Astra 已经达到其网络安全能力标准中的“Critical”级别。

简单来说,它可能不只是帮助安全专家检查漏洞,还可能具备自主发现高价值漏洞、开发攻击手段,甚至执行复杂攻击链的能力。
为此,OpenAI 放慢了部分前沿强化学习工作,并补充模型隔离、网络访问限制、权重保护和推理监控措施。
Sam Altman 随后还表示,Astra 是一个非常强大的模型,OpenAI 正在努力让它能够被广泛使用。

◈Astra 案例展示
在这次案例展示中,最受关注的案例,是一艘3D科幻飞船:一句话生成3D飞船,半小时输出数万Token
用户给出的要求很简单:
建造一艘华丽的科幻飞船,内部结构可以自由探索。
随后,模型直接生成了一艘拥有完整外观和内部空间的飞船。
它不只是做了一张看起来像飞船的图片,而是同时处理了3D场景、空间结构、内部房间和探索交互。
过去用AI制作类似项目,通常需要人类把任务拆成许多步骤:先生成模型,再设计内部结构,然后编写交互代码,最后反复修改细节。
据发布者展示,Astra尝试把这些工作一次完成。
第二个案例更加夸张。
有人让Astra生成《星球大战》里的死星场景。据测试者自述,模型在Max effort下持续运行约26分钟,一次输出约7.5万Token,最后生成了一个可以交互的完整3D场景。

从视频内容中可以看到,模型生成的不只是死星外观,还包括可操作的3D空间、不同观察视角、场景结构和相应的交互界面。
用户不需要先让模型建立场景,再逐步补充控制代码和交互功能,而是直接给出最终目标,让模型自己完成中间的大量步骤。
第三个案例是一座Voxel风格的立体城堡。
据@lyraxana记录,Astra在Max reasoning effort下运行约38分钟,输出约5.6万Token,最终生成了一个带有完整界面的3D宝塔场景。
模型不仅生成了城堡和周围环境,还给项目添加了完整的操作界面。画面中同时存在建筑、场景、菜单和交互按钮,更像一个可以继续开发的游戏原型,而不是单独生成的一张图片。
除了这三个大型案例,还有一些相对简单的测试。
有一些流出的视频则展示了Astra的前端能力:用户只提供一句简单要求,模型便一次生成视觉完成度较高的网页,并主动处理排版、配色、组件和交互细节。

总结一下,我们可以看到这些案例都有一个共同特点:
Astra 在长时间生成、复杂项目完成度和一次性交付规模上有了提升 !
不过,这些视频目前仍然属于社区流出的早期案例。
仅凭几段视频,我们只能看见 Astra 生成了什么,却无法知道 OpenAI 究竟想把它做成什么。
记者Alex Heath看到的内部演示,给出了更完整的答案。

◽第一,从执行长期任务,走向长期跟进项目
现在的 Codex 已经可以连续工作几天甚至几周,但通常仍要由用户提前设定任务、触发条件和执行时间。
Astra 想再往前一步:不只把任务执行得更久,还要一直保留项目状态。即使中途暂停、出现新资料,或者用户过几天再回来,它也知道项目进行到了哪里,可以接着往下做。
据 Alex Heath 转述:Sam Altman 希望未来能通过ChatGPT或API提供一种可以长期持续运行的智能体。

◽第二,记住用户的纠正
现在使用 AI 干活,一个常见问题是:
你刚刚纠正了它,换一个任务或者过一段时间,它又犯了同样的错误。
据 Alex Heath 披露,Astra 可以在长期任务中保留人类给出的纠正和反馈。
如果你告诉它,公司报告不能采用某种数据口径,或者代码必须符合一套内部规范,它可以在后续工作中继续遵守,而不是每一次都要重新提醒。
这意味着,未来训练一个 AI 员工可能真的会像带新人一样:
不用每次都重新写提示词,只需要在合作过程中不断纠正,它逐渐适应你的工作方式。
◽第三,从调用几个助手,走向组织一支 AI 团队
Astra 并不一定独自完成所有工作。
它可以把一个复杂目标拆成多个任务,再让不同智能体分别研究、执行和检查。
比如制作一份公司经营分析:
一个智能体负责整理财务数据,一个负责查找市场信息,一个负责制作图表,另一个负责检查结论是否与原始数字一致。

Astra 更像项目负责人,负责协调这些智能体、合并结果,并判断哪些部分需要重新处理。
这也解释了为什么 OpenAI 越来越强调云端运行。
当一个模型需要连续工作几天,同时调用多个智能体、浏览器、终端和数据工具时,个人笔记本很可能不再是最合适的运行环境。
◽第四,直接操作桌面软件
Astra 不只生成文字或者代码。
据 Alex Heath 描述,它可以操作桌面软件,制作演示文稿、检查财务材料,并分析格式混乱的数据。

比如它可以从邮件中获取要求,到表格里处理数据,再打开演示软件制作汇报,最后检查结果是否符合最初目标。
过去需要人类不断复制、粘贴和切换窗口的工作,可能被它连接成一条完整流程。
OpenAI 产品负责人还告诉 Alex Heath,为这类持续运行智能体设计的新界面“很快”就会到来。
如果界面已经接近完成,说明 OpenAI 考虑的不只是模型研究,而是普通用户应该如何管理这些不会停止工作的智能体。
◈一个免费重置,一个开始控制额度
过去几个月,OpenAI 已经多次为 Codex 和 ChatGPT Work 用户重置额度。
这一次,Tibo 甚至直接鼓励用户尽量把额度用光,打开/fast模式,体验最新功能。
其实目标也很明确:先让大家不用心疼Token,敢于把更大、更复杂的任务交给Codex。
当大家习惯让AI连续工作几十分钟、修改多个文件、运行测试并检查结果之后,Codex就不再只是一个偶尔打开的代码助手,而会逐渐进入每天的工作流程。
Astra 也正是使用模式的下一步。
如果一个模型未来需要连续工作几天,协调多个智能体,同时操作浏览器、终端、表格和演示软件,用户消耗的将不再是几次回答,而是持续运行的云端算力。
我们再回头看看隔壁 Anthropic 正在采取另一套策略。

Anthropic最新宣布,从9月14日起,标准周额度将永久提高25%。
和最初的100相比,确实增加了25%;但和用户现在享受的150相比,实际减少了约17%。
这也是不少用户不满的原因。
OpenAI还在频繁重置额度,鼓励用户尽量多用;Anthropic虽然降低了模型单价,却已经开始控制一个包月用户到底可以消耗多少算力。
Astra会不会在本周四发布,目前还没有官宣。
但围绕下一代AI的第一场竞争已经开始了。
不过,看到 Astra 已经展示出的这些能力,我已经忍不住开始期待了!


参考文献
[1] Tibo: https://x.com/thsottiaux/status/2094144275957350900
[2] Alex Heath: https://sources.news/p/sam-altman-openai-agi