前端这一行,真要被OpenAI一锅端了吗?
开发者@Lentils80近日无意间发现,OpenAI已经悄悄扩大了Astra的内测范围,该模型内部代号为mozaik-alpha-fdm。
他放出的两段结果,均在Max effort(最大算力)模式下一次生成,没有经过任何样本训练或提示微调。

其中一个是3D像素风的城堡场景,另一个则是完整的前端网页——两者都是一次成型,没有二次修改。


几乎同一时间,一批拿到灰度测试资格的开发者也陆续晒出了Astra的初体验。
令人意外的是,统一的视觉风格、复杂元素间的空间关系、页面层级乃至交互逻辑所需代码,Astra竟能一次性全部拿捏到位。
有开发者看完直接下结论:“前端问题,已经被解决了。”
业内普遍猜测,Astra很可能会在下周四(9月3日)前后正式亮相,届时将与Fable 5.1正面交锋。

综合已知信息,Astra大致具备以下几项突出能力——
前端表现极为出色,零样本即可一次生成;
多智能体协同经过端到端训练,能够从容应对超长周期任务;
推理模式具备“持续性”,可在生成过程中实时自我修正。
一句话憋出3D网页,Astra把前端玩出新高度
长期以来,前端一直是各家大模型难啃的骨头。
后端逻辑写得再漂亮,只要一涉及界面生成就容易露馅——CSS堆得臃肿,配色更是惨不忍睹。
但这一回不一样了,Astra在零样本条件下表现出的细节掌控力,让人隐约嗅到了质变的味道。
拿那张可交互的3D等距王国地图来说,想要做好它,AI得同时兼顾几何透视、图层叠放、动态交互和视觉统一,难度不小。
只要把思考程度调到最大,Astra便能一次成型,不需要反复调整。
在Max模式下,Astra的思考量普遍超过Sol模型,不过从输出结果能看出,它对细节的执着程度相当惊人。
它“凭空”造出的一艘宇宙飞船,细节和结构都相当逼真。


另一位开发者MeSun则用Astra做了个带物理效果的3D自行车演示网页,车身比例还能随意拖动调整。

研究者又给它出了道难题——生成一款主打战斗爽快感的3D第一人称Roguelike游戏。
结果同样毫无悬念,一次生成就搞定。

看完这波演示,有爆料人士直言,这大概是历史上第一次,“想法”真正跑赢了“执行”。
“只要你想得出来,AI就能给你做出来。”

“常驻”智能体,四大技术内核被扒了个底朝天
Astra的前端能力为何能在一夜之间脱胎换骨?
结合目前流出的信息与业内推测,mozaik-alpha-fdm版本的核心突破大致落在以下四个方面。

第一,端到端的多智能体编排。
Astra很可能已经不是单纯意义上的“单体代码生成器”,底层原生嵌入了多智能体架构。
比如,编程任务交给Codex处理,自然语言查询由另一个子模型负责,最后统一由主模型汇总输出。
在生成3D网页的过程中,模型内部实际上同时运转着“UI设计师、前端工程师、代码审查员”三重角色,从而让布局、样式和逻辑三者保持一致。
这与GPT-5.6此前以beta形式上线的Multi-agent功能一脉相承,区别在于Astra可能已将其内化为端到端训练出的原生能力。
第二,超长程任务处理能力。
过去的模型一旦遇到涉及多组件、CSS与JS深度联动的项目,很容易出现“遗忘”甚至“幻觉”。
而Astra展现出的完整度说明,其上下文窗口内的注意力机制经历了一次革命性升级,足以撑起从零搭建复杂工程的需求。
从它解答十道数学题的表现能看出,Astra能在相当长的时间跨度里维持推理的连贯一致。
这对代码项目的持续迭代、论文级研究任务乃至复杂工作流的自主运行,都有着不小的意义。

第三,持久化推理模式。
在Max effort模式下,Astra的思考量明显高于Sol,这背后指向的是一种更具“持续性”的推理机制。
它不会急着一次性抛出答案,而是在内部反复验证、纠错、迭代,直到结果令人满意为止。
换句话说,它能够“记住”当前DOM树的结构,从而让后续生成始终保持设计语言和代码规范的一致性。
第四,即时自我纠错。
这一点最让人后背发凉——Astra很可能在生成代码的同时,已经在内部沙盒里完成了“虚拟渲染”或AST语法树的逻辑校验。
一旦发现前端错位,系统会自动完成重构,最终才把打磨完善的零样本结果交到用户手中。
能在零样本情况下复刻PS5手柄这类高细节渲染任务,本身就间接证明了它具备自我纠错的能力。

9月首周迎来对决,Fable 5.1正面接招
不过,好戏才刚刚开场。
就在同一周,Anthropic也被曝正加快推进Fable 5.1的发布节奏。
巧合的是,它的发布窗口恰好也卡在Astra前后。
从已获得灰度测试资格的用户反馈来看,Fable 5.1这次升级的重点,几乎与Astra不谋而合:
前端代码更加稳定,复杂组件逻辑能够一次成型;
长链条推理能力进一步增强,不容易在推理途中“忘记”前提条件;
工具调用与分步规划也得到强化,正逐渐逼近成熟AI Agent的水准。

也就是说,两家公司实际上已经杀入了同一个赛场:代码能力要更强,任务要能跑得更久,过程中还得尽量减少人工介入。
如今,双方甚至已经开始隔空较量。
以同样一张“女子自画像”SVG矢量图为题,左边出自Astra,右边则由Fable 5.1完成。
细节是否更稳、结构是否更干净、一次生成的完成度谁更高,这些都已经能摆在台面上直接比较了。

不过,真正左右胜负的,或许还不止是模型能力本身。
据爆料透露,Astra除了性能出色,还可能在价格上继续下探。
如果OpenAI真能以更低的调用成本,交付一款自带Max effort、自纠错能力更强、且无需复杂工程编排的模型,那么Fable 5.1所要面对的,恐怕就不只是跑分上的压力了。
下周四,这场巅峰对决即将揭晓答案,谁能问鼎新王宝座,值得拭目以待。
(本文综合整理自新智元相关报道及开发者社交媒体爆料)