来客网

OpenAI神秘新模型曝光,前端要被AI一锅端了?

声明:本文转载自 「倍可亲」, 或因排版与篇幅原因进行过编辑,内容未经本站独立核实,不代表本站立场、观点或建议。 如涉及版权问题,请联系我们,核实后立即删除。 [ 免责声明 ]

OpenAI神秘新模型曝光,前端要被AI一锅端了?

来源:倍可亲(backchina.com)

  前端要被OpenAI端了?新模型Astra内测曝光,零样本直出复杂3D网页!凭借多智能体与自纠错等核心技术,彻底实现“想法碾压执行”。传Astra将于9月初发布,以极高性价比正面硬刚Fable 5.1,AI编程新王之战一触即发!

  前端开发,真要被OpenAI一把端了吗?

  今天,一位开发者@Lentils80意外发现,OpenAI已扩大Astra的内部测试,代号mozaik-alpha-fdm。

  最新放出的两个结果,全部来自Max effort模式下的零样本生成。

  一个是3D像素风格的城堡,另一个是前端网页,全部都是一次直出。

  与此同时,一大批拿到灰度资格的开发者们,同一时间放出了Astra首批测试。

  真正让开发者惊讶的,是它一次性管住了大量细节:统一的视觉语言、复杂元素之间的空间关系、页面层级,以及交互所需的代码结构。

  有人看完直接宣布,“Frontend is solved”!

  大家一致预测,也就是下周四(9月3日)前后,Astra将正式面世,与Fable 5.1正面硬刚。

  总结来说,Astra将具备以下强大的能力——

  前端非常强大,0样本一次生成

  端到端训练的多Agent编排,轻松驾驭超长周期任务;

  “持久”推理模式,还能即时自我修正。

  一句话生成3D网页 Astra前端“封神”

  要知道,前端一直是大模型的老大难。

  后端逻辑写得再溜,一到生成UI就露馅,比如,臃肿的CSS、辣眼的配色....

  而这一次,Astra在零样本条件下展现出的细节把控力,确实让人看到了质变的苗头。

  这个可交互的3D等距(isometric)王国地图,需要AI同时搞定几何透视、图层堆叠、动态交互和视觉一致性。

  开启最大思考程度,Astra可以做到一次成型。

  在Max模式下,Astra模型往往比Sol思考得更多,但从下面的输出可以看出,它对细节的关注度极高。

  它生成的一艘宇宙飞船,各种细节、构造非常逼真。

  另一位开发者MeSun,直接用Astra搓了个带有物理效果的3D自行车测试网页(HTML),连车身比例都能随意调整。

  再让它生成一个3D第一人称Roguelike游戏,还要主打战斗爽感。

  结果人家同样“一把过”,一次就给搞定了。

  看完一波Astra惊艳的演示,有爆料大咖甚至喊出,这是历史上第一次,“想法”开始碾压“执行”。

  “你能想到的,AI就能给你做出来”。

  永久智能体 四大技术内核扒光

  为什么Astra的前端能力会,一夜之间脱胎换骨?

  结合目前泄露的特征与行业预测,mozaik-alpha-fdm版本的核心技术突破可能集中在以下四个维度。

  首先是,端到端多智能体编排。

  Astra可能不再是一个单纯的“单体代码生成器”,而在底层原生集成了多智能体架构。

  比如让Codex处理编程任务,用另一个子模型处理自然语言查询,最后由主模型整合结果。

  在生成3D网页时,模型内部实际上并发运行了“UI设计师、前端工程师和代码审查员”,从而保证了布局、样式和逻辑的三位一体。

  这跟GPT-5.6中已经以beta形态推出的Multi-agent功能一脉相承,但Astra可能将其内化为“端到端训练”的原生能力。

  第二,超长程任务能力(Ultra Long-horizon Task)。

  以往模型在编写涉及多个组件和复杂CSS/JS联动的项目时,极易出现“遗忘”和“幻觉”。

  Astra展现出的完整度,证明其上下文窗口内的注意力机制得到了革命性优化,足以支撑从零构建复杂工程。

  从Astra解决十个数学问题的表现来看,它具备在极长时间跨度内维持推理一致性的能力。

  这对代码项目的持续开发、论文级别的研究任务、以及复杂工作流的自主执行都意义重大。

  第三,持久化推理模式(Persistent' Reasoning)。

  Astra在Max effort下的思考量显着超过Sol,这指向一种更“持久”的推理机制。

  模型不会一次性输出答案,而在内部反复验证、纠错、迭代,直到输出达到满意水平。

  这意味着它能“记住”当前DOM树的结构,在后续生成中保持设计语言和代码规范的绝对一致。

  第四,即时自我纠错。

  这是最可怕的一点,Astra可能在生成代码的同时,在内部沙盒中完成了“虚拟渲染”或AST语法树的逻辑跑通。

  自动发现了前端错位并完成了重构,最后才将完美的零样本结果呈现给用户。

  零样本就能复刻PS5手柄这种高细节渲染任务,本身就是自我纠错能力的间接证据。

  9月首周 正面硬刚Fable 5.1

  不过,好戏还在后头。

  就在这一周,Anthropic也被曝正在加速推进Fable 5.1。

  更巧的是,它的发布时间窗口,恰好也卡在Astra前后。

  从灰度测试者放出的反馈来看,Fable 5.1这次升级的重点,几乎和Astra撞了个正着:

  前端代码更稳,复杂组件逻辑可以一次成型;

  长思维链推理更强,不容易推着推着就“忘了前提”;

  工具调用和分步规划进一步强化,越来越接近一个成熟的AI Agent。

  也就是说,两家公司已经杀进了同一块战场:代码能力要更强,任务要跑得更久,过程中还得尽量少让人接手。

  现在,两边甚至已经开始隔空PK。

  同样生成一张“女子自画像”SVG矢量图,左边是Astra,右边是Fable 5.1。

  到底谁的细节更稳、结构更干净、一次生成完成度更高,已经可以直接摆到台面上比了。

  但真正可能决定胜负的,或许还不只是模型能力。

  从爆料来看,Astra除了性能强悍,还可能在性价比上继续往下压。

  如果OpenAI真能以更低的API调用成本,交付一款自带Max effort、自纠错能力更强、又不需要复杂工程编排的模型,那么Fable 5.1面对的,就不只是Benchmark上的压力。

  下周四,巅峰之战。到底谁能拿下新王宝座,拭目以待。

  参考资料:

  https://x.com/pankajkumar_dev/status/2093623079192891882

  https://x.com/lentils80/status/2093617080327127456

  本文来源:新智元

版权说明 / Copyright Notice:
Content and images in this article may originate from third-party sources and are used for news reporting, commentary, or public interest purposes. All copyrights remain with their respective owners. Please refer to the Copyright Notice at the bottom of this page.
本文内容仅供信息参考,不代表倍可亲立场或观点。

评论 (0)