OpenAI“去英伟达化”首个试验品退役 模型行业进入快速淘汰期

第一财经 09-13 03:08

OpenAI正在加速淘汰早期模型。近日,OpenAI Codex负责人Tibo (蒂博·索蒂奥,Thibault Sottiaux)宣布,GPT-5.3-Codex-Spark将在下周退役。

这款今年2月发布的实验性编程模型,生命周期不足八个月,也成为OpenAI探索Cerebras晶圆级芯片推理路线后首个被淘汰的模型。

GPT-5.3-Codex-Spark于2月12日以研究预览形式推出,定位明确:它是一款更小、更快、专门服务于实时交互式编程的模型,适用于代码编辑、局部修改和定向测试等场景。

Spark最特殊之处并非速度,而是运行它的硬件。它采用Cerebras WSE-3晶圆级处理器,是OpenAI首次将生产环境中的模型推理部署到英伟达GPU之外的芯片平台。

Cerebras将大量计算单元和片上SRAM(静态随机存储器)集成在整张晶圆上,减少传统GPU系统中模型权重在计算芯片与外部内存之间反复搬运带来的延迟,因此尤其适合低延迟推理。

这一尝试发生在OpenAI扩大算力供应商范围的背景下。2026年1月,OpenAI宣布与Cerebras达成多年合作,将部署最多750MW(兆瓦)的Cerebras推理算力。Cerebras随后披露的金额超过200亿美元,算力将在2028年前分阶段上线。因此,该合作也被视为OpenAI降低对单一GPU供应体系依赖、建立多元算力组合的一次尝试。

但速度优势并未转化为用户留存。Spark定位为轻量化实时编程分支,仅向ChatGPT Pro用户开放,用于Codex客户端、CLI命令行和VS Code插件场景。开发者反馈两极分化:有人认为它在重构等机械性任务上“速度非常快”,也有开发者称“Spark是个好玩的模型,也是个极度糟糕、根本没法用的模型”。

缺点迅速被新模型填补。8月,OpenAI发布GPT-5.6 SolUltrafast模式,同样由Cerebras提供底层推理能力,输出速度最高达到750 token/s。与Spark不同,Ultrafast运行的是完整的GPT-5.6 Sol,而不是为了速度专门压缩的小模型。

Spark发布时,当时的技术与工程能力仅能支持实时编程在模型能力和响应速度之间取舍。而到了GPT-5.6 Sol Ultrafast,OpenAI试图同时获得两者。Cerebras也将这一变化概括为过去AI产品长期存在的“速度与智能二选一”正在被打破。

Spark因此失去了继续独立存在的必要性。对于一个使用范围较窄、需要单独适配和运营的实验性模型而言,如果更强的主力模型已经能够在同一硬件平台上提供足够快的响应,继续维护旧模型的产品价值自然下降。

这也意味着模型行业进入快速淘汰期。过去,大模型迭代往往以半年甚至数年的版本周期为主;如今,模型产品越来越接近互联网软件的持续实验模式:先针对特定场景推出一个模型,验证速度、成本和用户需求,再把成功的技术路线迁移到下一代主力模型,最后迅速淘汰旧版本。

(文章来源:第一财经)

文章来源:第一财经
文章作者:吕倩
原标题:OpenAI“去英伟达化”首个试验品退役,模型行业进入快速淘汰期
郑重声明:东方财富发布此内容旨在传播更多信息,与本站立场无关,不构成投资建议。据此操作,风险自担。
热点阅读
伊朗外长与美特使在纽约会晤 特朗普:美伊代表会谈“非常有建设性”
伊朗外长与美特使在纽约会晤 特朗普:美伊代表会谈“非常有建设性”
央视新闻 71评论
全球市场:美股三大指数涨跌不一 纳指创历史新高 费城半导体指数涨超2%
全球市场:美股三大指数涨跌不一 纳指创历史新高 费城半导体指数涨超2%
东方财富Choice数据 33评论
最新公告!中金公司今日复牌 东兴证券、信达证券将终止上市
最新公告!中金公司今日复牌 东兴证券、信达证券将终止上市
券商中国 35评论
以正确相处之道推动中美关系行稳致远
以正确相处之道推动中美关系行稳致远
央视新闻 9评论
打开东方财富APP查看更多内容
24小时点击排行
国资委唯一亲儿子,被美国高盛、北向资金联手加仓锁定,手握103现金低估真龙迎来价值重估?
9月22日社保基金重仓进入前十大股东,股价暴涨的股票名单:
操作丨A股冲高再回落!分歧持续加大,是走是留?划重点了!
加仓843%——美国摩根、高盛、北向锁定国资委唯一亲儿子,芯片唯一低估真龙藏不住了?
深夜15股提前发三季报,6股高增长,2股下滑2股亏损,别踩雷
点击查看更多内容
写评论 ...