每秒千词实时编程!OpenAI与Cerebras推出GPT-5.3-Codex-Spark模型

2026年02月13日12:20:23 科技 4572

 该图片疑似ai生成每秒千词实时编程!OpenAI与Cerebras推出GPT-5.3-Codex-Spark模型 - 天天要闻

ai编程工具已成为开发者日常工作里的重要助手,但生成代码时的等待延迟始终是影响效率的一大痛点——传统模型每秒仅能生成几十tokens,开发者输入需求后往往要等数秒甚至数十秒才能收到反馈,这不仅拖慢开发节奏,更可能打断连贯的编程思路。

近日,openai与ai芯片巨头cerebras联手推出gpt-5.3-codex-spark模型,专为实时编程场景做了深度优化,最大亮点是突破了推理速度的瓶颈,实现每秒1000tokens的生成能力,让ai编程反馈和开发者思路同步成为可能。

该模型的发布正是为了解决ai编程中的“等待焦虑,回应开发者对实时交互的迫切需求。

gpt-5.3-codex-spark的超高速性能背后离不开cerebras晶圆级引擎(wse)技术的支撑——这款全球最大的ai芯片集成了数万亿晶体管,采用单晶圆设计,彻底消除了多芯片集群间的通信延迟,能以极高的并行计算能力处理大规模模型的推理任务。

同时,openai针对编程场景对模型做了专项优化:一方面调整了tokenization策略,优先高效处理代码相关的语法结构和关键词;另一方面简化了部分非必要的推理步骤,在保证代码准确性的前提下进一步压缩响应时间。

对开发者来说,这种实时反馈能力将彻底重塑编程体验。比如编写复杂算法时,输入问题描述后模型能在1秒内生成完整的代码片段和注释;调试代码时,输入错误信息就能立刻得到修复建议。

这种即时性不仅能大幅提升开发效率,还能帮助开发者维持连贯的思维状态,减轻认知负担。目前该模型已向部分企业客户开放测试,预计2026年第二季度全面上线,届时会整合到主流ide插件和在线编程平台中。

行业内其他玩家也在加速布局。

据报道,全球代码托管平台gitlab计划2026年第三季度推出基于自有模型的实时编程助手,目标速度达800tokens/s,重点优化分布式系统代码的生成能力;google deepmind旗下alphacode 2.5已于2026年1月更新,通过优化tpu集群架构将推理速度提升至750tokens/s,还新增了python和java的实时调试功能。

此外,anthropic的claude 3.1-code模型则聚焦代码安全性检测,虽然速度只有600tokens/s,但在代码漏洞识别准确率上比行业平均水平高出15%,能为开发者提供更可靠的代码质量保障。(本文首发钛媒体app , 作者|agi-signal,编辑|秦聪慧) 

更多精彩内容,关注钛媒体微信号(id:taimeiti),或者下载钛媒体app

科技分类资讯推荐

引领科技豪华MPV新风尚 第二代腾势D9西安车展亮相 - 天天要闻

引领科技豪华MPV新风尚 第二代腾势D9西安车展亮相

兼具宜商气度与家用温情的科技豪华旗舰MPV,第二代腾势D9迎来西安地区正式亮相。新车依托全球新能源MPV冠军底蕴,以第二代刀片电池、双阀云辇-C、天神之眼5.0智驾等核心技术全面升级,兼顾商务体面与家庭舒适,为西北高端用户带来一站式全能出行解决方案。
采购禁入!科华数据材料造假被拒门外 - 天天要闻

采购禁入!科华数据材料造假被拒门外

本报(chinatimes.net.cn)记者胡雅文 北京报道这家赶上AI算力风口的公司,因投标材料造假,被相关采购方列入禁入名单两年,其此前提出的复议申请也被正式驳回。相关采购平台近日发布公告,明确驳回科华数据股份有限公司(下称“科华数据”,002335.SZ)此前提交的复议申请。早在一年前,科华数据已被认定在“信息通信枢纽...
快评乐道L80:15万元级买大五座,这波值得冲? - 天天要闻

快评乐道L80:15万元级买大五座,这波值得冲?

日前,乐道L80正式发布并开启预售,其整车购买预售价为24.58万元起,租电购买预售价则低至15.98万元起。面对大型SUV市场“细分再细分”之竞争趋势,这款乐道年度重磅新车都有哪些优势?又能否成为“大五座SUV革新之作”?下面,圈哥就带大家全方位感受。
成都直击凯威德:纯电全尺寸SUV的张扬与大气 - 天天要闻

成都直击凯威德:纯电全尺寸SUV的张扬与大气

4月22日,凯迪拉克以奥斯卡级盛典规格,将上海保利大剧院点亮为璀璨舞台,在品牌代言人倪妮与全场嘉宾的共同见证下,凯迪拉克全尺寸纯电公路旗舰——凯威德耀然上市。新车共推出长续航四驱Pro、高性能四驱Ultra两款配置,官方售价区间为46.88万-50.88万元。