OpenAI最强AI智能体编程模型:GPT-5.3-Codex登场
IT之家 2 月 6 日消息,OpenAI 昨日(2 月 5 日)发布公告,宣布推出 GPT-5.3-Codex,宣称这是其迄今最强的 AI 智能体编程模型。
IT之家附上相关基准测试结果如下:
在 SWE-bench Pro(公开版)测试中,该模型得分 56.8%,超越了前代的 56.4%;在 Terminal-Bench 2.0 测试中,其得分从前代的 64.0% 大幅跃升至 77.3%;最为显著的是在 OSWorld-Verified 智能体计算机操作基准测试中,得分从 38.2% 飙升至 64.7%,表明其在复杂环境下的操作能力实现了质的飞跃。官方数据显示,该模型不仅在多项编程基准测试中创下新高,运行速度也比前代 GPT-5.2-Codex 提升了 25%。
OpenAI 致力于将 GPT-5.3-Codex 打造为更优秀的开发者协作工具。新模型支持用户在任务执行过程中进行“引导与交互”,且不会导致上下文丢失。
在 Codex 应用中,模型会高频更新工作进度,允许开发者实时提问、讨论方案并修正方向。官方博文指出,Codex 正从单一的编程智能体演变为更通用的计算机协作者,大幅降低了构建应用的门槛。
GPT-5.3-Codex 目前已全面向 ChatGPT 付费用户开放,涵盖 Plus、Team 及 Enterprise 等订阅计划。用户可通过 Codex 应用、命令行工具(CLI)、IDE 扩展插件及网页端立即访问,API 版本也将在近期上线。
延伸阅读:
长安汽车全球炼车季硬核开幕 钠锂双星开启新能源新格局
2026年2月5日,长安汽车(000625.SZ)在内蒙古牙克石举办天枢智能新安全成果发布暨钠电战略全球发布会,发布天枢...
苹果iPhone Fold搭载顶级薄膜材料:耐用度直接拉满
快科技2月6日消息,为了在折叠屏市场实现差异化,苹果正为其首款折叠手机iPhone Fold评估一种韧性更强的薄膜技术。...
新上海人的故事 ∣ 曾宪宇:一个航天人的“常态”
TELL+DREAM是TELL公众演讲会与虹梅街道、漕河泾开发区共同举办的演讲活动,全方位展现了各行各业劳动者的风采。在...
AI巨头中“烧钱最猛”!亚马逊(AMZN.US)盈利引担忧:今年支出指引2000亿美元远超预期,AWS增利不如意
智通财经APP获悉,亚马逊(AMZN.US)公布了第四财季业绩。Q4营收同比增长14%至2134亿美元,高于市场普遍预期...
