OpenAI最强编程模型登场!连续干活24小时,一次处理几百万token_每日快讯(日常热点指南)

OpenAI最强编程模型登场!连续干活24小时,一次处理几百万token


OpenAI最强编程模型登场!连续干活24小时,一次处理几百万token

  2025-11-22 00:16:10     简体|繁體
http://news.qghjm.com/1182026.html

炒股就看金麒麟分析师研报,权威,专业,及时,全面,助您挖掘潜力主题机会!

(来源:智东西)

智东西

作者陈骏达

编辑心缘

智东西11月20日报道,今天,OpenAI发布了其最新的智能体编程模型GPT‑5.1‑Codex‑Max,这一模型基于OpenAI最新的推理模型打造,专门面向软件工程、研究、数学等复杂任务进行训练。

与此同时,OpenAI还将GPT-5Pro升级为GPT-5.1Pro,据说这一模型在写作、数据分析等方面的能力比前一代模型更强。不过,OpenAI并未披露更多GPT-5.1Pro的细节。

GPT‑5.1‑Codex‑Max能在单一任务中连贯地处理上百万个token,跨多个上下文窗口运行。这得益于一项叫做压缩(compaction)的技术:模型在接近上下文窗口限制时会自动压缩上下文,保留重要信息,并赋予对话新的上下文窗口,直到任务完成。

这一模型是由OpenAI研究科学家NoamBrown牵头完成的,他在OpenAI专门从事测试时计算,也就是推理的研究。

OpenAI认为,能够持续进行连贯工作,是迈向更通用、更可靠AI系统的基础能力。GPT-5.1-Codex-Max可以独立工作数小时。在OpenAI的内部评估中,GPT-5.1-Codex-Max甚至可以针对同一任务连续工作24小时,持续迭代实现,修复测试失败,最终交付成功的结果。

性能方面,GPT‑5.1‑Codex‑Max在多个编程基准测试中评测优于前代GPT‑5.1‑Codex。该模型还是OpenAI训练的首个适用于在Windows环境里进行编程操作的模型。

推理效率上,GPT‑5.1‑Codex‑Max在中等推理强度下完成任务时,所使用的思考token比GPT‑5.1‑Codex少约30%,但仍能取得更高准确性。

对于不那么敏感延迟但追求质量的任务,还可以开启超高强度推理,让模型花更多时间思考,输出更优解。

OpenAI预计,这种token效率的提升,可以为开发者带来实际的成本节省。

▲GPT‑5.1‑Codex‑Max用更少token实现更高的准确率

目前,GPT-5.1-Codex-Max现已在Codex中提供,可用于CLI、IDE扩展、云端和代码审查,API访问也即将推出。

OpenAI分享了GPT-5.1-Codex-Max打造的多个网页。根据提示词,GPT-5.1-Codex-Max直接打造了一个完全运行在浏览器中的CartPole(倒立摆)强化学习沙箱。

用户不仅可以观看倒立摆的动态,还能通过内置的策略梯度控制器直接训练模型,让AI在实验中不断优化策略。

它提供了神经网络可视化功能,在训练或推理时,用户可以实时观察模型的权重和激活状态,直观理解决策机制。

此外,应用界面清晰展示了每个回合的步数和奖励,并记录了上一次存活时间及历史最佳存活时间,让训练过程和成果一目了然。

在成功实现类似功能的前提下,GPT-5.1-Codex-Max所使用的token数量为27k,而GPT-5.1-Codex的用量为37k。

GPT-5.1-Codex-Max还开发出一个太阳系重力的模拟器。这一应用的目标是让用户直接观察天体的运动轨迹,通过拖拽、点击与操控界面元素,直观理解轨道、速度与引力之间的关系。

这一网页的功能运行流畅,提示词中的功能都得到了不错的实现。用户可点击画布放置带质量的天体,再次点击即可为测试设置初速度向量,借此构建出任意的简易行星系统。

界面提供用于调节中心天体质量与整体时间缩放因子的滑块,允许用户观察同一轨道结构在不同物理条件下的演化过程。

GPT-5.1-Codex-Max打造的下一个案例,可帮助用户直观、动态的方式理解光在两种介质界面上的折射规律——斯涅尔定律(Snell’sLaw)。

用户可以通过左右滑块调节介质1与介质2的折射率。折射率改变时,界面实时更新折射角度,呈现不同光学环境下的光线偏折情况。

也有不少网友分享了自己的使用体验。这位网友试着让昨天发布的Gemini3Pro和GPT-5.1-Codex-Max对决,提示词是创建一个鹈鹕骑自行车的SVG。

可以看到,GPT-5.1-Codex-Max打造的鹈鹕、自行车等元素明显包含更多细节,也更逼真。

英国定制化贺卡公司Moonpig的AI部门负责人PeterGostev分享,自己试着让GPT-5.1-Codex-Max打造了一个金门大桥模拟器,他称这绝对是自己从类似提示词中获得的最好的效果。

与GPT-5.1-Pro相比,Gostev认为GPT-5.1-Codex-Max明显更勤快,而且速度也更快。要让GPT-5.1-Pro完成类似的效果,需要不断指出问题,给出明确要求,GPT-5.1-Codex-Max则更有主动性。

AI工程师PeterDedene分享,自己体验时发现,GPT-5.1-Codex-Max盯着问题看了5分钟,决定以后再处理,自己以前从没见过Codex这么做。在他看来,模型似乎已经拥有意识了。

不过,需要注意的是,随着模型能力的持续提升,安全性也成为一大挑战。OpenAI称GPT-5.1-Codex-Max尚未在内部的PreparednessFramework中达到“高等级网络安全能力”,不过其安全能力已经是业内迄今为止最强大的。

目前,Codex系列模型默认运行在高度隔离的安全沙箱中,文件写入仅限自身工作空间,网络访问被关闭,除非开发者主动启用。这些措施可减少提示词注入(promptinjection)等风险。

OpenAI希望通过渐进式部署的方法从真实世界收集反馈,并及时更新模型的安全防护。

结语:编程模型正在走向“智能体化”时代

从GPT-5.1-Codex-Max可以看出,新一代编程模型已不再是简单的代码生成器,而是能够持续工作、自动调试、主动规划的编程智能体。其长时推理、上下文压缩、自我修复等能力,让模型能独立完成项目级任务。

随着运行成本下降、安全沙箱强化、能力全面增强,未来的软件开发方式也可能出现变化,从“写代码”转向“描述需求+审核结果”,智能体有望承担更多实现与迭代工作。

海量资讯、精准解读,尽在新浪财经APP

编辑:财经 来源:市场资讯

免责声明:以上文章内容信息均搜集自互联网或用户发布,并不代表本站观点或立场,本站不对其真实合法性负责。如有信息侵犯了您的权益,请联系本站将立即删除。
分享到:

  • 上一篇
    下一篇

  • 今日要闻|实事关注

    每日快讯(日常热点指南)
    手机查看(二维码扫一扫)

    每日快讯网为您提供最新的行业简讯、新闻报道,以及今日热点内容,重大事件等实时资讯,24小时不间断播报,让您获得最新行业信息。
    « 2024年 » « 10月 »
    123456
    78910111213
    14151617181920
    21222324252627
    28293031

    最新资讯

    兰花实业产品抽检不合格,实控人张冕持股超四成
  • 2025-11-27 07:53:17

     

    重要成果!稀土,大消息!
  • 2025-11-27 07:45:10

     

    万亿美元市值蒸发!“币灾”来袭,特朗普家族财富缩水超10亿美元
  • 2025-11-27 07:37:05

     

    湖南益阳警方通报:王某网名“嘉宝”发布不当言论 被行拘15日
  • 2025-11-27 07:28:58

     

    南宁铁路通报:一成人旅客跳入股道与动车发生碰撞受伤 相关部门已介入调查
  • 2025-11-27 07:20:52

     

    治愈值拉满!房东的猫 12 周年音乐会圆满结束,《世界 / 青年》live 解锁老歌新体验
  • 2025-11-27 07:12:46

     

    第五届亚洲国际青年电影节落幕,演员胡悦凭《想被你看见》双丰收实力与积淀铸就荣耀
  • 2025-11-27 07:04:40

     

    中国入境游客量同比激增超100%,企查查:相关企业多集中一线城市
  • 2025-11-27 06:56:34

     

    国寿鑫稳盈两全保险(分红型)多久回本?关键注意事项有哪些?
  • 2025-11-27 06:48:28

     

    [代运营托管]本地推高反点开户14+,教育{职培,学历}汽后,摄影,口腔,假发,综法
  • 2025-11-27 06:40:22

     

    [代运营托管]痛风 耳鸣 甲状腺肠胃 肺结节痔疮 肺部 肝病 眼病 糖尿病血糖 咳喘 小病种加粉
  • 2025-11-27 06:32:15

     

    [开户代运营]抖音本地推汽车后市场、心理咨询可辅助报白抖音汽车、房产全国可开
  • 2025-11-27 06:24:10

     

    [开户代运营]快手一代高安徽招商加盟,回收,法律等,高政策,欢迎渠道,二代咨询
  • 2025-11-27 06:16:03

     

    [开户代运营]凤凰搜狐新浪网易喜马各种电商加粉户,带运营
  • 2025-11-27 06:07:57

     

    [开户代运营]理财培训、私密、nk大健康、法律、骨科、体检、妇产、心理咨询、AI剪辑等各种户;
  • 2025-11-27 05:59:51