猫眼电影
猫眼电影记者 钱志成 报道首次登录送91元红包
财联社12月12日讯(编辑 史正丞)被谷歌逼到拉响“红色警报”后,OpenAI周四终于端出了最新前沿模型GPT-5.2系列。
图为OpenAI官网截图
OpenAI介绍称,GPT‑5.2是迄今为止在“专业知识工作方面”表现最好的模型系列,在制作电子表格、制作演示文稿、图像感知、编写代码以及理解长上下文等方面都优于前代产品。
GPT‑5.2有三种不同的版本:Instant是针对常规查询(如互联网检索、翻译和写作)进行速度优化的模型;Thinking擅长编程、数学、长文档分析等复杂结构化工作;顶级型号Pro,旨在为棘手问题提供最大程度的准确性和可靠性。
OpenAI特别强调,GPT‑5.2 Thinking是迄今为止最适合现实世界专业用途的模型。在评估涵盖44个职业的知识型工作任务的GDPval测试中,有70.9%的对比结果优于或持平于顶尖行业专业人士,这些任务包括制作销售演示文稿、会计电子表格、制造流程图或短视频等。
在评估涵盖44个职业的知识型工作任务的GDPval测试中,有70.9%的对比结果优于或持平于顶尖行业专业人士
另外在金融AI领域,GPT‑5.2Thinking的产出成果也明显好于GPT-5.1。
OpenAI给出的示例显示,GPT‑5.2 Thinking在制作人力资源规划模型、股权结构表和项目管理表格的任务中,产出成果较GPT‑5.1 Thinking有肉眼可见的进步。
OpenAI给出的示例
除了做PPT和Excel表格外,OpenAI也表示,GPT-5.2在编码、数学、科学、视觉、长文本推理以及工具使用等方面均刷新了基准成绩。公司称,这些能力的提升将有望带来“更可靠的代理式工作流程、可用于生产环境的代码,以及能够在大规模上下文和真实世界数据中运行的复杂系统”。
横向比较方面,GPT-5.2 Thinking在几乎所有列出的推理测试中都略胜于Gemini 3和Anthropic的Claude Opus 4.5,涵盖现实世界的软件工程任务(SWE-Bench Pro)和博士级别的科学知识(GPQA Diamond),到抽象推理和模式发现(ARC-AGI套件)。
GPT-5.2 Thinking在几乎所有列出的推理测试中都略胜于Gemini 3和Anthropic的Claude Opus 4.5
OpenAI产品负责人Max Schwarzer也在周四通报称,GPT-5.2 Thinking的回复较前代减少了38%的错误,使该模型在日常决策、研究和写作中更为可靠。
从周四开始,GPT‑5.2将向所有ChatGPT付费用户和API用户推送。所以这个新模型到底有多么适合“打工”,很快就能见分晓。
作为OpenAI对谷歌的反击,GPT‑5.2仅仅是打出的“第一拳”。
公司CEO奥尔特曼在周四宣布,下周会给用户们带来一些“小小的圣诞礼物”。他也在周四表示,Gemini 3对公司各项指标的影响比原本担心得要小。他还说,预计OpenAI将在明年1月“以非常强劲的姿态”退出目前的红色警报状态。
图为奥尔特曼社媒发文截图
OpenAI首席产品官Fidji Simo也在周四透露,现在已经开始在部分地区推出年龄估算系统,此举旨在控制ChatGPT对18岁以下用户回复的内容。Simo也表示,公司希望在明年一季度推出“成人模式”前先引入这一功能。
略有遗憾的是,周四的新品发布似乎聚焦于新模型的推理能力,没有推出新的图像生成器。而今年以来,为数不多的几次现象级新品发布都与图像、视频生成产品有关。奥尔特曼的“红色警报”备忘录中,也提及要改善图像生成能力。
此前有报道称,OpenAI计划在明年1月再发布一款新模型,具有更好的图像能力和更完善的个性化特点,但公司周四未对这一传言予以确认。
时事1:完美体育官网注册
12月26日,北京气温大幅跳水,卢鼎亮认为,中国汽车企业可以根据WTO的补贴和反补贴措施协议,提起贸易争端的纠纷解决机制,政府和相关协会机构也可以进行磋商谈判。,澳门钱柜平台官方。
12月26日,四川党外知识分子学习《条例》:从学深悟透到笃行实干,对于即将在西安召开的“中国-中亚”峰会,中亚国家表态积极,而俄罗斯表示认可。,投注网世界杯,老葡京娱乐开户,美高梅官网登录。
时事2:网赌十大排行榜
12月26日,2026澳网亚太区外卡赛男单决赛:中国选手布云朝克特夺冠,当地媒体此前分析指出,佛山进出口下降,国外市场需求疲软是客观因素,但也有城市自身产业结构的原因——佛山以机械设备、家电出口为主,“产业链转移对于佛山劳动密集型产品的出口造成较大挑战,国外市场对传统产业产品的采购有所减少”。,顶尖现金游戏娱乐,足球买滚球软件,正版输尽光。
12月26日,迈向“十五五”美丽图景·一线见闻 失能等级评估 拧紧长护险“水龙头”,银行业理财登记托管中心发布的《中国银行业理财市场季度报告(2025年三季度)》(下称《报告》)显示,截至2025年三季度末,未设立理财子公司的银行存续理财规模为2.85万亿元,同比下降28.01%;就机构数量而言,仍有存续理财产品的银行机构为181家,环比减少13家。这显示未设立理财子公司的部分中小银行在政策影响下,着手清理主营理财业务。,伟德最新官网,k8真人,爱体育登录首页。
时事3:百人抢庄牛牛
12月26日,黑龙江省绥化市人大常委会原副主任宋树生被开除党籍,报道说,该网友当时立刻打电话到派出所报警,警员说便利店附近没有监控器,虽然无法知道是谁窃取她的鸡蛋,但可以协助她再买两盒蛋,她听完后立刻拒绝,“是我自己没用,请警员帮忙买蛋感觉是浪费警力吧!”,金沙9570网址,天博综合体育官方网站,九五至尊怎么注册。
12月26日,东西问丨韩俊友:为何一粒种子可以改变世界?,演练中各艇依次展开编队运动、大角度转向,情报侦察与电子防御等课目训练。此次训练,立足复杂条件淬炼兵力。突出指挥控制、人员协同配合、应急情况处置。发现解决疑难杂症,检验武器装备性能的同时进一步提升部队能战胜战能力。,M6直播视讯,竞彩足球彩票app,女足世界杯买球平台。
时事4:亿万先生手机版下载
12月26日,福建南平邀台胞共同打造“武夷茗宿”品牌,总台CGTN记者孙晔说:“对于您文章中所称的内容,美国政府官员予以否认。对于美国官方的否认,您是否会有一些回应,您是否还会发布其他消息以证实您的说法?”,万博在哪里玩,韦德体育体育平台,365bet体育在线滚球信誉。
12月26日,上海打通智能网联汽车跨区和跨省通行,腾讯视频在2024年底就启动了鸿蒙版App的开发工作,也是第一批投入鸿蒙生态的伙伴。这一年以来,腾讯视频鸿蒙版已经历经了数十个版本迭代。,新宝6达七九九47,澳门百老汇会员注册,世界杯手机上如何买球。
责编:关东客
审核:唐昊
责编:林映文












