猫眼电影
猫眼电影记者 陈瑶光 报道首次登录送91元红包
财联社12月12日讯(编辑 史正丞)被谷歌逼到拉响“红色警报”后,OpenAI周四终于端出了最新前沿模型GPT-5.2系列。
图为OpenAI官网截图
OpenAI介绍称,GPT‑5.2是迄今为止在“专业知识工作方面”表现最好的模型系列,在制作电子表格、制作演示文稿、图像感知、编写代码以及理解长上下文等方面都优于前代产品。
GPT‑5.2有三种不同的版本:Instant是针对常规查询(如互联网检索、翻译和写作)进行速度优化的模型;Thinking擅长编程、数学、长文档分析等复杂结构化工作;顶级型号Pro,旨在为棘手问题提供最大程度的准确性和可靠性。
OpenAI特别强调,GPT‑5.2 Thinking是迄今为止最适合现实世界专业用途的模型。在评估涵盖44个职业的知识型工作任务的GDPval测试中,有70.9%的对比结果优于或持平于顶尖行业专业人士,这些任务包括制作销售演示文稿、会计电子表格、制造流程图或短视频等。
在评估涵盖44个职业的知识型工作任务的GDPval测试中,有70.9%的对比结果优于或持平于顶尖行业专业人士
另外在金融AI领域,GPT‑5.2Thinking的产出成果也明显好于GPT-5.1。
OpenAI给出的示例显示,GPT‑5.2 Thinking在制作人力资源规划模型、股权结构表和项目管理表格的任务中,产出成果较GPT‑5.1 Thinking有肉眼可见的进步。
OpenAI给出的示例
除了做PPT和Excel表格外,OpenAI也表示,GPT-5.2在编码、数学、科学、视觉、长文本推理以及工具使用等方面均刷新了基准成绩。公司称,这些能力的提升将有望带来“更可靠的代理式工作流程、可用于生产环境的代码,以及能够在大规模上下文和真实世界数据中运行的复杂系统”。
横向比较方面,GPT-5.2 Thinking在几乎所有列出的推理测试中都略胜于Gemini 3和Anthropic的Claude Opus 4.5,涵盖现实世界的软件工程任务(SWE-Bench Pro)和博士级别的科学知识(GPQA Diamond),到抽象推理和模式发现(ARC-AGI套件)。
GPT-5.2 Thinking在几乎所有列出的推理测试中都略胜于Gemini 3和Anthropic的Claude Opus 4.5
OpenAI产品负责人Max Schwarzer也在周四通报称,GPT-5.2 Thinking的回复较前代减少了38%的错误,使该模型在日常决策、研究和写作中更为可靠。
从周四开始,GPT‑5.2将向所有ChatGPT付费用户和API用户推送。所以这个新模型到底有多么适合“打工”,很快就能见分晓。
作为OpenAI对谷歌的反击,GPT‑5.2仅仅是打出的“第一拳”。
公司CEO奥尔特曼在周四宣布,下周会给用户们带来一些“小小的圣诞礼物”。他也在周四表示,Gemini 3对公司各项指标的影响比原本担心得要小。他还说,预计OpenAI将在明年1月“以非常强劲的姿态”退出目前的红色警报状态。
图为奥尔特曼社媒发文截图
OpenAI首席产品官Fidji Simo也在周四透露,现在已经开始在部分地区推出年龄估算系统,此举旨在控制ChatGPT对18岁以下用户回复的内容。Simo也表示,公司希望在明年一季度推出“成人模式”前先引入这一功能。
略有遗憾的是,周四的新品发布似乎聚焦于新模型的推理能力,没有推出新的图像生成器。而今年以来,为数不多的几次现象级新品发布都与图像、视频生成产品有关。奥尔特曼的“红色警报”备忘录中,也提及要改善图像生成能力。
此前有报道称,OpenAI计划在明年1月再发布一款新模型,具有更好的图像能力和更完善的个性化特点,但公司周四未对这一传言予以确认。
时事1:
12月29日,中新健康|喝酒能缓解痛经?医生辟谣,在救援的过程中,不断发生的奇迹让我们感受到生命的顽强。当地时间9日1时30分,中国救援队与当地救援队通力合作,从一栋8层倒塌房屋废墟中成功营救出一名孕妇,这是中国救援队成功参与营救的首位幸存者。,。
12月29日,(乡村行·看振兴)山西忻州:大棚蔬菜采收忙 “芹”劳致富有奔头,今年5月,吕临华在《中国金融》杂志发表《科技金融浪潮下农商银行的探索》一文指出,浙江农商银行系统立足浙江民营经济大省和杭州市、嘉兴市科创金融改革试验区,在推动科技金融发展、助力浙江高质量发展建设共同富裕示范区中形成了“四专一生态”科技金融服务体系。,,,。
时事2:
12月29日,中国专家谈AI未来:不是代替人,而是成为新的“纸和笔”,考克斯汽车行业洞察总监斯蒂芬妮・巴尔德斯・斯特里蒂表示:‘汽车电动化的长期发展方向依然明确:未来终将是电动化的时代。但行业的发展节奏,正迎来重新校准。短期内,车企会持续调整战略,大幅扩充混动车型的产品阵容,以此贴合当下消费者的真实需求。’,,,。
12月29日,多部门以“雪”为令协同联动保畅通、保民生 全力护航百姓生产生活平稳有序,投资人急了!海辰储能IPO二度折戟,六年独角兽的上市“悬了”?,,,。
时事3:
12月29日,关注巴以局势 以色列开始在东部边境建设安全隔离墙,昨天,华北、黄淮等地的高温过程仍处于鼎盛阶段,据实况监测显示,陕西中北部、山西中南部、河北中南部、天津中部、山东中西部、河南大部、苏皖北部、湖北中部、湖南西北部等地部分地区出现35~39℃高温天气,陕西关中、山西南部、河北南部、山东西部、河南北部局地40~43.4℃,山西、山东、河南、河北有14个国家气象观测站日最高气温突破建站以来历史极值。,,,。
12月29日,天津统一战线踊跃支援香港火灾救援 展现血浓于水同胞情,草案二审稿明确,从事跨境电子商务零售进口的电子商务平台经营者、物流企业和报关企业,以及法律、行政法规规定负有代扣代缴、代收代缴关税税款义务的单位和个人,是关税的扣缴义务人。,,,。
时事4:
12月29日,中新人物 | 24年了,谁在等待田震?,除广东、福建外,多个省份的省级党政“一把手”以暗访、调研、开会等方式部署防汛抗旱工作。,,,。
12月29日,匈总理反对利用被冻结俄方资产资助乌克兰,外包模式则依赖专业的第三方机构提供仓储、交割和物流服务,其核心价值在于交易效率、降低综合成本,并形成强大的市场流动性。,,,。
责编:刁文元
审核:韦小宝
责编:朱燕












