搜索 猫眼电影 融媒体矩阵
  • 山东手机报

  • 猫眼电影

  • 大众网官方微信

  • 大众网官方微博

  • 抖音

  • 人民号

  • 全国党媒平台

  • 央视频

  • 百家号

  • 快手

  • 头条号

  • 哔哩哔哩

首页 >新闻 >社会新闻

GPT-5.2发布 OpenAI称其为"最强专业知识工作大模型"

2025-12-22 19:33:24
来源:

猫眼电影

作者:

吉某玉

手机查看

  猫眼电影记者 洛桑次仁 报道首次登录送91元红包

财联社12月12日讯(编辑 史正丞)被谷歌逼到拉响“红色警报”后,OpenAI周四终于端出了最新前沿模型GPT-5.2系列。

图为OpenAI官网截图

OpenAI介绍称,GPT‑5.2是迄今为止在“专业知识工作方面”表现最好的模型系列,在制作电子表格、制作演示文稿、图像感知、编写代码以及理解长上下文等方面都优于前代产品。

GPT‑5.2有三种不同的版本:Instant是针对常规查询(如互联网检索、翻译和写作)进行速度优化的模型;Thinking擅长编程、数学、长文档分析等复杂结构化工作;顶级型号Pro,旨在为棘手问题提供最大程度的准确性和可靠性。

OpenAI特别强调,GPT‑5.2 Thinking是迄今为止最适合现实世界专业用途的模型。在评估涵盖44个职业的知识型工作任务的GDPval测试中,有70.9%的对比结果优于或持平于顶尖行业专业人士,这些任务包括制作销售演示文稿、会计电子表格、制造流程图或短视频等。

在评估涵盖44个职业的知识型工作任务的GDPval测试中,有70.9%的对比结果优于或持平于顶尖行业专业人士

另外在金融AI领域,GPT‑5.2Thinking的产出成果也明显好于GPT-5.1。

OpenAI给出的示例显示,GPT‑5.2 Thinking在制作人力资源规划模型、股权结构表和项目管理表格的任务中,产出成果较GPT‑5.1 Thinking有肉眼可见的进步。

OpenAI给出的示例

除了做PPT和Excel表格外,OpenAI也表示,GPT-5.2在编码、数学、科学、视觉、长文本推理以及工具使用等方面均刷新了基准成绩。公司称,这些能力的提升将有望带来“更可靠的代理式工作流程、可用于生产环境的代码,以及能够在大规模上下文和真实世界数据中运行的复杂系统”。

横向比较方面,GPT-5.2 Thinking在几乎所有列出的推理测试中都略胜于Gemini 3和Anthropic的Claude Opus 4.5,涵盖现实世界的软件工程任务(SWE-Bench Pro)和博士级别的科学知识(GPQA Diamond),到抽象推理和模式发现(ARC-AGI套件)。

GPT-5.2 Thinking在几乎所有列出的推理测试中都略胜于Gemini 3和Anthropic的Claude Opus 4.5

OpenAI产品负责人Max Schwarzer也在周四通报称,GPT-5.2 Thinking的回复较前代减少了38%的错误,使该模型在日常决策、研究和写作中更为可靠。

从周四开始,GPT‑5.2将向所有ChatGPT付费用户和API用户推送。所以这个新模型到底有多么适合“打工”,很快就能见分晓。

作为OpenAI对谷歌的反击,GPT‑5.2仅仅是打出的“第一拳”。

公司CEO奥尔特曼在周四宣布,下周会给用户们带来一些“小小的圣诞礼物”。他也在周四表示,Gemini 3对公司各项指标的影响比原本担心得要小。他还说,预计OpenAI将在明年1月“以非常强劲的姿态”退出目前的红色警报状态。

图为奥尔特曼社媒发文截图

OpenAI首席产品官Fidji Simo也在周四透露,现在已经开始在部分地区推出年龄估算系统,此举旨在控制ChatGPT对18岁以下用户回复的内容。Simo也表示,公司希望在明年一季度推出“成人模式”前先引入这一功能。

略有遗憾的是,周四的新品发布似乎聚焦于新模型的推理能力,没有推出新的图像生成器。而今年以来,为数不多的几次现象级新品发布都与图像、视频生成产品有关。奥尔特曼的“红色警报”备忘录中,也提及要改善图像生成能力。

此前有报道称,OpenAI计划在明年1月再发布一款新模型,具有更好的图像能力和更完善的个性化特点,但公司周四未对这一传言予以确认。

 时事1:凯旋门官网赌场

  12月22日,河南元旦春节将迎出入境客流高峰 发布旅客“通关秘籍”,高校实力与经济水平不相匹配,曾一度是经济大省广东面临的尴尬处境。,中三元下载网址。

  12月22日,鄱阳湖跌破极枯水位 通江水体面积减九成,进一步对公司业务板块分析可知,当前公司各核心业务发展显著分化。宜昌人福(麻醉镇痛领域)作为公司的“利润奶牛”,其增长已显疲态。2025年上半年,神经系统用药(主要为麻醉镇痛药)营收同比仅增长约4%,远低于前几年的增速。在麻醉镇痛领域面临新品种集采压力、市场竞争加剧的背景下,这一核心引擎的动力减弱是公司整体增长乏力的主因。,12bet网址是多少,发体育在线首页,冠通游戏。

 时事2:m6vip米乐首页

  12月22日,俄国防部:乌军一昼夜损失约1210名军人,内部模式通常是指国家央行或大型金融机构自建自营金库,拥有自己的仓储和交割业务,核心优势在于对黄金资产的绝对控制权和安全保障。,wnsr909,AG视作讯真人,九游会手机版。

  12月22日,香港沙田消防局降半旗致哀殉职消防员 民众前往吊唁点哀悼罹难者,这意味着我们引以为傲的移动互联网大厦,始终建立在他人夯实的根基之上,让中国科技产业始终悬停在“空中楼阁”的隐忧之中。正是在这样的背景下,鸿蒙系统在安卓与iOS的夹缝中破土而生,让我们在无路可退中看到阔步前行的希望。,bbv体育官网登录,体育下载网站,开元棋下载app1973。

 时事3:皇冠滚球app下载

  12月22日,从嘎仙洞到洛阳城:拓跋鲜卑的万里迁徙与“心向中华”,美国知名保守派媒体人班尼·约翰逊(Benny Johnson)还一副被震惊到的模样:“吉尔·拜登刚才是不是亲了卡玛拉丈夫的嘴唇?!”,亚星网投平台,体育娱乐平台排行,银河网址平台银。

  12月22日,第十三届“东升杯”国际创业大赛收官 2061个项目参与角逐,T5航站楼面积70.55万平方米,同时配套35万平方米的综合交通中心。,捕鱼达人千炮版官方正版破解版,体育反水最高,天博体育官方网站下载。

 时事4:bet官网注册

  12月22日,中国驻墨西哥使馆对美方抹黑中国出口商品言论表示强烈不满,苏商银行特约研究员付一夫表示,银行理财子“下乡”,还需关注三大销售合规性问题:一是客户适配性,县域乡村客群的风险认知较浅,容易产生理财产品风险与个人风险承受能力的错配,引发客诉增多;二是部分农商行自身合规风控能力有限,专业人才短缺也会衍生销售误导等操作风险;三是当地理财产品竞争激烈,若引发“佣金战”,也会导致某些产品代销违规行为发生。,letou备用线路app,bet足球,ayxag。

  12月22日,法国游客的阿拉善“驼超”之约,集训前几天来到沈阳的媒体人数还不多,晚上公开训练前伊万还非常友好地与媒体记者握手打招呼,看上去一片祥和气氛。,葡京手机版网址,356体育投注平台,365Bet过关投注。

责编:呼双鹏

审核:袁世凯

责编:齐平

相关推荐 换一换