搜索 猫眼电影 融媒体矩阵
  • 山东手机报

  • 猫眼电影

  • 大众网官方微信

  • 大众网官方微博

  • 抖音

  • 人民号

  • 全国党媒平台

  • 央视频

  • 百家号

  • 快手

  • 头条号

  • 哔哩哔哩

首页 >新闻 >社会新闻

GPT-5.2发布 OpenAI称其为"最强专业知识工作大模型"

2025-12-26 08:11:15
来源:

猫眼电影

作者:

瓦里克

手机查看

  猫眼电影记者 鹿礁 报道首次登录送91元红包

财联社12月12日讯(编辑 史正丞)被谷歌逼到拉响“红色警报”后,OpenAI周四终于端出了最新前沿模型GPT-5.2系列。

图为OpenAI官网截图

OpenAI介绍称,GPT‑5.2是迄今为止在“专业知识工作方面”表现最好的模型系列,在制作电子表格、制作演示文稿、图像感知、编写代码以及理解长上下文等方面都优于前代产品。

GPT‑5.2有三种不同的版本:Instant是针对常规查询(如互联网检索、翻译和写作)进行速度优化的模型;Thinking擅长编程、数学、长文档分析等复杂结构化工作;顶级型号Pro,旨在为棘手问题提供最大程度的准确性和可靠性。

OpenAI特别强调,GPT‑5.2 Thinking是迄今为止最适合现实世界专业用途的模型。在评估涵盖44个职业的知识型工作任务的GDPval测试中,有70.9%的对比结果优于或持平于顶尖行业专业人士,这些任务包括制作销售演示文稿、会计电子表格、制造流程图或短视频等。

在评估涵盖44个职业的知识型工作任务的GDPval测试中,有70.9%的对比结果优于或持平于顶尖行业专业人士

另外在金融AI领域,GPT‑5.2Thinking的产出成果也明显好于GPT-5.1。

OpenAI给出的示例显示,GPT‑5.2 Thinking在制作人力资源规划模型、股权结构表和项目管理表格的任务中,产出成果较GPT‑5.1 Thinking有肉眼可见的进步。

OpenAI给出的示例

除了做PPT和Excel表格外,OpenAI也表示,GPT-5.2在编码、数学、科学、视觉、长文本推理以及工具使用等方面均刷新了基准成绩。公司称,这些能力的提升将有望带来“更可靠的代理式工作流程、可用于生产环境的代码,以及能够在大规模上下文和真实世界数据中运行的复杂系统”。

横向比较方面,GPT-5.2 Thinking在几乎所有列出的推理测试中都略胜于Gemini 3和Anthropic的Claude Opus 4.5,涵盖现实世界的软件工程任务(SWE-Bench Pro)和博士级别的科学知识(GPQA Diamond),到抽象推理和模式发现(ARC-AGI套件)。

GPT-5.2 Thinking在几乎所有列出的推理测试中都略胜于Gemini 3和Anthropic的Claude Opus 4.5

OpenAI产品负责人Max Schwarzer也在周四通报称,GPT-5.2 Thinking的回复较前代减少了38%的错误,使该模型在日常决策、研究和写作中更为可靠。

从周四开始,GPT‑5.2将向所有ChatGPT付费用户和API用户推送。所以这个新模型到底有多么适合“打工”,很快就能见分晓。

作为OpenAI对谷歌的反击,GPT‑5.2仅仅是打出的“第一拳”。

公司CEO奥尔特曼在周四宣布,下周会给用户们带来一些“小小的圣诞礼物”。他也在周四表示,Gemini 3对公司各项指标的影响比原本担心得要小。他还说,预计OpenAI将在明年1月“以非常强劲的姿态”退出目前的红色警报状态。

图为奥尔特曼社媒发文截图

OpenAI首席产品官Fidji Simo也在周四透露,现在已经开始在部分地区推出年龄估算系统,此举旨在控制ChatGPT对18岁以下用户回复的内容。Simo也表示,公司希望在明年一季度推出“成人模式”前先引入这一功能。

略有遗憾的是,周四的新品发布似乎聚焦于新模型的推理能力,没有推出新的图像生成器。而今年以来,为数不多的几次现象级新品发布都与图像、视频生成产品有关。奥尔特曼的“红色警报”备忘录中,也提及要改善图像生成能力。

此前有报道称,OpenAI计划在明年1月再发布一款新模型,具有更好的图像能力和更完善的个性化特点,但公司周四未对这一传言予以确认。

 时事1:开户送68元体验金

  12月26日,一名中国公民在柬泰冲突中受伤 中方要求冲突双方保障中国公民安全,尽管北京人寿在公开宣传中多次强调其风险管理“向‘深’‘精’‘专’方向推进”,并称风险综合评级已连续13个季度保持在BB类及以上,但此次监管处罚无疑是对其自我宣称的风控成效打上了一个问号。它揭示出,在快速的业务发展和规模扩张过程中,公司的内部管理精细化水平可能未能同步跟上,为未来的稳健经营埋下了风险隐患。,世界杯网站源码下载。

  12月26日,第七届中华民族抗日战争史与抗战精神传承研讨会在北京举办,4月底,内蒙古通辽市科左中旗的希伯花镇,天气已经暖起来,正是一年中春播的好时候。种植户张立奎却在自己的田地边无所事事。,必发网址是多少,下载送钱的赌博,冠体育世界杯最新版本下载。

 时事2:888真人平台首页

  12月26日,大兴安岭 “冰超” 系列活动启幕 36项冰雪盛宴燃动极寒,梁启东说,渤海海峡跨海通道建成后,会节约山东到辽东半岛乃至整个东北的运输成本,打通交通堵点,扩大物流,激发新的增长点,并对沿线旅游业产生积极影响。受历史上闯关东等因素影响,山东与东北地区历史渊源深厚,两个地区从经济联系、区位关系,再到情感纽带、文化渊源等方面都有很好的区域协同发展的基础。,真人国际,z6尊龙旗舰厅,澳门梭哈游戏平台。

  12月26日,海南自由贸易港国际服务门户上线运行,她谈到,人工智能要创造新质生产力,但绝非易事——若无法实现数倍效率与效果提升,便不能称之为新质生产力。它需要四个核心要素协同:数倍的效率效果提升、配套的生产工具、适配的生产关系,以及员工整体素质的提升。只有这四点同时满足,新质生产力才能真正落地推广。,永利贵宾会app,金莎娱乐体育,宝博体育官网。

 时事3:永利会员登录网址

  12月26日,浙江义乌春节用品热销 马相关产品海内外销量均涨,与此同时,要以文塑旅、以旅彰文,推动文旅文创融合发展,不断提升城市品位格调、品质能级,努力创造宜业、宜居、宜乐、宜游良好城市环境。这也显示出郑州正以优质文旅项目为抓手,培育新的支柱产业,甚至重塑城市品牌的决心。,下载手机赌博app,真钱在线平台,九州体育app。

  12月26日,1—11月中国销售彩票同比增长1.7%,无生产能力:该公司无GMP车间、无药品生产许可证,不具备承接该技术落地的能力;,百家乐分析,世界杯竞彩投注调整,押二八杠技巧。

 时事4:188金宝搏手机app下载

  12月26日,朝“问”健康·你做对了吗?大雪节气养生四忌 速记避坑,第二,产业场景的专业化能力,正如几位嘉宾所说,人才重要,但专业能力需长期积累,像谢总在行业深耕十几年才成为专家;,网上怎样赌博,澳门太阳集团www7,永利体育真人百家乐。

  12月26日,好评中国|锚定高质量发展,奋力实现“十五五”良好开局,辽宁队此番客场远征,郭艾伦随队来到东莞,并参加了球队的训练。不过,这场比赛他依然没有复出。末节还剩4分多钟时,辽宁队老将李晓旭在无对抗中受伤,他单脚跳到场边后,在郭艾伦等人的搀扶下回到更衣室。,天博官网安全,必威手机客户端登入,38330033金沙官网app。

责编:骆余民

审核:许红梅

责编:安乔拉·阿尔梅利尼

相关推荐 换一换