搜索 猫眼电影 融媒体矩阵
  • 山东手机报

  • 猫眼电影

  • 大众网官方微信

  • 大众网官方微博

  • 抖音

  • 人民号

  • 全国党媒平台

  • 央视频

  • 百家号

  • 快手

  • 头条号

  • 哔哩哔哩

首页 >新闻 >社会新闻

GPT-5.2发布 OpenAI称其为"最强专业知识工作大模型"

2025-12-29 09:08:07
来源:

猫眼电影

作者:

周芳仪

手机查看

  猫眼电影记者 张雅秀 报道首次登录送91元红包

财联社12月12日讯(编辑 史正丞)被谷歌逼到拉响“红色警报”后,OpenAI周四终于端出了最新前沿模型GPT-5.2系列。

图为OpenAI官网截图

OpenAI介绍称,GPT‑5.2是迄今为止在“专业知识工作方面”表现最好的模型系列,在制作电子表格、制作演示文稿、图像感知、编写代码以及理解长上下文等方面都优于前代产品。

GPT‑5.2有三种不同的版本:Instant是针对常规查询(如互联网检索、翻译和写作)进行速度优化的模型;Thinking擅长编程、数学、长文档分析等复杂结构化工作;顶级型号Pro,旨在为棘手问题提供最大程度的准确性和可靠性。

OpenAI特别强调,GPT‑5.2 Thinking是迄今为止最适合现实世界专业用途的模型。在评估涵盖44个职业的知识型工作任务的GDPval测试中,有70.9%的对比结果优于或持平于顶尖行业专业人士,这些任务包括制作销售演示文稿、会计电子表格、制造流程图或短视频等。

在评估涵盖44个职业的知识型工作任务的GDPval测试中,有70.9%的对比结果优于或持平于顶尖行业专业人士

另外在金融AI领域,GPT‑5.2Thinking的产出成果也明显好于GPT-5.1。

OpenAI给出的示例显示,GPT‑5.2 Thinking在制作人力资源规划模型、股权结构表和项目管理表格的任务中,产出成果较GPT‑5.1 Thinking有肉眼可见的进步。

OpenAI给出的示例

除了做PPT和Excel表格外,OpenAI也表示,GPT-5.2在编码、数学、科学、视觉、长文本推理以及工具使用等方面均刷新了基准成绩。公司称,这些能力的提升将有望带来“更可靠的代理式工作流程、可用于生产环境的代码,以及能够在大规模上下文和真实世界数据中运行的复杂系统”。

横向比较方面,GPT-5.2 Thinking在几乎所有列出的推理测试中都略胜于Gemini 3和Anthropic的Claude Opus 4.5,涵盖现实世界的软件工程任务(SWE-Bench Pro)和博士级别的科学知识(GPQA Diamond),到抽象推理和模式发现(ARC-AGI套件)。

GPT-5.2 Thinking在几乎所有列出的推理测试中都略胜于Gemini 3和Anthropic的Claude Opus 4.5

OpenAI产品负责人Max Schwarzer也在周四通报称,GPT-5.2 Thinking的回复较前代减少了38%的错误,使该模型在日常决策、研究和写作中更为可靠。

从周四开始,GPT‑5.2将向所有ChatGPT付费用户和API用户推送。所以这个新模型到底有多么适合“打工”,很快就能见分晓。

作为OpenAI对谷歌的反击,GPT‑5.2仅仅是打出的“第一拳”。

公司CEO奥尔特曼在周四宣布,下周会给用户们带来一些“小小的圣诞礼物”。他也在周四表示,Gemini 3对公司各项指标的影响比原本担心得要小。他还说,预计OpenAI将在明年1月“以非常强劲的姿态”退出目前的红色警报状态。

图为奥尔特曼社媒发文截图

OpenAI首席产品官Fidji Simo也在周四透露,现在已经开始在部分地区推出年龄估算系统,此举旨在控制ChatGPT对18岁以下用户回复的内容。Simo也表示,公司希望在明年一季度推出“成人模式”前先引入这一功能。

略有遗憾的是,周四的新品发布似乎聚焦于新模型的推理能力,没有推出新的图像生成器。而今年以来,为数不多的几次现象级新品发布都与图像、视频生成产品有关。奥尔特曼的“红色警报”备忘录中,也提及要改善图像生成能力。

此前有报道称,OpenAI计划在明年1月再发布一款新模型,具有更好的图像能力和更完善的个性化特点,但公司周四未对这一传言予以确认。

 时事1:能够买球的app

  12月29日,市场监管总局:开展规范光伏行业价格竞争秩序合规指导,下周(12.29-01.02,下同)短期资金到期1526亿元,1月有17000亿元买断式逆回购资金到期,2000亿元MLF到期:(1)统计期短期资金到期1526亿元,其中7天期OMO到期1526亿元;(2)中长期资金部分,1月有2000亿元1年期MLF到期,6000亿元6个月期买断式逆回购到期,11000亿元3个月期买断式逆回购到期。,乐鱼官网登陆。

  12月29日,北京市发放首批L3级高速公路自动驾驶车辆专用号牌,郑总提到有些业务不好落地,为什么?因为依靠传统人工模式无法完成。例如按使用时长计费的经营租赁,人力无法精确判断,必须借助模型和大数据,细化到每小时颗粒度,才能真正实现租赁创新。,云顶娱乐手机登陆页面,凯时官方版手游,世界杯投注开奖结果。

 时事2:365bet试玩

  12月29日,(乡村行·看振兴)浙江云和:景村融合助力水库移民村“鱼跃龙门”,常年打球的张先生告诉《环球时报》记者:“在郑钦文夺冠前的这几年,网球运动在大众层面一直是向上走的态势,加入网球运动行列中的人不断增多。”张先生分析,这也许跟网球是隔网运动有关,因此在疫情期间受到欢迎。,BET登录,必威网址多少啊,滚球app官网下载。

  12月29日,巴西学者:我在中国生活很舒服、很安全,期待巴中深化合作丨世界观,随着华尔街对人工智能行业投机性泡沫的担忧加剧,全球投资者正加大对中国人工智能企业的投资押注,期望发掘下一个深度求索(DeepSeek),同时实现投资组合多元化。,实力通天报,obo体育官网最新下载,线上信誉葡京。

 时事3:澳门网投

  12月29日,云南省纪委监委驻省交通运输厅纪检监察组原组长唐定文被查,如今,佛山已再次校准坐标,明确要用7年时间再上一个万亿台阶。在今年2月举行的广东省高质量发展大会上,佛山市委书记郑轲透露,佛山制造业当家的下一个目标,是到2030年规上工业总产值跃升到4万亿元。,188网球比分直播吧,ag捕鱼王游戏首页,vwin体育app。

  12月29日,好评中国|锚定高质量发展,奋力实现“十五五”良好开局,12月15日,国任保险召开第四十七次临时股东大会,审议《关于修订公司章程及附件的议案》,此次议案虽成功通过,但其中有6.01亿票反对、0.3亿票弃权。,太阳城游戏登录,poker star,华体会注册。

 时事4:世界杯买球中国官方

  12月29日,中国全植入脑机接口临床试验成功 高位截瘫患者实现意念操控,财报显示,江特电机主要从事以碳酸锂为主的锂盐产品研发、生产和销售,依托自有锂云母矿山,构建了从锂矿石到锂盐的“采选冶”一体化产业链。公司对外主要销售产品为电池级碳酸锂、工业级碳酸锂及其他共生矿产品。,拉斯维加斯官方网站,ag真人官方app金年会,百姓彩票大首页。

  12月29日,2025年度中国电影总票房破480亿元人民币,Copyright © 1996-2023 SINA Corporation,币博网站,星力电玩打鱼,六合无绝对。

责编:朱左峰

审核:谢佳睿

责编:许木阳

相关推荐 换一换