猫眼电影
猫眼电影记者 巴菲 报道首次登录送91元红包
财联社12月12日讯(编辑 史正丞)被谷歌逼到拉响“红色警报”后,OpenAI周四终于端出了最新前沿模型GPT-5.2系列。
图为OpenAI官网截图
OpenAI介绍称,GPT‑5.2是迄今为止在“专业知识工作方面”表现最好的模型系列,在制作电子表格、制作演示文稿、图像感知、编写代码以及理解长上下文等方面都优于前代产品。
GPT‑5.2有三种不同的版本:Instant是针对常规查询(如互联网检索、翻译和写作)进行速度优化的模型;Thinking擅长编程、数学、长文档分析等复杂结构化工作;顶级型号Pro,旨在为棘手问题提供最大程度的准确性和可靠性。
OpenAI特别强调,GPT‑5.2 Thinking是迄今为止最适合现实世界专业用途的模型。在评估涵盖44个职业的知识型工作任务的GDPval测试中,有70.9%的对比结果优于或持平于顶尖行业专业人士,这些任务包括制作销售演示文稿、会计电子表格、制造流程图或短视频等。
在评估涵盖44个职业的知识型工作任务的GDPval测试中,有70.9%的对比结果优于或持平于顶尖行业专业人士
另外在金融AI领域,GPT‑5.2Thinking的产出成果也明显好于GPT-5.1。
OpenAI给出的示例显示,GPT‑5.2 Thinking在制作人力资源规划模型、股权结构表和项目管理表格的任务中,产出成果较GPT‑5.1 Thinking有肉眼可见的进步。
OpenAI给出的示例
除了做PPT和Excel表格外,OpenAI也表示,GPT-5.2在编码、数学、科学、视觉、长文本推理以及工具使用等方面均刷新了基准成绩。公司称,这些能力的提升将有望带来“更可靠的代理式工作流程、可用于生产环境的代码,以及能够在大规模上下文和真实世界数据中运行的复杂系统”。
横向比较方面,GPT-5.2 Thinking在几乎所有列出的推理测试中都略胜于Gemini 3和Anthropic的Claude Opus 4.5,涵盖现实世界的软件工程任务(SWE-Bench Pro)和博士级别的科学知识(GPQA Diamond),到抽象推理和模式发现(ARC-AGI套件)。
GPT-5.2 Thinking在几乎所有列出的推理测试中都略胜于Gemini 3和Anthropic的Claude Opus 4.5
OpenAI产品负责人Max Schwarzer也在周四通报称,GPT-5.2 Thinking的回复较前代减少了38%的错误,使该模型在日常决策、研究和写作中更为可靠。
从周四开始,GPT‑5.2将向所有ChatGPT付费用户和API用户推送。所以这个新模型到底有多么适合“打工”,很快就能见分晓。
作为OpenAI对谷歌的反击,GPT‑5.2仅仅是打出的“第一拳”。
公司CEO奥尔特曼在周四宣布,下周会给用户们带来一些“小小的圣诞礼物”。他也在周四表示,Gemini 3对公司各项指标的影响比原本担心得要小。他还说,预计OpenAI将在明年1月“以非常强劲的姿态”退出目前的红色警报状态。
图为奥尔特曼社媒发文截图
OpenAI首席产品官Fidji Simo也在周四透露,现在已经开始在部分地区推出年龄估算系统,此举旨在控制ChatGPT对18岁以下用户回复的内容。Simo也表示,公司希望在明年一季度推出“成人模式”前先引入这一功能。
略有遗憾的是,周四的新品发布似乎聚焦于新模型的推理能力,没有推出新的图像生成器。而今年以来,为数不多的几次现象级新品发布都与图像、视频生成产品有关。奥尔特曼的“红色警报”备忘录中,也提及要改善图像生成能力。
此前有报道称,OpenAI计划在明年1月再发布一款新模型,具有更好的图像能力和更完善的个性化特点,但公司周四未对这一传言予以确认。
时事1:新宝gg备用网址
12月27日,科技策源力引领行业未来 乳业生物技术国家重点实验室第三届学术委员会第5次会议圆满召开,福特首席执行官法利在上周一的采访中直言:‘毫无疑问,政策对消费者的购车需求产生了巨大影响,归根结底,市场的基本面已经变了。’,开元棋牌电竞。
12月27日,报告:中国消费市场展望乐观,中高收入群体扩大成核心驱动力,他还表示,日本不是北约成员国,但开设联络处发出了一个信号,即北约的亚太伙伴正在“以非常稳定的方式”与北约进行接触。,斗牛玩法,凯发娱乐手机版登录网页,2020欧洲杯小组。
时事2:365注册网址
12月27日,寒潮来袭 乌鲁木齐降雪降温,而且在国泰之前,南航和乌鲁木齐航空已经开通了香港航线。相当于香港也不是乌鲁木齐的新航点。,买外围网站哪个好,世界杯游戏,leyu乐鱼vip。
12月27日,喝酒吃辣能暖身?都是御寒“损招”,随着华尔街对人工智能行业投机性泡沫的担忧加剧,全球投资者正加大对中国人工智能企业的投资押注,期望发掘下一个深度求索(DeepSeek),同时实现投资组合多元化。,十大菠菜靠谱平台,bbin体育滚球介绍,最好的世界杯投注软件。
时事3:压大小稳赢公式
12月27日,首届“泉州杯”世遗文创大赛启动 面向全球征集作品,据英国广播公司(BBC)2月9日报道,泽连斯基访英之际,乌英两国领导人会晤讨论“双管齐下的英国对乌援助”,其中包括立刻增加军火援助以应对俄军春季攻势,以及强化长期支持。此外,泽连斯基还在白金汉宫会见了英国国王查尔斯三世,并在英国议会下议院发表演讲。,im电竞体育平台,买外围球赛的app,leyu乐鱼投注登录。
12月27日,海南自贸港全岛封关准备就绪,他警告道,去年也有好几所和斯坦福大学一样著名的高等学府发生过类似的抗议闹事,比如耶鲁大学、加州大学等,让不少业内人士心有余悸,甚至考虑不再录用相关学校的学生。,澳门皇冠官网视讯直播,急速28,优发国际注册平台。
时事4:贝博下载地址
12月27日,中国女棋士芮乃伟九段:AI改变了围棋训练,其次,高管薪酬面临行业性压制。尽管公开信息未披露北京人寿具体的高管薪酬数字,但其所处的行业背景值得关注。近年来,在财政部“限薪令”和行业周期下行的影响下,保险业高管薪酬整体呈下降趋势。特别是对于北京人寿这类股权结构中包含地方国资背景(如北京供销社、顺鑫控股)的企业,其薪酬体系受到的政策约束更为严格。行业数据显示,2024年已无国资背景的非上市险企董监高年薪超过500万元。,滚球那个网址可靠,赌博十大网址有哪些,十大赌场官方网站。
12月27日,高铁上现“平面盲文” 无障碍设施不能沦为空壳摆设,2025国际财富管理与金融投资论坛•澳门——上海理财博览会澳门论坛圆满举行!,捕鱼电玩城大全上下分,葡京体育网投,线上网赌手机app。
责编:比奇科夫斯基
审核:冯·勒
责编:奚正辉












