猫眼电影
猫眼电影记者 金恩淑 报道首次登录送91元红包
财联社12月12日讯(编辑 史正丞)被谷歌逼到拉响“红色警报”后,OpenAI周四终于端出了最新前沿模型GPT-5.2系列。
图为OpenAI官网截图
OpenAI介绍称,GPT‑5.2是迄今为止在“专业知识工作方面”表现最好的模型系列,在制作电子表格、制作演示文稿、图像感知、编写代码以及理解长上下文等方面都优于前代产品。
GPT‑5.2有三种不同的版本:Instant是针对常规查询(如互联网检索、翻译和写作)进行速度优化的模型;Thinking擅长编程、数学、长文档分析等复杂结构化工作;顶级型号Pro,旨在为棘手问题提供最大程度的准确性和可靠性。
OpenAI特别强调,GPT‑5.2 Thinking是迄今为止最适合现实世界专业用途的模型。在评估涵盖44个职业的知识型工作任务的GDPval测试中,有70.9%的对比结果优于或持平于顶尖行业专业人士,这些任务包括制作销售演示文稿、会计电子表格、制造流程图或短视频等。
在评估涵盖44个职业的知识型工作任务的GDPval测试中,有70.9%的对比结果优于或持平于顶尖行业专业人士
另外在金融AI领域,GPT‑5.2Thinking的产出成果也明显好于GPT-5.1。
OpenAI给出的示例显示,GPT‑5.2 Thinking在制作人力资源规划模型、股权结构表和项目管理表格的任务中,产出成果较GPT‑5.1 Thinking有肉眼可见的进步。
OpenAI给出的示例
除了做PPT和Excel表格外,OpenAI也表示,GPT-5.2在编码、数学、科学、视觉、长文本推理以及工具使用等方面均刷新了基准成绩。公司称,这些能力的提升将有望带来“更可靠的代理式工作流程、可用于生产环境的代码,以及能够在大规模上下文和真实世界数据中运行的复杂系统”。
横向比较方面,GPT-5.2 Thinking在几乎所有列出的推理测试中都略胜于Gemini 3和Anthropic的Claude Opus 4.5,涵盖现实世界的软件工程任务(SWE-Bench Pro)和博士级别的科学知识(GPQA Diamond),到抽象推理和模式发现(ARC-AGI套件)。
GPT-5.2 Thinking在几乎所有列出的推理测试中都略胜于Gemini 3和Anthropic的Claude Opus 4.5
OpenAI产品负责人Max Schwarzer也在周四通报称,GPT-5.2 Thinking的回复较前代减少了38%的错误,使该模型在日常决策、研究和写作中更为可靠。
从周四开始,GPT‑5.2将向所有ChatGPT付费用户和API用户推送。所以这个新模型到底有多么适合“打工”,很快就能见分晓。
作为OpenAI对谷歌的反击,GPT‑5.2仅仅是打出的“第一拳”。
公司CEO奥尔特曼在周四宣布,下周会给用户们带来一些“小小的圣诞礼物”。他也在周四表示,Gemini 3对公司各项指标的影响比原本担心得要小。他还说,预计OpenAI将在明年1月“以非常强劲的姿态”退出目前的红色警报状态。
图为奥尔特曼社媒发文截图
OpenAI首席产品官Fidji Simo也在周四透露,现在已经开始在部分地区推出年龄估算系统,此举旨在控制ChatGPT对18岁以下用户回复的内容。Simo也表示,公司希望在明年一季度推出“成人模式”前先引入这一功能。
略有遗憾的是,周四的新品发布似乎聚焦于新模型的推理能力,没有推出新的图像生成器。而今年以来,为数不多的几次现象级新品发布都与图像、视频生成产品有关。奥尔特曼的“红色警报”备忘录中,也提及要改善图像生成能力。
此前有报道称,OpenAI计划在明年1月再发布一款新模型,具有更好的图像能力和更完善的个性化特点,但公司周四未对这一传言予以确认。
时事1:全球赌场排名榜二十名
12月24日,恩佐:中国单板滑雪发展迅速 期待与苏翊鸣冬奥会相见,据美联社9日报道,土耳其总统埃尔多安当地时间周三(8日)视察灾区时承认救灾工作存在“不足”。但他同时反驳了部分指责声音,称没有可能为如此级别的灾难做好准备。,ManBetx登录。
12月24日,哈尔滨采冰节启幕 千年冰雪文化焕新登场,“当有足够多像这样的孩子进入法律行业,法治会堕落为野蛮行径。”因此,邓肯要求斯坦福大学必须严厉惩罚此次参与抗议的学生,并解雇法学院副院长斯坦巴赫。,bet在线官网,凤凰彩票在线注册,真钱金沙下注。
时事2:天博体育APP链接
12月24日,从织布到“织音”:石家庄“工业锈带”时尚焕新,张先生认为,网球明星的出现与整个网球运动以及网球经济的发展是相互促进的,并形成正向反馈。他说,明星越多,示范效应就越强,就会更加刺激网球运动的发展,网球经济热度也会越高。而打网球的人多了,就会涌现出更多的网球明星。,yabo22vip在线试玩,奥门威尼斯太阳城,必发在哪里玩。
12月24日,鄱阳湖跌破8米极枯水位,对西北城市来说,机场的作用尤为重要。西北不沿海,也没有内河航运。依托铁路和机场打造枢纽,形成开放门户,无论对区域还是全国而言,都具有经济与战略的双重意义。,365电子平台,优酷网站能看世界杯吗,马经数理报。
时事3:AG真人是什么公司
12月24日,羽超联赛苏州站:“升班马”辽宁极兔队跃升首位,6月15日白天,安阳东部、濮阳、新乡、焦作、洛阳东部、郑州、开封、商丘、平顶山、许昌、漯河、周口、南阳、驻马店、信阳大部最高气温将升至37℃以上,其中漯河南部、周口南部、驻马店部分县市最高气温将升至40℃以上。请注意防范。上述地区的相邻县市(区)也需关注。,世界十大赌场网站,J9赌神赛,万博官方manbext体育下载。
12月24日,第18届WTO法与中国论坛在昆明召开,路透社称斯坦福大学一名官员的电子邮件中显示,以校园LGBTQ团体“OutLaw”为首的学生联盟对邓肯被邀请发言感到不安,称他所采取的立场威胁到了LGBTQ群体、移民、黑人选民、女性等的权利。,必赢下载,火狐体育在线下载app,新濠天地网站官网。
时事4:365bet体育足球官方介绍
12月24日,青海首个24小时数智零工驿站在西宁投运 实现"指尖接单"促就业,46979名球迷把沈阳奥体中心打造成了红色海洋,在这个2001年十强赛出线的所谓福地城市,中国足球终究是没能等到一场属于自己的胜利,1比1的平局让国足的出局进入倒计时。,188体育官网登陆,飞驰娱乐官网入口,乐游棋牌斗牛技巧。
12月24日,金上—湖北±800千伏特高压直流输电工程建成投运,目前中国队2胜2平1负拿到8分,得失球为9比8;而泰国队1胜2平2负积5分,得失球为6比8。国足依然掌握着自己的出线命运,但前提是做客韩国拿到1分。然而以中韩两国足球间的巨大差距来看,主场都0比3完败的国足,想要在客场拿分的难度无疑是巨大的。,opebet体育官方z,十博体育版,金沙娱城全部。
责编:罗拉萨尔曼
审核:白鸟湖
责编:黄金招












