猫眼电影
猫眼电影记者 赫楠 报道首次登录送91元红包
财联社12月12日讯(编辑 史正丞)被谷歌逼到拉响“红色警报”后,OpenAI周四终于端出了最新前沿模型GPT-5.2系列。
图为OpenAI官网截图
OpenAI介绍称,GPT‑5.2是迄今为止在“专业知识工作方面”表现最好的模型系列,在制作电子表格、制作演示文稿、图像感知、编写代码以及理解长上下文等方面都优于前代产品。
GPT‑5.2有三种不同的版本:Instant是针对常规查询(如互联网检索、翻译和写作)进行速度优化的模型;Thinking擅长编程、数学、长文档分析等复杂结构化工作;顶级型号Pro,旨在为棘手问题提供最大程度的准确性和可靠性。
OpenAI特别强调,GPT‑5.2 Thinking是迄今为止最适合现实世界专业用途的模型。在评估涵盖44个职业的知识型工作任务的GDPval测试中,有70.9%的对比结果优于或持平于顶尖行业专业人士,这些任务包括制作销售演示文稿、会计电子表格、制造流程图或短视频等。
在评估涵盖44个职业的知识型工作任务的GDPval测试中,有70.9%的对比结果优于或持平于顶尖行业专业人士
另外在金融AI领域,GPT‑5.2Thinking的产出成果也明显好于GPT-5.1。
OpenAI给出的示例显示,GPT‑5.2 Thinking在制作人力资源规划模型、股权结构表和项目管理表格的任务中,产出成果较GPT‑5.1 Thinking有肉眼可见的进步。
OpenAI给出的示例
除了做PPT和Excel表格外,OpenAI也表示,GPT-5.2在编码、数学、科学、视觉、长文本推理以及工具使用等方面均刷新了基准成绩。公司称,这些能力的提升将有望带来“更可靠的代理式工作流程、可用于生产环境的代码,以及能够在大规模上下文和真实世界数据中运行的复杂系统”。
横向比较方面,GPT-5.2 Thinking在几乎所有列出的推理测试中都略胜于Gemini 3和Anthropic的Claude Opus 4.5,涵盖现实世界的软件工程任务(SWE-Bench Pro)和博士级别的科学知识(GPQA Diamond),到抽象推理和模式发现(ARC-AGI套件)。
GPT-5.2 Thinking在几乎所有列出的推理测试中都略胜于Gemini 3和Anthropic的Claude Opus 4.5
OpenAI产品负责人Max Schwarzer也在周四通报称,GPT-5.2 Thinking的回复较前代减少了38%的错误,使该模型在日常决策、研究和写作中更为可靠。
从周四开始,GPT‑5.2将向所有ChatGPT付费用户和API用户推送。所以这个新模型到底有多么适合“打工”,很快就能见分晓。
作为OpenAI对谷歌的反击,GPT‑5.2仅仅是打出的“第一拳”。
公司CEO奥尔特曼在周四宣布,下周会给用户们带来一些“小小的圣诞礼物”。他也在周四表示,Gemini 3对公司各项指标的影响比原本担心得要小。他还说,预计OpenAI将在明年1月“以非常强劲的姿态”退出目前的红色警报状态。
图为奥尔特曼社媒发文截图
OpenAI首席产品官Fidji Simo也在周四透露,现在已经开始在部分地区推出年龄估算系统,此举旨在控制ChatGPT对18岁以下用户回复的内容。Simo也表示,公司希望在明年一季度推出“成人模式”前先引入这一功能。
略有遗憾的是,周四的新品发布似乎聚焦于新模型的推理能力,没有推出新的图像生成器。而今年以来,为数不多的几次现象级新品发布都与图像、视频生成产品有关。奥尔特曼的“红色警报”备忘录中,也提及要改善图像生成能力。
此前有报道称,OpenAI计划在明年1月再发布一款新模型,具有更好的图像能力和更完善的个性化特点,但公司周四未对这一传言予以确认。
时事1:历届世界杯投注分析
12月27日,以美食为桥促文化交流 国际小吃创意大赛亮相福建沙县,5月10日,曙光信息产业股份有限公司(以下简称“中科曙光”,603019)公告称,收到公司董事长李国杰告知,其收到中国证券监督管理委员会天津监管局出具的《行政处罚决定书》。,世界杯买球注册。
12月27日,年均发放高龄补贴29亿元 陕西推进养老服务提质增效,不久前, 德国媒体报道称,朔尔茨于1月29日重申德国不会向乌克兰提供战斗机。朔尔茨当时在接受《每日镜报》采访时说:“在武器系统方面,我的忠告是,不要陷入一种持续不断的竞购战中。”他称:“如果刚做了一个(关于提供主战坦克的)决定,德国又掀起另一轮(军援的)辩论,将给人一种态度轻忽的印象,而且会削弱民众对政府决策的信心。”,10大网赌论坛,pg电子游戏体验kok软件,365外围滚球平台。
时事2:365体育手机端
12月27日,海南实现船舶证书文书“一件事一次办” 服务自贸港航运业,朔尔茨在讲话中再次敦促俄罗斯总统普京从乌克兰撤军。他还证实,德国希望实现北约设定的将国内生产总值的2%用于国防的长期目标。,365篮球比分,世界杯彩票无法投注,365bet亚洲网站。
12月27日,飞机“锁座”引争议 有偿选座被质疑 江苏省消保委已对10家航司展开调查,据日本共同社昨天(9日)报道,在当天的参议院外交防卫委员会上,防卫省提出了一项大胆的考虑,即允许自卫队招募有文身的应募者。报道援引退役前自卫队干部、自民党议员、军事评论家佐藤正久的观点称,在目前的少子化、老龄化背景下,有必要采取措施保障自卫队的员额(数量充足)。,乐鱼官网买球,bbin世界杯内幕,微球体育官网版。
时事3:识破玄机(保证香港版)
12月27日,1800亿件快递背后的物流变革:透视物流大省智慧物流发展,北京、上海、广州是3大全方位门户复合型功能的国际航空枢纽,成都、深圳、重庆、昆明、西安、乌鲁木齐、哈尔滨是7大区位门户复合型功能的国际航空枢纽。,银河总站娱乐官网网址,MG真人网站是多少,必威真人投注。
12月27日,梁水映东城:辽阳汉魏晋壁画摹本暨出土文物展在沈阳开展,鸿蒙的快速成长与发展,不只是一家企业的成果,更是中国科技产业在关键领域自主创新、自力更生的一个缩影。此次盛典,让我们看到了国产操作系统发展背后,那股源自千行百业、万千开发者的的磅礴力量。无数个“我”汇聚,便成了“我们”,“聚是一团火,散是满天星”是无数鸿蒙合伙人最真实的写照。,世界杯手机app投注,宝博在线登陆,天博APP官网。
时事4:德扑圈网址
12月27日,第二届“西部青训杯”青少年足球交流赛在贵州毕节圆满完赛,据公开资料,吕王镇刘院村379户,共有1356人。该村以刘、汪两大姓为主,其中刘姓长字辈、汪姓绪字辈的以五六十岁的中老年人居多。有村民在企查查APP上输入“刘长”二字,发现大量村民的工商注册信息。,9001aa金沙登录,澳门所有游戏网站,至尊手游app。
12月27日,视频丨缅怀先烈 致敬和平 多地开展国家公祭日主题教育活动,2024年,西安机场旅客吞吐量4703.04万人次,排名全国第11位;乌鲁木齐机场旅客吞吐量2776.57万人次,排名全国第18位。西安去年GDP为13317.78亿元,排名全国第21位;乌鲁木齐去年GDP仅为4502.16亿元,排名全国第74位。,英皇国际真人ag,开元棋牌手机版注册,开元棋牌网页版。
责编:纳尼
审核:陈朝宗
责编:杨明静












