猫眼电影
猫眼电影记者 沈汝发 报道首次登录送91元红包
财联社12月12日讯(编辑 史正丞)被谷歌逼到拉响“红色警报”后,OpenAI周四终于端出了最新前沿模型GPT-5.2系列。
图为OpenAI官网截图
OpenAI介绍称,GPT‑5.2是迄今为止在“专业知识工作方面”表现最好的模型系列,在制作电子表格、制作演示文稿、图像感知、编写代码以及理解长上下文等方面都优于前代产品。
GPT‑5.2有三种不同的版本:Instant是针对常规查询(如互联网检索、翻译和写作)进行速度优化的模型;Thinking擅长编程、数学、长文档分析等复杂结构化工作;顶级型号Pro,旨在为棘手问题提供最大程度的准确性和可靠性。
OpenAI特别强调,GPT‑5.2 Thinking是迄今为止最适合现实世界专业用途的模型。在评估涵盖44个职业的知识型工作任务的GDPval测试中,有70.9%的对比结果优于或持平于顶尖行业专业人士,这些任务包括制作销售演示文稿、会计电子表格、制造流程图或短视频等。
在评估涵盖44个职业的知识型工作任务的GDPval测试中,有70.9%的对比结果优于或持平于顶尖行业专业人士
另外在金融AI领域,GPT‑5.2Thinking的产出成果也明显好于GPT-5.1。
OpenAI给出的示例显示,GPT‑5.2 Thinking在制作人力资源规划模型、股权结构表和项目管理表格的任务中,产出成果较GPT‑5.1 Thinking有肉眼可见的进步。
OpenAI给出的示例
除了做PPT和Excel表格外,OpenAI也表示,GPT-5.2在编码、数学、科学、视觉、长文本推理以及工具使用等方面均刷新了基准成绩。公司称,这些能力的提升将有望带来“更可靠的代理式工作流程、可用于生产环境的代码,以及能够在大规模上下文和真实世界数据中运行的复杂系统”。
横向比较方面,GPT-5.2 Thinking在几乎所有列出的推理测试中都略胜于Gemini 3和Anthropic的Claude Opus 4.5,涵盖现实世界的软件工程任务(SWE-Bench Pro)和博士级别的科学知识(GPQA Diamond),到抽象推理和模式发现(ARC-AGI套件)。
GPT-5.2 Thinking在几乎所有列出的推理测试中都略胜于Gemini 3和Anthropic的Claude Opus 4.5
OpenAI产品负责人Max Schwarzer也在周四通报称,GPT-5.2 Thinking的回复较前代减少了38%的错误,使该模型在日常决策、研究和写作中更为可靠。
从周四开始,GPT‑5.2将向所有ChatGPT付费用户和API用户推送。所以这个新模型到底有多么适合“打工”,很快就能见分晓。
作为OpenAI对谷歌的反击,GPT‑5.2仅仅是打出的“第一拳”。
公司CEO奥尔特曼在周四宣布,下周会给用户们带来一些“小小的圣诞礼物”。他也在周四表示,Gemini 3对公司各项指标的影响比原本担心得要小。他还说,预计OpenAI将在明年1月“以非常强劲的姿态”退出目前的红色警报状态。
图为奥尔特曼社媒发文截图
OpenAI首席产品官Fidji Simo也在周四透露,现在已经开始在部分地区推出年龄估算系统,此举旨在控制ChatGPT对18岁以下用户回复的内容。Simo也表示,公司希望在明年一季度推出“成人模式”前先引入这一功能。
略有遗憾的是,周四的新品发布似乎聚焦于新模型的推理能力,没有推出新的图像生成器。而今年以来,为数不多的几次现象级新品发布都与图像、视频生成产品有关。奥尔特曼的“红色警报”备忘录中,也提及要改善图像生成能力。
此前有报道称,OpenAI计划在明年1月再发布一款新模型,具有更好的图像能力和更完善的个性化特点,但公司周四未对这一传言予以确认。
时事1:龙8国际平台首页
12月22日,日本遗孤郜凤琴:没有中国,我也不能有今天,(2)体感情况:全周资金面体感整体偏松,银行间隔夜资金价格保持在1.26%附近稳健。,利澳平台注册登录地址。
12月22日,广州白云国际机场年旅客吞吐量首次突破8000万人次,美国财政部数据显示,4 月公布关税政策当天,美国国家债务约为 36.1 万亿美元。本周最新数据显示,该数字已增至 38.2 万亿美元,增幅超 2 万亿美元。,365平台网址,百家乐快速登陆,锦游斗地主。
时事2:金狮贵宾会登录中心
12月22日,12月9日央行开展1173亿元7天期逆回购操作,(2)个人成长需要打开视野,人际交往需要打开心扉,科技创新需要打开思路……打开,发现新的自己;打开,带来新的气象。每一次“打开”,都有一段故事。,捕鱼游戏注册送,美高梅线上赌钱,亚新体育在线官网。
12月22日,探路干线物流自动驾驶 四川港投开启实证行动,我们要求美方停止售台武器和美台军事联系,停止插手台湾问题,停止加剧台海局势紧张。中国人民解放军始终严阵以待,随时回击一切谋“独”挑衅和外部势力干涉,坚决捍卫国家主权和领土完整。,世界杯买球微信群,天博官网网页版,世界杯足球转播网站。
时事3:富博娱乐
12月22日,食品添加剂致痛风?医生:不能撇开剂量谈风险,“我们离“双一流”强省还有多远?”深刻反省之后,浙江开始奋起直追。,365bet体育滚球备用,捕鱼达人2技巧,bet9会员登录通道。
12月22日,平粮台古城遗址博物馆新馆开馆试运营,宝马集团大中华区政府和涉外事务副总裁吴燕彦表示,智能驾驶是宝马重点研发领域,其L3自动驾驶功能获得德国交通管理局批准,配备L3级自动驾驶的宝马i7在德国已面向终端客户接受预订。在小马智行政府事务副总裁王彊看来,无人驾驶“高效率”“高质量”特征明显,通过创新性配置生产要素、优化组合、提高生产效率,来助力汽车生产和交通运输两大产业升级。,龙8国际登陆,必威体育官方网站入口,千亿购彩app下载地址。
时事4:正规nba押注网站
12月22日,中国国家网信办拟规范人工智能拟人化互动服务,金库中的大部分黄金是在二战期间和之后运抵的,因为许多国家希望将其黄金储备储存在安全的地方。黄金库的持有量持续增加,并在 1973 年达到顶峰,当时美国暂停了外国政府将美元兑换成黄金。在鼎盛时期,金库里藏有超过 12,000 吨货币黄金。从那时起,黄金存款和取款活动放缓,金库的整体持有量逐渐但稳步下降。然而,该金库今天仍然是世界上已知最大的货币黄金存放处。,ag官方平台注册,365游戏官网版,开元棋牌注册送18。
12月22日,香港M+博物馆举办“赵无极:版艺匠心”特别展览,崔光灿也认为,住房按套内面积销售或按套销售,更有利于保障购房人的权益。他提出了另外两点原因,其一,由于公摊面积没有规范性标准,可大可小,且透明性不足,可能会损害购房人权益;其二,购房不仅要考虑交易成本,也需考虑使用成本。“后面的使用费用如暖气费等,如果按建筑面积分摊也不尽合理。”,体球即寸比分网手机版app,PG电子游戏在线买球,真正的AG平台。
责编:常卫
审核:马修·科芬
责编:马勇












