猫眼电影
猫眼电影记者 朱绍良 报道首次登录送91元红包
财联社12月12日讯(编辑 史正丞)被谷歌逼到拉响“红色警报”后,OpenAI周四终于端出了最新前沿模型GPT-5.2系列。
图为OpenAI官网截图
OpenAI介绍称,GPT‑5.2是迄今为止在“专业知识工作方面”表现最好的模型系列,在制作电子表格、制作演示文稿、图像感知、编写代码以及理解长上下文等方面都优于前代产品。
GPT‑5.2有三种不同的版本:Instant是针对常规查询(如互联网检索、翻译和写作)进行速度优化的模型;Thinking擅长编程、数学、长文档分析等复杂结构化工作;顶级型号Pro,旨在为棘手问题提供最大程度的准确性和可靠性。
OpenAI特别强调,GPT‑5.2 Thinking是迄今为止最适合现实世界专业用途的模型。在评估涵盖44个职业的知识型工作任务的GDPval测试中,有70.9%的对比结果优于或持平于顶尖行业专业人士,这些任务包括制作销售演示文稿、会计电子表格、制造流程图或短视频等。
在评估涵盖44个职业的知识型工作任务的GDPval测试中,有70.9%的对比结果优于或持平于顶尖行业专业人士
另外在金融AI领域,GPT‑5.2Thinking的产出成果也明显好于GPT-5.1。
OpenAI给出的示例显示,GPT‑5.2 Thinking在制作人力资源规划模型、股权结构表和项目管理表格的任务中,产出成果较GPT‑5.1 Thinking有肉眼可见的进步。
OpenAI给出的示例
除了做PPT和Excel表格外,OpenAI也表示,GPT-5.2在编码、数学、科学、视觉、长文本推理以及工具使用等方面均刷新了基准成绩。公司称,这些能力的提升将有望带来“更可靠的代理式工作流程、可用于生产环境的代码,以及能够在大规模上下文和真实世界数据中运行的复杂系统”。
横向比较方面,GPT-5.2 Thinking在几乎所有列出的推理测试中都略胜于Gemini 3和Anthropic的Claude Opus 4.5,涵盖现实世界的软件工程任务(SWE-Bench Pro)和博士级别的科学知识(GPQA Diamond),到抽象推理和模式发现(ARC-AGI套件)。
GPT-5.2 Thinking在几乎所有列出的推理测试中都略胜于Gemini 3和Anthropic的Claude Opus 4.5
OpenAI产品负责人Max Schwarzer也在周四通报称,GPT-5.2 Thinking的回复较前代减少了38%的错误,使该模型在日常决策、研究和写作中更为可靠。
从周四开始,GPT‑5.2将向所有ChatGPT付费用户和API用户推送。所以这个新模型到底有多么适合“打工”,很快就能见分晓。
作为OpenAI对谷歌的反击,GPT‑5.2仅仅是打出的“第一拳”。
公司CEO奥尔特曼在周四宣布,下周会给用户们带来一些“小小的圣诞礼物”。他也在周四表示,Gemini 3对公司各项指标的影响比原本担心得要小。他还说,预计OpenAI将在明年1月“以非常强劲的姿态”退出目前的红色警报状态。
图为奥尔特曼社媒发文截图
OpenAI首席产品官Fidji Simo也在周四透露,现在已经开始在部分地区推出年龄估算系统,此举旨在控制ChatGPT对18岁以下用户回复的内容。Simo也表示,公司希望在明年一季度推出“成人模式”前先引入这一功能。
略有遗憾的是,周四的新品发布似乎聚焦于新模型的推理能力,没有推出新的图像生成器。而今年以来,为数不多的几次现象级新品发布都与图像、视频生成产品有关。奥尔特曼的“红色警报”备忘录中,也提及要改善图像生成能力。
此前有报道称,OpenAI计划在明年1月再发布一款新模型,具有更好的图像能力和更完善的个性化特点,但公司周四未对这一传言予以确认。
时事1:欧洲杯2020决赛地点
12月25日,“艺路七十年——赵一唐艺术作品展”亮相中国美术馆,然而,这种转变引发了市场对“AI泡沫”及其对实体资产影响的担忧。与2000年互联网泡沫破裂时商业地产相对稳健的表现不同,如今的房地产业与科技行业的捆绑程度已达到历史峰值。随着投资者押注AI技术将产生万亿美元级的新收入,一旦需求出现回调或建设交付不及预期,风险敞口大增的地产基金恐将面临严峻考验。,注册送99元现金的捕鱼游戏。
12月25日,黑龙江伊春森工集团有限责任公司原总经理杨公伟被“双开”,2018年7月,经原银保监会批复,两江金融将其4亿股股份转让给联美量子,两江金融退出,联美量子持股5.8亿股,比例上升至19.333%,为历年来国任保险民营股权最大占比。,正规赌场,九州官方网站,注册送币下载软件。
时事2:线上体育比分网
12月25日,香港一定会更好——致敬并肩前行的“我们”,尽管莫迪政府利用各种外交手段极大提升了印度的“国际能见度”,但高“能见度”并不等同于实际成效。楼春豪指出,莫迪预计会延续其内政和外交政策,但国内政治变动将对外交走向产生一定影响。他还提到,印度外交的未来走向也可能受到美国大选结果及后续外交政策调整的影响。,球探篮球比分旧版,新濠博亚娱乐平台,新宝5注册登录网网址。
12月25日,国家技术转移中部中心在武汉揭牌,亿纬锂能成立于2001年,于2009年在深圳创业板首批上市,历经20余年发展,已成为全球化布局的全场景锂电池企业。其工厂布局在广东惠州、湖北荆门及武汉、四川成都、云南玉溪及曲靖、江苏启东、浙江宁波、辽宁沈阳、匈牙利、马来西亚及美国。,尊龙开户网址,环球在哪里玩,永利官方客户端下载。
时事3:K8凯发网址
12月25日,第三个10万亿大省官宣!谁是下一个?,楼春豪认为,尽管印度的宏观经济数据表现相对亮眼,其失业率、劳动参与率及公共服务供给(包括教育和医疗)的数据表现并不理想。他认为,莫迪政府在新一任期内要对经济政策进行必要的反思和调整。,香港六合皇A,万博体育官方网站下载,PG电子游戏平台网址。
12月25日,黑龙江“东北黑蜂”“黏豆包”农产品进京 全国采购额4.1亿元,“近期国内用钻爆法建成的海底隧道有三条。其一是厦门翔安隧道,隧道段长约6公里,其二是厦门第二西通道,即海沧隧道,长约6.3公里,其三是青岛胶州湾隧道,长约7.8公里;目前在建的青岛二隧道采用钻爆加盾构组合的工法,隧道长约16公里;沉管隧道目前最长的,是港珠澳隧道,长约7公里,同样使用沉管工法的深中通道隧道,长约6.85公里。”黄清飞说。,开博体育网页版登录,今年世界杯在哪里买球,球球体育官网入口。
时事4:世界杯买球在哪里玩
12月25日,福建发改委主任孟芊谈2026年经济工作:福建数字化赋能智能化改造走在前列,今天,多只科技股成交额突破百亿元。截至收盘,中际旭创成交额为144.98亿元,居A股个股成交额第一名;新易盛、工业富联成交额均超130亿元;中国卫星、胜宏科技、寒武纪-U成交额超120亿元。,手机足球直播,万博狼队,BB体平台下载。
12月25日,专家:“十五五”需深刻认识和把握三项重要战略方针,西安咸阳机场T5,与北京大兴机场、成都天府机场航站楼面积相当。三座机场中规模最小的兰州中川机场T3,面积也相当于上海虹桥机场两座航站楼之和。,澳门金沙城官方网站黄,银河手机版登陆,威尼斯手机客户端网站。
责编:沃兹
审核:奥姆里-卡斯比
责编:金烨












