热点丨GPT-4.5正式发布,号称OpenAI最好的聊天模型

AI芯天下 2025-03-03 20:30

·聚焦:人工智能、芯片等行业

欢迎各位客官关注、转发






前言
GPT-4.5的发布被OpenAI视为[非思维链模型的最后一代],此后将转向需要长时间思考的推理模型。

这一转变与行业趋势紧密相连——自从DeepSeekR1开源引发推理热潮后,AI竞争的焦点已经从数据规模转向逻辑深度。


作者 | 方文三
图片来源 |  网 络 


OpenAI正式发布GPT-4.5


2月27日,OpenAI通过一段时长为13分钟的视频,正式发布了其迄今为止最为庞大的最新模型——GPT-4.5。


在介绍该模型时,OpenAI的研究副总裁MiaGlaese指出,GPT-4.5模型的显著特点是其能够进行充满热情、直观且自然流畅的对话,并且在理解用户需求方面展现出更为强大的能力。


GPT-4.5与o1在回答同一问题时的表现有所不同。


值得注意的是,GPT-4.5并非一个推理模型,而是迄今为止OpenAI所构建的规模最大、知识储备最为丰富的模型。


据透露,GPT-4.5的训练过程消耗了相当于GPT-4o十倍的计算资源,其性能的提升充分展示了预训练规模扩展所带来的显著效果。


在多项基准测试中,GPT-4.5的表现超越了GPT-4o,特别是在数学能力上提高了27%,在编码能力上提升了7%至10%。GPT-4.5在某些特定指标上甚至超越了o3-mini。


GPT-4.5的核心进步体现在无监督学习能力的增强。


通过增强计算资源和数据规模,该模型在执行复杂任务时表现出更高的精确度,特别是在降低[幻觉]现象(即错误生成信息)方面取得了显著成效。


这使得GPT-4.5在处理事实性问题时更为可靠,适用范围也更为广泛。



在减少幻觉和提高准确率方面,早期测试显示GPT-4.5具有较高的情感智能(EQ),能够根据对话情境调整其回应,尤其在处理与用户情感相关的交流时,展现了较高的同理心。


尽管其更高的[情商]、审美直觉和创造力主要依赖于无监督学习,GPT-4.5在推理能力方面也显示出强劲的实力。


GPT-4.5的显著升级体现在其对人类情感的深刻理解。


OpenAI的研究副总裁MiaGlaese强调,GPT-4.5的回应更加温馨、自然,并且能够通过语言调整用户的情绪状态。



更通用和更自然智能的模型


OpenAI明确指出,GPT-4.5在作出反应之前并不进行思考,这使得其优势与推理模型如o1等截然不同。


因此,与o1、o3-mini相比,GPT-4.5被认为是一种更通用、更自然智能的模型。


OpenAI坚信推理将成为未来模型的核心能力,而预训练和推理这两种扩展方法将相互补充。


随着GPT-4.5等模型通过预训练变得更加智能和知识渊博,它们将成为推理和使用工具的代理的更强大的基础。


在GPQA(科学)、AIME’24(数学)、SWE-BenchVerfied(编码)等数据集上,GPT-4.5全面领先于GPT-4o,但在数学和真实编程能力方面,仍略逊于o3-mini。


OpenAI已经开发出一系列先进的可扩展技术,这些技术使得GPT-4.5能够利用较小模型的数据集来训练更为庞大和强大的模型。


这些技术的引入显著提升了GPT-4.5的操作性、对细节的敏感度以及自然对话能力。



定价高于市面主力大模型


目前,GPT-4.5仅对ChatGPTPro用户开放,其订阅费用高达每月200美元,API使用成本则为输入75美元/百万token、输出150美元/百万token,是GPT-4o的30倍。


OpenAI坦承,模型训练消耗了大量GPU资源,因此迫切需要扩充数万张显卡以满足需求。


以输入数据缓存未命中为例,GPT-4.5的API费用是GPT-4o的三十倍,较之DeepSeek-V3(美元定价)则为二百七十七倍,与DeepSeek-R1(美元定价)相比则为一百三十六倍。


进一步比较,即便是在DeepSeek的优惠时段,GPT-4.5的费用也达到了前者的五百五十五倍。


GPT-4.5的API定价出乎意料地高,不仅高于自家主力大模型,甚至比新推出的全球首个混合推理模型Claude-3.7-Sonnet高出二十五倍,更不用说与刚刚宣布错峰定价的[价格屠夫]DeepSeek相比了。


GPT-4.5的计算效率相较于GPT-4实现了超过十倍的提升。


在API层面,ChatCompletionsAPI、AssistantsAPI和BatchAPI将向所有付费开发者提供预览,支持函数调用等关键功能及图像输入视觉功能,适用于写作辅助等应用场景。


然而,由于模型庞大且计算密集,成本较高,官方正在评估是否长期在API中提供该服务。



将与kimi、DeepSeek展开竞争


目前,OpenAI的市值已超过1570亿美元(约合人民币1.1万亿元)。


最近,奥尔特曼公开透露,OpenAI正在考虑根据使用量来设定价格策略。


至于何时能够实现通用人工智能(AGI),他指出,当一个AI系统能够执行一个熟练人士在关键工作中所能完成的任务时,即可称之为AGI。


值得注意的是,在今天凌晨,月之暗面kimi再次发布最新版本的Kimi-K1.6-IOI-high模型,该模型在LiveCodeBench基准测试中排名第一,超越了GPT和Claude系列模型。


同时,DeepSeek的开源周活动持续吸引公众关注,包括发布了专为英伟达HopperGPU设计的MLA解码内核FlashMLA、EP通信库DeepEP、FP8GEMM(通用矩阵乘法)计算库DeepGEMM等。


据公开资料,2024年全年,OpenAI的销售收入约为37亿美元,同比增长超过1700%。


预计到2025年,OpenAI的年化收入将增长至116亿美元,其中75%的收入来源于用户对ChatGPTPlus服务的订阅。


内部预估,到2029年全年,OpenAI的营收将达到1000亿美元,相当于目前雀巢公司的年销售额。


GPT-4.5象征着一个时代的终结


OpenAI宣布,GPT-4.5将是其聊天机器人系统中最后一个不包含[思维链推理]功能的版本。


继GPT-4.5之后,OpenAI的模型将可能模仿人类的思考方式,花费更多时间深入思考问题后再给出回答,而不是立即作出反应。


GPT-4.5代表了OpenAI最后一个[非思维链]模型。


基于GPT-4.5,OpenAI计划优化其产品线,为GPT-5的重大创新做好准备,并奠定采用新方法的基础。


山姆·奥特曼指出,过多的模型会使用户感到困惑,而未来的GPT-5将成为一个重要里程碑,它将整合OpenAI的所有技术进步。


其中最大的创新在于它与之前独立的o系列模型的融合。


OpenAI表示,它将把o3模型中的大部分技术整合进GPT-5,这实际上意味着o3模型将不再作为一个独立的产品存在。


换言之,GPT-5将融合两个并行发展的[AI大脑]的优势。


业界推测,GPT-5可能会扮演[路由器模型]的角色,根据需要协调各种内部组件或子模型。


用户只需与GPT-5交互,而GPT-5将利用不同的工具和知识资源来寻找最佳解决方案,这可能包括访问搜索引擎、执行计算或使用代码解释工具,具体取决于任务需求。



结尾:在收购OpenAI未果后计划


GPT-4.5的发布不仅是技术上的进步,更是AI人性化的重要里程碑。


它用情商重新定义了人机交互,用知识的广度赋能实际应用场景,同时也因高昂的成本引发了争议。


随着推理模型的到来,AI有望真正融入人类生活,成为工作与情感的[双重助手]。


对于普通用户而言,如何在性能与成本之间找到平衡,将是接下来最实际的挑战。


部分资料参考:凤凰网科技:《史上最贵AI模型上线,主打情商高,奥特曼竟因"带娃"缺席发布会?》,网站知识:《OpenAI发布GPT-4.5:高情商AI引发全网热议》,机器之心:《OpenAI迄今最大、最贵模型,API价格飞涨30倍,不拼推理拼情商》,DeepTech深科技:《OpenAI发布号称[情商最高]的AI模型,奥特曼称GPU已用完》,雷科技:《价格是DeepSeek277倍!GPT-4.5还是太自信了》,钛媒体AGI:《6年来最强模型GPT-4.5登场:更贵、更高情商、更少幻觉》

本公众号所刊发稿件及图片来源于网络,仅用于交流使用,如有侵权请联系回复,我们收到信息后会在24小时内处理。




END


推荐阅读:


商务合作请加微信勾搭:
18948782064

请务必注明:

「姓名 + 公司 + 合作需求」


AI芯天下 聚焦人工智能,AI芯片,5G通讯等行业动态
评论 (0)
  •   卫星通信效能评估系统平台全面解析   北京华盛恒辉卫星通信效能评估系统平台是衡量卫星通信系统性能、优化资源配置、保障通信服务质量的关键技术工具。随着卫星通信技术的快速发展,特别是低轨卫星星座、高通量卫星和软件定义卫星的广泛应用,效能评估系统平台的重要性日益凸显。以下从技术架构、评估指标、关键技术、应用场景及发展趋势五个维度进行全面解析。   应用案例   目前,已有多个卫星通信效能评估系统在实际应用中取得了显著成效。例如,北京华盛恒辉和北京五木恒润卫星通信效能评估系统。这些成功案例为卫
    华盛恒辉l58ll334744 2025-04-22 16:34 148浏览
  • 前言本文主要演示基于TL3576-MiniEVM评估板HDMI OUT、DP 1.4和MIPI的多屏同显、异显方案,适用开发环境如下。Windows开发环境:Windows 7 64bit、Windows 10 64bitLinux开发环境:VMware16.2.5、Ubuntu22.04.5 64bitU-Boot:U-Boot-2017.09Kernel:Linux-6.1.115LinuxSDK:LinuxSDK-[版本号](基于rk3576_linux6.1_release_v
    Tronlong 2025-04-23 13:59 82浏览
  • 一、技术背景与市场机遇在智能家居高速发展的今天,用户对家电设备的安全性、智能化及能效表现提出更高要求。传统取暖器因缺乏智能感知功能,存在能源浪费、安全隐患等痛点。WTL580-C01微波雷达感应模块的诞生,为取暖设备智能化升级提供了创新解决方案。该模块凭借微波雷达技术优势,在精准测距、环境适应、能耗控制等方面实现突破,成为智能取暖器领域的核心技术组件。二、核心技术原理本模块采用多普勒效应微波雷达技术,通过24GHz高频微波信号的发射-接收机制,实现毫米级动作识别和精准测距。当人体进入4-5米有效
    广州唯创电子 2025-04-23 08:41 121浏览
  •   复杂电磁环境模拟系统平台解析   一、系统概述   北京华盛恒辉复杂电磁环境模拟系统平台是用于还原真实战场或特定场景电磁环境的综合性技术平台。该平台借助软硬件协同运作,能够产生多源、多频段、多体制的电磁信号,并融合空间、时间、频谱等参数,构建高逼真度的电磁环境,为电子对抗、通信、雷达等系统的研发、测试、训练及评估工作提供重要支持。   应用案例   目前,已有多个复杂电磁环境模拟系统在实际应用中取得了显著成效。例如,北京华盛恒辉和北京五木恒润复杂电磁环境模拟系统。这些成功案例为复杂电
    华盛恒辉l58ll334744 2025-04-23 10:29 133浏览
  • 一、行业背景与市场需求高血压作为全球发病率最高的慢性病之一,其早期监测与管理已成为公共卫生领域的重要课题。世界卫生组织数据显示,全球超13亿人受高血压困扰,且患者群体呈现年轻化趋势。传统血压计因功能单一、数据孤立等缺陷,难以满足现代健康管理的需求。在此背景下,集语音播报、蓝牙传输、电量检测于一体的智能血压计应运而生,通过技术创新实现“测量-分析-管理”全流程智能化,成为慢性病管理的核心终端设备。二、技术架构与核心功能智能血压计以电子血压测量技术为基础,融合物联网、AI算法及语音交互技术,构建起多
    广州唯创电子 2025-04-23 09:06 131浏览
  •   电磁频谱数据综合管理平台系统解析   一、系统定义与目标   北京华盛恒辉电磁频谱数据综合管理平台融合无线传感器、软件定义电台等前沿技术,是实现无线电频谱资源全流程管理的复杂系统。其核心目标包括:优化频谱资源配置,满足多元通信需求;运用动态管理与频谱共享技术,提升资源利用效率;强化频谱安全监管,杜绝非法占用与干扰;为电子战提供频谱监测分析支持,辅助作战决策。   应用案例   目前,已有多个电磁频谱数据综合管理平台在实际应用中取得了显著成效。例如,北京华盛恒辉和北京五木恒润电磁频谱数
    华盛恒辉l58ll334744 2025-04-23 16:27 118浏览
  •   无人机结构仿真与部件拆解分析系统平台解析   北京华盛恒辉无人机结构仿真与部件拆解分析系统无人机技术快速发展的当下,结构仿真与部件拆解分析系统平台成为无人机研发测试的核心工具,在优化设计、提升性能、降低成本等方面发挥关键作用。以下从功能、架构、应用、优势及趋势展开解析。   应用案例   目前,已有多个无人机结构仿真与部件拆解分析系统在实际应用中取得了显著成效。例如,北京华盛恒辉和北京五木恒润无人机结构仿真与部件拆解分析系统。这些成功案例为无人机结构仿真与部件拆解分析系统的推广和应用提
    华盛恒辉l58ll334744 2025-04-23 15:00 133浏览
  •   后勤实验仿真系统平台深度解析   北京华盛恒辉后勤实验仿真系统平台依托计算机仿真技术,是对后勤保障全流程进行模拟、分析与优化的综合性工具。通过搭建虚拟场景,模拟资源调配、物资运输等环节,为后勤决策提供数据支撑,广泛应用于军事、应急管理等领域。   应用案例   目前,已有多个后勤实验仿真系统平台在实际应用中取得了显著成效。例如,北京华盛恒辉和北京五木恒润后勤实验仿真系统平台。这些成功案例为后勤实验仿真系统平台的推广和应用提供了有力支持。   一、核心功能   (一)后勤资源模拟
    华盛恒辉l58ll334744 2025-04-23 15:39 90浏览
  • 在科技飞速发展的当下,机器人领域的每一次突破都能成为大众瞩目的焦点。这不,全球首届人形机器人半程马拉松比赛刚落下帷幕,赛场上的 “小插曲” 就掀起了一阵网络热潮。4月19日,北京亦庄的赛道上热闹非凡,全球首届人形机器人半程马拉松在这里激情开跑。20支机器人队伍带着各自的“参赛选手”,踏上了这21.0975公里的挑战之路。这场比赛可不简单,它将机器人放置于真实且复杂的动态路况与环境中,对机器人在运动控制、环境感知和能源管理等方面的核心技术能力进行了全方位的检验。不仅要应对长距离带来的续航挑战,还要
    用户1742991715177 2025-04-22 20:42 89浏览
  • 文/Leon编辑/cc孙聪颖‍在特朗普政府发起的关税战中,全球芯片产业受到巨大冲击,美国芯片企业首当其冲。据报道称,英伟达本周二公布的8-K文件显示,美国政府通知该公司向中国(包括中国香港及澳门)销售尖端芯片(H20)时,需要获得美国政府的许可。文件发布后,英伟达预计会在第一季度中额外增加55亿美元的相关费用计提。随后,英伟达股价单日下跌6.9%,市值一夜蒸发约1890亿美元(约合人民币1.37万亿元)。至截稿时,至截稿时,其股价未见止跌,较前日下跌4.51%。北京时间4月17日,英伟达创始人、
    华尔街科技眼 2025-04-22 20:14 87浏览
  • 文/Leon编辑/cc孙聪颖‍4月18日7时,2025北京亦庄半程马拉松暨人形机器人半程马拉松正式开跑。与普通的半马比赛不同,这次比赛除了有人类选手,还有21支人形机器人队伍参赛,带来了全球首次人类与机器人共同竞技的盛况。参赛队伍中,不乏明星机器人企业及机型,比如北京人形机器人创新中心的天工Ultra、松延动力的N2等。宇树G1、众擎PM01,则是由城市之间科技有限公司购置及调试,并非厂商直接参赛。考虑到机器人的适用场景和续航力各有不同,其赛制也与人类选手做出区别:每支赛队最多可安排3名参赛选手
    华尔街科技眼 2025-04-22 20:10 89浏览
  •   陆地边防事件紧急处置系统平台解析   北京华盛恒辉陆地边防事件紧急处置系统平台是整合监测、预警、指挥等功能的智能化综合系统,致力于增强边防安全管控能力,快速响应各类突发事件。以下从系统架构、核心功能、技术支撑、应用场景及发展趋势展开全面解读。   应用案例   目前,已有多个陆地边防事件紧急处置系统在实际应用中取得了显著成效。例如,北京华盛恒辉和北京五木恒润陆地边防事件紧急处置系统。这些成功案例为陆地边防事件紧急处置系统的推广和应用提供了有力支持。   一、系统架构   感知层:部
    华盛恒辉l58ll334744 2025-04-23 11:22 103浏览
  • 故障现象一辆2016款奔驰C200L车,搭载274 920发动机,累计行驶里程约为13万km。该车组合仪表上的防侧滑故障灯、转向助力故障灯、安全气囊故障灯等偶尔异常点亮,且此时将挡位置于R挡,中控显示屏提示“后视摄像头不可用”,无法显示倒车影像。 故障诊断用故障检测仪检测,发现多个控制单元中均存储有通信类故障代码(图1),其中故障代码“U015587 与仪表盘的通信存在故障。信息缺失”出现的频次较高。 图1 存储的故障代码1而组合仪表中存储有故障代码“U006488 与用户界
    虹科Pico汽车示波器 2025-04-23 11:22 67浏览
我要评论
0
0
点击右上角,分享到朋友圈 我知道啦
请使用浏览器分享功能 我知道啦