科大讯飞:星火大模型快进入Next-level了

原创 松果财经 2024-07-05 17:49


自力更生,星火大模型成国产力量代言人

@松果财经原创

作者| 在辉


OpenAI一纸禁令,挑动了大模型行业的神经。但没有什么阻碍,可以抵挡技术向上的决心。在不少大模型厂商开出优惠价格,试图从OpenAI禁令中截流用户的同时,国产大模型的代表企业科大讯飞,拿出了直面技术挑战的勇气。


6月27日,科大讯飞在北京国家会议中心举行讯飞星火4.0发布会。在“懂你的AI助手”这个主题下,讯飞星火大模型不但在8个国际主流测试集中排名第一,实现了对GPT-4 Turbo的全面对标,还对商业化落地、生产力探索做出了更全面的阐释,前瞻了行业的“Next-level”。

         

 

这一次,星火大模型掀起了新的巨浪。

         

 

自力更生

星火大模型成国产力量代言人


在国内外总共覆盖中英文的12项主流测试集,讯飞星火大模型V4.0在其中8项全面超越了GPT-4 Turbo、Claude 3 Opus、Gemini 1.5 Pro。后面这三位,正是目前英文世界大模型的战力天花板选手。


换一个指标,去年,科大讯飞参与设计了国产通用认知智能大模型测评体系,包含由481个测试项组成的7个方面。而如今,星火大模型V4.0在其中的文本生成、语言理解、知识问答、逻辑推理、数学能力五个方面超越了GPT-4 Turbo,仅在代码能力和多模态能力上仍有一定差距。

         

 

不过从数据来看,文本生成(80.2%)、语言理解(82.3%)、知识问答(85.7%)、逻辑推理(82.2%)、数学能力(86.5%)、代码能力(81.2%)、多模态能力(78.4%)这组数据放在一起,星火大模型V4.0总体已然算是国产大模型的能力代表。

         

 

具体来看,GPT-4 Turbo、Claude 3 Opus和星火大模型V4.0,重点都放在多维度信息组成的复杂指令、更考验逻辑任务能力的空间推理等高阶能力上。根据科大讯飞发布会现场的介绍,星火大模型V4.0不仅在长文本等通用能力上整体打平GPT-4 Turbo,而且更加擅长利用已有资料进行联系推理——比如解读几张有联系的图片的关系,为其补全内容情节,并减少“幻觉”的出现。    

         

 

有趣的地方在于,星火大模型V4.0其实在多模态能力方面,实现了对GPT4-Turbo的部分超越,比如科研、金融、医疗、司法和办公等专业领域的图文识别能力。这代表星火大模型V4.0的侧重点明显不同于普通的通用大模型。它更侧重于某些垂直领域的应用潜力。

         

 

对此,科大讯飞董事长刘庆峰在演讲中做了一些阐述:“大模型不仅可以写诗、作画,在改变工业、改变科研范式等方面已经实实在在发挥作用,包括我们和中国科学技术大学做的合成类的科学创新,比如说化学;还有与合肥综合性国家科学中心能源研究院合作,在推进大模型赋能核聚变整个过程中更快地预测、更好地应对各种各样的异常情况。”

         

 

应用,已经成为星火大模型V4.0的重头戏。只有真正用起来,能力才会有价值。

         

 

以讯飞星火APP为例,自2023年9月全面开放以来,讯飞星火APP在安卓公开市场累计下载量达1.31亿次。现在,全新升级的讯飞星火APP,允许消费者用自己的知识库打造“更懂你的AI助手”。换句话说,专属于个体的智能体。


按照刘庆峰在演讲中透露的信息,讯飞星火APP使用的高峰期是工作日的工作时间段,意味着它真的变成了不少用户的刚需。这是对“AI只能用来玩玩”的刻板印象的有力回击,也是星火大模型价值的体现。    

         

 

但更让人激动的应用,其实还在蓄力。个人能从星火大模型中找到助手,企业乃至社会,将从中汲取更大的力量。这就是整个大模型产业的“Next-level”,它的亮点就在落地的最后一公里,以及那些暂时还是畅想的形式。

         

 

真正的Next-level

藏在最后一公里


几个简单的问题,可以让我们对星火大模型V4.0的未来进化更有数。

         

 

首先,智能体为什么值得期待?九合创投在近日召开的年会上发布了《不朽的计算:比特连接世界,词元生成未来》报告。其中提到,“模型是能够沉淀智慧的计算形态”。传统算法是数学结果,一次使用不具备普及性。但模型可以持续进化,适应多维度的使用需求。而封装为智能体之后的超级模型,已经是特定领域的智慧结晶。它具有不可估量的复用价值。



以星火企业智能体平台为例,科大讯飞已经首批创建了32个企业智能体,可以深入业务流程,满足企业的需求。而这个过程其实非常轻松,企业只需要提出需求就可以开始创建智能体,经过功能验证后,就可以真实上马,并可以和企业内部办公平台打通。    

         

 

从市场价值来看,讯飞星火大模型从去年发布到现在,已经和国家能源集团、中国石油、中国移动、交通银行、大众汽车、海尔集团、美的集团等行业领军企业建立合作,证明其使用价值得到一线认可。

         

 

其次,为什么是讯飞?因为企业智能的底层除了大模型技术,还有对企业业务的理解,对分门别类的场景的认知,这不是坐在办公室里就能拍脑袋想出来的。讯飞建立这些认知,花费了数十年的时间和遍布各行各业的具体尝试。所以,智能体是新物种,但在讯飞和星火大模型的共同支持下,它会很快和现有生态相融。

         

 

换句话说,讯飞的领先,是星火大模型的技术领先和自身To B和To G业务领先的复合结果。2024年6月,讯飞刚刚荣获国家科学技术进步奖一等奖,获奖项目名为“多语种智能语音关键技术及产业化”,技术和产业化的双剑合璧,成为一块勋章。上半场的技术较量,讯飞能和OpenAI掰手腕。下半场的应用较量,讯飞更懂中国市场。

         

 

最后,星火大模型V4.0背后的进化,对智能体概念的探索,远期价值恐怕会远超普通人的想象。目前,还只是这个概念的蓄力阶段。

         

 

一个很关键的问题是,从GPT-4 Turbo到星火大模型V4.0,我们越来越关注大模型的多模态能力、空间和逻辑推理能力、对复杂指令的理解和执行能力等等。这种需求引导下发展的大模型和智能体,注定用于和现实世界融合交互。    

         

 

现代机器人之父罗德尼·布鲁克斯(Rodney Brooks)在1991年发表的《没有表征的智能》论文中提出,传统智能基于复杂算法和内部数据模型是错误和片面的,真正的智能行为要从自主机器与环境的物理交互中产生。这个想法更加适合今天大模型和智能体的发展,或者说“具身智能”的概念——能理解和推理物理世界,并且产生互动。

         

 

“AI教母”李飞飞选择的创业方向就是与之类似的“空间智能”。她曾在TED的演讲上举过一个例子——一张猫伸出爪子将玻璃杯推向桌子边缘的图片。她说,人类大脑可以评估“这个玻璃杯的几何形状,它在三维空间中的位置,它与桌子、猫和所有其他东西的关系”,所有推理都基于这些认知。



无疑,星火大模型V4.0也好,GPT-4 Turbo也罢,都是在朝着这种意义上的智能发展。

         

 

刘庆峰曾提出星火大模型的四条商业化路径,其中一条就是基于“超脑2030计划”推动机器人走进千家万户,重头戏在于全栈机器人能力,而这又源于大模型的多模感知和多维表达。

         

 

    

对科大讯飞来说,好消息是它所掌握的应用经验,很有可能让星火大模型在向空间智能、具身智能的发展过程中步步领先。比如现在,星火个人智能体和企业智能体的落地,其实已经在调动现实要素对大模型和智能体进行完善。只不过,目前的应用停留在数字空间,还没有深入现实进行交互。

         

 

但我们相信,这一天会比想象的更早到来。毕竟,从去年的星火大模型1.0版本到如今的4.0版本,科大讯飞从无到有,创造出世界一流的大模型能力和应用,已然是一个奇迹。

         

 

而在当下这个世界中,地缘层面的割裂已经影响到大模型世界的完整性。当OpenAI发出断供宣言,有星火大模型这样的一线玩家能够顶上,不得不说是中国大模型产业的幸运。在这一年,中国人工智能领域的实力,正在这些领先者身上,闪耀着新的光芒。


本文来源:松果财经(公众号:songguocaijing1)—— 解读财经热点事件,以独特视角带你挖掘新经济时代的商业机会。


关注下面公众号

和我一起探索港股市场的所有秘密


松果财经 解读财经热点事件,以独特的视角带你挖掘新经济时代的商业机会。
评论
  •     IPC-2581是基于ODB++标准、结合PCB行业特点而指定的PCB加工文件规范。    IPC-2581旨在替代CAM350格式,成为PCB加工行业的新的工业规范。    有一些免费软件,可以查看(不可修改)IPC-2581数据文件。这些软件典型用途是工艺校核。    1. Vu2581        出品:Downstream     
    电子知识打边炉 2025-01-22 11:12 339浏览
  • 飞凌嵌入式基于瑞芯微RK3562系列处理器打造的FET3562J-C全国产核心板,是一款专为工业自动化及消费类电子设备设计的产品,凭借其强大的功能和灵活性,自上市以来得到了各行业客户的广泛关注。本文将详细介绍如何启动并测试RK3562J处理器的MCU,通过实际操作步骤,帮助各位工程师朋友更好地了解这款芯片。1、RK3562J处理器概述RK3562J处理器采用了4*Cortex-A53@1.8GHz+Cortex-M0@200MHz架构。其中,4个Cortex-A53核心作为主要核心,负责处理复杂
    飞凌嵌入式 2025-01-24 11:21 230浏览
  • 临近春节,各方社交及应酬也变得多起来了,甚至一月份就排满了各式约见。有的是关系好的专业朋友的周末“恳谈会”,基本是关于2025年经济预判的话题,以及如何稳定工作等话题;但更多的预约是来自几个客户老板及副总裁们的见面,他们为今年的经济预判与企业发展焦虑而来。在聊天过程中,我发现今年的聊天有个很有意思的“点”,挺多人尤其关心我到底是怎么成长成现在的多领域风格的,还能掌握一些经济趋势的分析能力,到底学过哪些专业、在企业管过哪些具体事情?单单就这个一个月内,我就重复了数次“为什么”,再辅以我上次写的:《
    牛言喵语 2025-01-22 17:10 399浏览
  • 随着AI大模型训练和推理对计算能力的需求呈指数级增长,AI数据中心的网络带宽需求大幅提升,推动了高速光模块的发展。光模块作为数据中心和高性能计算系统中的关键器件,主要用于提供高速和大容量的数据传输服务。 光模块提升带宽的方法有两种:1)提高每个通道的比特速率,如直接提升波特率,或者保持波特率不变,使用复杂的调制解调方式(如PAM4);2)增加通道数,如提升并行光纤数量,或采用波分复用(CWDM、LWDM)。按照传输模式,光模块可分为并行和波分两种类型,其中并行方案主要应用在中短距传输场景中成本
    hycsystembella 2025-01-25 17:24 284浏览
  • 前篇文章中『服务器散热效能不佳有解吗?』提到气冷式的服务器其散热效能对于系统稳定度是非常重要的关键因素,同时也说明了百佳泰对于散热效能能提供的协助与服务。本篇将为您延伸说明我们如何进行评估,同时也会举例在测试过程中发现的问题及改善后的数据。AI服务器的散热架构三大重点:GPU导风罩:尝试不同的GPU导风罩架构,用以集中服务器进风量,加强对GPU的降温效果。GPU托盘:改动GPU托盘架构,验证出风面积大小对GPU散热的影想程度。CPU导风罩:尝试封闭CPU导风罩间隙,集中风流,验证CPU降温效果。
    百佳泰测试实验室 2025-01-24 16:58 134浏览
  • 嘿,咱来聊聊RISC-V MCU技术哈。 这RISC-V MCU技术呢,简单来说就是基于一个叫RISC-V的指令集架构做出的微控制器技术。RISC-V这个啊,2010年的时候,是加州大学伯克利分校的研究团队弄出来的,目的就是想搞个新的、开放的指令集架构,能跟上现代计算的需要。到了2015年,专门成立了个RISC-V基金会,让这个架构更标准,也更好地推广开了。这几年啊,这个RISC-V的生态系统发展得可快了,好多公司和机构都加入了RISC-V International,还推出了不少RISC-V
    丙丁先生 2025-01-21 12:10 1148浏览
  • 书接上回:【2022年终总结】阳光总在风雨后,启航2023-面包板社区  https://mbb.eet-china.com/blog/468701-438244.html 总结2019,松山湖有个欧洲小镇-面包板社区  https://mbb.eet-china.com/blog/468701-413397.html        2025年该是总结下2024年的喜怒哀乐,有个好的开始,才能更好的面对2025年即将
    liweicheng 2025-01-24 23:18 255浏览
  • 高速先生成员--黄刚这不马上就要过年了嘛,高速先生就不打算给大家上难度了,整一篇简单但很实用的文章给大伙瞧瞧好了。相信这个标题一出来,尤其对于PCB设计工程师来说,心就立马凉了半截。他们辛辛苦苦进行PCB的过孔设计,高速先生居然说设计多大的过孔他们不关心!另外估计这时候就跳出很多“挑刺”的粉丝了哈,因为翻看很多以往的文章,高速先生都表达了过孔孔径对高速性能的影响是很大的哦!咋滴,今天居然说孔径不关心了?别,别急哈,听高速先生在这篇文章中娓娓道来。首先还是要对各位设计工程师的设计表示肯定,毕竟像我
    一博科技 2025-01-21 16:17 220浏览
  • 项目展示①正面、反面②左侧、右侧项目源码:https://mbb.eet-china.com/download/316656.html前言为什么想到要做这个小玩意呢,作为一个死宅,懒得看手机,但又想要抬头就能看见时间和天气信息,于是就做个这么个小东西,放在示波器上面正好(示波器外壳有个小槽,刚好可以卡住)功能主要有,获取国家气象局的天气信息,还有实时的温湿度,主控采用ESP32,所以后续还可以开放更多奇奇怪怪的功能,比如油价信息、股票信息之类的,反正能联网可操作性就大多了原理图、PCB、面板设计
    小恶魔owo 2025-01-25 22:09 375浏览
  • 不让汽车专美于前,近年来哈雷(Harley-Davidson)和本田(Honda)等大型重型机车大厂的旗下车款皆已陆续配备车载娱乐系统与语音助理,在路上也有越来越多的普通机车车主开始使用安全帽麦克风,在骑车时透过蓝牙连线执行语音搜寻地点导航、音乐播放控制或免持拨打接听电话等各种「机车语音助理」功能。客户背景与面临的挑战以本次分享的客户个案为例,该客户是一个跨国车用语音软件供货商,过往是与车厂合作开发前装车机为主,且有着多年的「汽车语音助理」产品经验。由于客户这次是首度跨足「机车语音助理」产品,因
    百佳泰测试实验室 2025-01-24 17:00 157浏览
  • 故障现象 一辆2007款日产天籁车,搭载VQ23发动机(气缸编号如图1所示,点火顺序为1-2-3-4-5-6),累计行驶里程约为21万km。车主反映,该车起步加速时偶尔抖动,且行驶中加速无力。 图1 VQ23发动机的气缸编号 故障诊断接车后试车,发动机怠速运转平稳,但只要换挡起步,稍微踩下一点加速踏板,就能感觉到车身明显抖动。用故障检测仪检测,发动机控制模块(ECM)无故障代码存储,且无失火数据流。用虹科Pico汽车示波器测量气缸1点火信号(COP点火信号)和曲轴位置传感器信
    虹科Pico汽车示波器 2025-01-23 10:46 256浏览
我要评论
0
点击右上角,分享到朋友圈 我知道啦
请使用浏览器分享功能 我知道啦