OpenAISora画的饼,AI行业集体给它圆了......吗?

原创 松果财经 2024-08-16 18:12


放弃期货,文生视频应用爆发

@松果财经原创

作者|在辉


AI文生视频领域,几乎只剩Sora还是个期货了。

         

 

最近两个月,国内外的AI-generated Video应用持续爆发,中国的快手、字节、智谱AI、生数科技、爱诗科技,海外的谷歌、Luma、Runway,格局如八仙过海。

         

 

虽然不同平台水平差异依旧存在,但整体可用性已经大大提高,而且风格化特征也比较全面。唯一的缺憾是,在融入工作流方面,AI视频工具们的水平还是差了一点。Sora画的饼,要交给这些后来者去圆了。

         

 

放弃期货

文生视频应用爆发


业界民间都把视频视为AI应用落地的重点领域。英伟达CEO黄仁勋在7月30日的全球顶级计算机图形学会议SIGGRAPH 2024上邀请了Meta的CEO扎克伯格进行对话,双方都认可视频能力会是AI大模型的进化方向。

         

 

出身于英伟达研究小组的Luma AI首席科学家宋佳铭,在与a16z合伙人Anjney Midha对谈时说,视频关联着3D世界,从学习角度看,视频数据使模型更好地理解和推理3D世界。所以,实时高质量的视频生成,最终会推动具身AI的发展。

         

 

视频就是这样一座“桥”,而现在大量的AI公司正在试图抢先通过它,尤其是OpenAI让Sora变成了外界用不到的期货,给了其他平台进一步发展的空间。


(整理自公开信息)


(图源:天眼查)


超长战线背后是这些公司的试探。一部分是关于商业模式,另一部分是关于技术应用前景。

         

 

可灵、即梦、Vidu等都推出了会员订阅模式,在C端进行应用普及化尝试。爱诗科技创始人王长虎此前在接受财新采访时表示:“爱诗目前的策略以2C(面向消费者)为主,广泛收集国内外用户反馈,以更好地基于用户体验迭代底层模型。”至于更远的应用,现在来谈则为时尚早,主要是因为C端的收费模式无法承担成本。

         

 

Luma AI采取了To C的产品形态,不过它原本专注于3D领域,进入视频生成领域是为了探索3D生成与重建的更多可能性,以视频驱动3D发展。这在产业领域有更多的应用前景,例如批量制造电影需要的三维素材等。

         

 

最重要的是,Luma AI的期望不是售卖技术或者素材,而是建立类似TikTok这样的平台,也就是一个基于3D的生态系统。王长虎也在和极客公园创始人张鹏对话时表示,爱诗科技也瞄准的是“AIGC时代的平台性机会”,但平台的形态暂时无法预测,因为AI产业不会以复制现在已有的平台的方式成长。

         

 

不仅如此,目前让AI-generated Video进入完整工作流的应用已经在成形。开源视频编辑工具Clapper最近热度上升,它的特色就是集合各类AI技术,用prompt的方式调动AI Agent生成和迭代故事,直接跳过了手工编辑文件的过程。


(图源:机器之心)


由此可见,AI-generated Video的进化速度远比我们想象得要快。目前,行业的重点无疑在于生成速度和生成效率两个方面。但是,大模型并不提供完全确定的商业模式方向,这更多取决于团队的选择。而在这个过程中,除了商业化之外,AI公司还要思考怎么避免陷入合规困境、成本困境。所以,把文生视频变得成熟并不容易,现在仅仅相当于ChatGPT刚刚问世的阶段。

         

 

AI-generated Video

的“硬伤”和突破口


a16z之前就发表过观点,巨头在从科研成果到商业产品的转化中需要更关注法律安全、版权等问题,所以往往效率会慢。我们不去考虑Sora是不是因为这个原因始终不露面,单看行业都要面对的相关问题,逻辑其实是一样的。

         

 

1.商业化的“落差”,目前的AI-generated Video很难满足甲方们的需求

         

 

彭博社曾报道,OpenAI一直试图向好莱坞推荐Sora,但并不成功。用Sora制作的第一则商业化广告是6月公开的玩具反斗城广告。然而,这则视频不但用了一些旧素材,公开新闻稿也没有说完全由AI生成。

         

 

导演Nik Kleverov还在一条已经删除的动态里表示,制作这些镜头的创意机构Native Foreign提供了大约十几个工作人员参与工作,Sora支持了80%到85%的流程。这对需要高效低成本的AI-generated Video来说算不上什么好消息。

         

 

2.训练成本、高质量数据集难以满足

         

 

视频的本质可以视为一系列图像,图像有很多公开的数据集,但是视频没有。OpenAI遇到过违规使用YouTube视频进行训练的指控,英伟达最近被媒体曝光从Netflix和YouTube收集了大量数据,用来训练自己的Cosmos项目,用于支持其AI产品往现实世界发展。它每天可以下载相当于80年的视频内容。

         

 

这体现了两个关键点:一是黄仁勋和Luma的观点类似,AI视频的发展确实对AI进入3D世界意义重大,英伟达也是这样做的:文本——图像——视频——三维模型——现实世界。二是视频数据集是个大问题,除了版权问题,这些视频数据还缺乏标签,斯坦福大学教授Stefano Ermon说,现阶段缺乏筛选和过滤好视频的方法,而且筛选后还要考虑它们的标签和描述。

         

 

3.AI资产泡沫的问题,AI必须为用户解决重要复杂的问题才能有价值,但现在它的发展成效,远远不能和互联网等技术当年初生时的情况相比

         

 

Benchmark合伙人Michael Eisenberg在最近的一期访谈中,引用了其好友Atreides Management创始人Gavin Baker关于大模型发展的观点:“基础模型是历史上贬值最快的资产。”

         

 

他所举的例子来自Seeking Alpha的创始人,类似金融领域这种每分钟都会进行业务和数据更新的高频领域,训练出来的模型只能完成写报告之类的常规工作,但无法应对数据的高速刷新,满足金融预测未来的需求。

         

 

而且,其他技术的发展是确定性的,互联网发展早期虽然泡沫巨大,但已经体现了应用路径;而AI浑身都是不确定性。互联网发展的边际成本几乎约等于0(或者说其中不少都分担给了运营商和用户),然而AI成长的边际成本涉及大量固定资产,现在都由创业者自己承担,而且越投入边际改善效应越弱。大量的早期投入,很可能是一个陷阱。

         

 

技术革命之后必须伴随产业革命,产业革命则需要现象级产品的引领。AI更需要的是一个成功的场景。目前看来,AI-generated Video还没有拿到这类成果的起色。

         

 

Perplexity的创始人Arin对此提供了另外一个观点,那就是基础模型的价值本质映射着背后团队的价值,即Sora之于OpenAI,文心大模型之于百度。不是Sora能革了视频的命,只是外界相信由OpenAI领导的Sora具备这样的可能性而已。当Sora没能提供符合我们预期的突破时,谁能在这个领域担起大任呢?

         

 

由此出发,关键或许在于谁能先把AI-generated Video真正融入到某一个商业系统的工作流中去,就像Clapper对视频制作的探索一样。而这就是一个更大的问题了,因为它涉及到和其他领域的融合——气象、城市、影视、汽车、制造业。也许Sora会在今年的某天拿出一个更具体的成果,也许是其他的创业公司颠覆了我们对AI视频的认知。


本文来源:松果财经(公众号:songguocaijing1)—— 解读财经热点事件,以独特视角带你挖掘新经济时代的商业机会。


关注下面公众号

和我一起探索港股市场的所有秘密


松果财经 解读财经热点事件,以独特的视角带你挖掘新经济时代的商业机会。
评论
  • 光耦合器,也称为光隔离器,是一种利用光在两个隔离电路之间传输电信号的组件。在医疗领域,确保患者安全和设备可靠性至关重要。在众多有助于医疗设备安全性和效率的组件中,光耦合器起着至关重要的作用。这些紧凑型设备经常被忽视,但对于隔离高压和防止敏感医疗设备中的电气危害却是必不可少的。本文深入探讨了光耦合器的功能、其在医疗应用中的重要性以及其实际使用示例。什么是光耦合器?它通常由以下部分组成:LED(发光二极管):将电信号转换为光。光电探测器(例如光电晶体管):检测光并将其转换回电信号。这种布置确保输入和
    腾恩科技-彭工 2025-01-03 16:27 128浏览
  • 本文继续介绍Linux系统查看硬件配置及常用调试命令,方便开发者快速了解开发板硬件信息及进行相关调试。触觉智能RK3562开发板演示,搭载4核A53处理器,主频高达2.0GHz;内置独立1Tops算力NPU,可应用于物联网网关、平板电脑、智能家居、教育电子、工业显示与控制等行业。查看系统版本信息查看操作系统版本信息root@ido:/# cat /etc/*releaseDISTRIB_ID=UbuntuDISTRIB_RELEASE=20.04DISTRIB_CODENAME=focalDIS
    Industio_触觉智能 2025-01-03 11:37 110浏览
  • Matter加持:新世代串流装置如何改变智能家居体验?随着现在智能家庭快速成长,串流装置(Streaming Device,以下简称Streaming Device)除了提供更卓越的影音体验,越来越多厂商开始推出支持Matter标准的串流产品,使其能作为智能家庭中枢,连结多种智能家电。消费者可以透过Matter的功能执行多样化功能,例如:开关灯、控制窗帘、对讲机开门,以及操作所有支持Matter的智能家电。此外,再搭配语音遥控器与语音助理,打造出一个更加智能、便捷的居家生活。支持Matter协议
    百佳泰测试实验室 2025-01-03 10:29 109浏览
  • 自动化已成为现代制造业的基石,而驱动隔离器作为关键组件,在提升效率、精度和可靠性方面起到了不可或缺的作用。随着工业技术不断革新,驱动隔离器正助力自动化生产设备适应新兴趋势,并推动行业未来的发展。本文将探讨自动化的核心趋势及驱动隔离器在其中的重要角色。自动化领域的新兴趋势智能工厂的崛起智能工厂已成为自动化生产的新标杆。通过结合物联网(IoT)、人工智能(AI)和机器学习(ML),智能工厂实现了实时监控和动态决策。驱动隔离器在其中至关重要,它确保了传感器、执行器和控制单元之间的信号完整性,同时提供高
    腾恩科技-彭工 2025-01-03 16:28 135浏览
  • 在测试XTS时会遇到修改产品属性、SElinux权限、等一些内容,修改源码再编译很费时。今天为大家介绍一个便捷的方法,让OpenHarmony通过挂载镜像来修改镜像内容!触觉智能Purple Pi OH鸿蒙开发板演示。搭载了瑞芯微RK3566四核处理器,树莓派卡片电脑设计,支持开源鸿蒙OpenHarmony3.2-5.0系统,适合鸿蒙开发入门学习。挂载镜像首先,将要修改内容的镜像传入虚拟机当中,并创建一个要挂载镜像的文件夹,如下图:之后通过挂载命令将system.img镜像挂载到sys
    Industio_触觉智能 2025-01-03 11:39 94浏览
  • 【工程师故事】+半年的经历依然忧伤,带着焦虑和绝望  对于一个企业来说,赚钱才是第一位的,对于一个人来说,赚钱也是第一位的。因为企业要活下去,因为个人也要活下去。企业打不了倒闭。个人还是要吃饭的。企业倒闭了,打不了从头再来。个人失业了,面对的不仅是房贷车贷和教育,还有找工作的焦虑。企业说,一个公司倒闭了,说明不了什么,这是正常的一个现象。个人说,一个中年男人失业了,面对的压力太大了,焦虑会摧毁你的一切。企业说,是个公司倒闭了,也不是什么大的问题,只不过是这些公司经营有问题吧。
    curton 2025-01-02 23:08 250浏览
  • 车身域是指负责管理和控制汽车车身相关功能的一个功能域,在汽车域控系统中起着至关重要的作用。它涵盖了车门、车窗、车灯、雨刮器等各种与车身相关的功能模块。与汽车电子电气架构升级相一致,车身域发展亦可以划分为三个阶段,功能集成愈加丰富:第一阶段为分布式架构:对应BCM车身控制模块,包含灯光、雨刮、门窗等传统车身控制功能。第二阶段为域集中架构:对应BDC/CEM域控制器,在BCM基础上集成网关、PEPS等。第三阶段为SOA理念下的中央集中架构:VIU/ZCU区域控制器,在BDC/CEM基础上集成VCU、
    北汇信息 2025-01-03 16:01 144浏览
  • 在科技飞速发展的今天,机器人已经逐渐深入到我们生活和工作的各个领域。从工业生产线上不知疲倦的机械臂,到探索未知环境的智能探测机器人,再到贴心陪伴的家用服务机器人,它们的身影无处不在。而在这些机器人的背后,C 语言作为一种强大且高效的编程语言,发挥着至关重要的作用。C 语言为何适合机器人编程C 语言诞生于 20 世纪 70 年代,凭借其简洁高效、可移植性强以及对硬件的直接操控能力,成为机器人编程领域的宠儿。机器人的运行环境往往对资源有着严格的限制,需要程序占用较少的内存和运行空间。C 语言具有出色
    Jeffreyzhang123 2025-01-02 16:26 143浏览
  • 影像质量应用于多个不同领域,无论是在娱乐、医疗或工业应用中,高质量的影像都是决策的关键基础。清晰的影像不仅能提升观看体验,还能保证关键细节的准确传达,例如:在医学影像中,它对诊断结果有着直接的影响!不仅如此,影像质量还影响了:▶ 压缩技术▶ 存储需求▶ 传输效率随着技术进步,影像质量的标准不断提高,对于研究与开发领域,理解并提升影像质量已成为不可忽视的重要课题。在图像处理的过程中,硬件与软件除了各自扮演着不可或缺的基础角色,有效地协作能够确保图像处理过程既高效又具有优异的质量。软硬件各扮演了什么
    百佳泰测试实验室 2025-01-03 10:39 89浏览
  • 前言近年来,随着汽车工业的快速发展,尤其是新能源汽车与智能汽车领域的崛起,汽车安全标准和认证要求日益严格,应用范围愈加广泛。ISO 26262和ISO 21448作为两个重要的汽车安全标准,它们在“系统安全”中扮演的角色各自不同,但又有一定交集。在智能网联汽车的高级辅助驾驶系统(ADAS)应用中,理解这两个标准的区别及其相互关系,对于保障车辆的安全性至关重要。ISO 26262:汽车功能安全的基石如图2.1所示,ISO 26262对“功能安全”的定义解释为:不存在由于电子/电气系统失效引起的危害
    广电计量 2025-01-02 17:18 200浏览
  • 物联网(IoT)的快速发展彻底改变了从智能家居到工业自动化等各个行业。由于物联网系统需要高效、可靠且紧凑的组件来处理众多传感器、执行器和通信设备,国产固态继电器(SSR)已成为满足中国这些需求的关键解决方案。本文探讨了国产SSR如何满足物联网应用的需求,重点介绍了它们的优势、技术能力以及在现实场景中的应用。了解物联网中的固态继电器固态继电器是一种电子开关设备,它使用半导体而不是机械触点来控制负载。与传统的机械继电器不同,固态继电器具有以下优势:快速切换:确保精确快速的响应,这对于实时物联网系统至
    克里雅半导体科技 2025-01-03 16:11 138浏览
  • 国际标准IPC 标准:IPC-A-600:规定了印刷电路板制造过程中的质量要求和验收标准,涵盖材料、外观、尺寸、焊接、表面处理等方面。IPC-2221/2222:IPC-2221 提供了用于设计印刷电路板的一般原则和要求,IPC-2222 则针对高可靠性电子产品的设计提供了进一步的指导。IPC-6012:详细定义了刚性基板和柔性基板的要求,包括材料、工艺、尺寸、层次结构、特征等。IPC-4101:定义了印刷电路板的基板材料的物理和电气特性。IPC-7351:提供了元件封装的设计规范,包括封装尺寸
    Jeffreyzhang123 2025-01-02 16:50 181浏览
  • 从无到有:智能手机的早期探索无线电话装置的诞生:1902 年,美国人内森・斯塔布菲尔德在肯塔基州制成了第一个无线电话装置,这是人类对 “手机” 技术最早的探索。第一部移动手机问世:1938 年,美国贝尔实验室为美国军方制成了世界上第一部 “移动” 手机。民用手机的出现:1973 年 4 月 3 日,摩托罗拉工程师马丁・库珀在纽约曼哈顿街头手持世界上第一台民用手机摩托罗拉 DynaTAC 8000X 的原型机,给竞争对手 AT&T 公司的朋友打了一个电话。这款手机重 2 磅,通话时间仅能支持半小时
    Jeffreyzhang123 2025-01-02 16:41 162浏览
  • 在快速发展的能源领域,发电厂是发电的支柱,效率和安全性至关重要。在这种背景下,国产数字隔离器已成为现代化和优化发电厂运营的重要组成部分。本文探讨了这些设备在提高性能方面的重要性,同时展示了中国在生产可靠且具有成本效益的数字隔离器方面的进步。什么是数字隔离器?数字隔离器充当屏障,在电气上将系统的不同部分隔离开来,同时允许无缝数据传输。在发电厂中,它们保护敏感的控制电路免受高压尖峰的影响,确保准确的信号处理,并在恶劣条件下保持系统完整性。中国国产数字隔离器经历了重大创新,在许多方面达到甚至超过了全球
    克里雅半导体科技 2025-01-03 16:10 89浏览
我要评论
0
点击右上角,分享到朋友圈 我知道啦
请使用浏览器分享功能 我知道啦