OpenAI新年开出“王炸”,AI竞争升级

文|伯虎财经 陈平安

Open AI又刷屏了。

2023年年初,OPEN AI就曾引爆全球科技圈。

因为其发布了一个全新的聊天机器人模型—— ChatGPT。和过去那些简单的聊天机器人相比,ChatGPT不仅可以回答人类的追问,承认自己回答中的错误,拒绝回答不适当的问题,还能写诗、编程、写论文等等。

连马斯克都忍不住感叹:“ChatGPT好得吓人,我们离强大到危险的人工智能不远了。”距离发布后仅两个月,ChatGPT月活用户就达到了1亿,为其母公司OpenAI拉来了微软100亿美元的下注。

2024年年初,相似的故事又在上演。

2月16日凌晨,OpenAI 在 AI 生成视频领域扔出一枚“王炸”,宣布推出全新的生成式人工智能模型“Sora”。

在 OpenAI 官网分享的演示视频中,Sora 可以直接输出有多个角色、多种场景和运镜的画面。这对比一年前 AI 生成的视频,简直是天差地别,其视频长度方面就“碾压”同行。

据了解,通过文本指令,Sora可以直接输出长达60秒的视频,且视频的精致程度远超大部分人的想象。

这意味着,继文本、图像之后,OpenAI将其先进的AI技术拓展到了视频领域。

马斯克也再次评价了 OpenAI 视频模型:“AI 增强的人类将在未来几年里创造出最好的作品。”

01 Sora让人惊艳的到底是什么?

一方面是技术上的突破。

Sora 能够生成长达 1 分钟的超长视频,远超Runway-gen2 的 18 秒和 Pika 的 3 秒。

更重要的是,相比之前AI视频明显的“AI感”不同,Sora制作的视频在逼真度和画面精致程度将整个AI视频行业提升到 next level。

从官网视频来看,人物脸上的黑痣粉刺,地面积水倒映的霓虹光影等等,其细节的精细度几乎已经做到了以假乱真。换句话来说,Sora 创作的视频质量,无论是高清度还是还原度,都是可圈可点的。

另一方面,同样引人关注的是,Sora理解长文本的能力。OpenAI在官方博客中写道,“Sora不仅可以理解用户的需求,还知道这些事物在现实世界如何存在。”

什么意思呢?只需要输入一段文本,Sora就能自动生成最长一分钟的高清视频。让人惊艳的是,Sora不仅可以准确把握用户文本中的复杂意思,并且还能分拆出不同的元素,将其转换为有具体创意构思的视频内容,看起来就像是专业导演、摄像和剪辑的作品。

比如 Sora以“色彩缤纷的鱼类和海洋生物充斥的,由纸艺精心构建的珊瑚礁世界”为主题的视频中, Sora 通过其摄影角度和拍摄时机,成功地推进了故事的发展。视频中实际上发生了多次镜头转换,这些没有特别指令它这么做,它却能自动完成。

据内行人士透露,像是Sora生成的视频,就算是头部动画制作公司都需要数日时间完成,而Sora只需要几分钟搞定。

国盛证券认为 Sora 相比此前其他文生视频模型,已经跨越到实用生产力工具,1 分钟长度有望大规模应用在短视频领域,扩展视频的能力也有望制作长视频,或将带来新一轮内容创作产业革命。

当然,Sora并不完美。OpenAI官网指出它可能难以准确模拟复杂场景的物理原理,并且可能无法理解因果关系,混淆提示的空间细节。

以此次发布的DEMO“与中国龙一起庆祝农历新年的视频”为例,Sora无法准确生成视频画面中的中文,还被网友调侃调侃“都怪中文太难了?”以及视频中老人生日蛋糕蜡烛,但蜡烛火苗前面却没有丝毫变化等等。

但OpenAI的团队,让AI能从最初的模糊分辨不清的图像,进步到目前足以生成长视频的阶段,可见其发展可怖。

B站一位网友是这么评价的:

“sora出之前我还在给gpt5心里打一个问号,到底能提升多少,openai还能继续领跑么,但现在我是真的服了,真的是比其他厂牛逼不止一点,一出手就是降维打击,sora也是transform架构,这不就是gpt5的一部分么,之前网上说gpt5看完了互联网的所有视频我还不信,现在我信了”。

02 竞争升级

Sora最直接的影响的肯定是对视频行业的冲击。作为一种视频生成工具,Sora仅需文字就可以生成60秒时长的精细视频,大大降低了视频制作的门槛和成本,特别是热点类等具备强烈时效性的内容。

不过Sora更深层的意义在于,这也意味着有关AI的竞争再度升级。

2023年,ChatGPT的发布引领全球进入AI热潮,光是中国公司就发布了超过130个大模型。起初,大家的目标都是朝着自研大模型进发——有钱的大厂研发基座模型,创业公司们则转向研发在开源模型基础上加入特定数据集做微调的行业模型、垂直模型。

但事实证明,大模型真正的门槛在于高昂的成本——海量的算力、能提供定制服务的数据服务商和顶尖的人才团队。

以算力为例,目前市场绝大部分被用于训练大模型的算力芯片都来自于英伟达。根据财经报道,2023年,英伟达A100的售价涨了约1倍。单单部署1000台服务器的电力成本就高达月20万元。

大厂们的优势在于,既拥有雄厚的财力去大规模购买、部署GPU,也能及时通过工程优化,利用大模型去实现效率提升。

根据晚点LatePost报道,11月,基于阿里的“通义千问”,跨境业务AI Business团队正式对外公布自己的产品 “Aidge”,兼具翻译、营销、设计、本地化服务等一系列功能。统计数据显示,11月经过AI优化后的商品,获得的海外询盘量比之前增加了15%。

字节则在推出了云雀大模型后,相继研发出了豆包、扣子、话炉等产品。以话炉为例,用户可以在其中与AI智能体一道,通过故事聊天、创作,获得互动体验。

Sora使用 transformer 架构,将视频和图像表示为称为 Patch 的较小数据单元的集合,类似于 GPT 中的 token。重要的是,它和GPT一样符合AI 缩尺律(Scaling Law),也就是说随着训练计算量的增加,样本质量明显提高。

有行业人士表示,目前Sora 暂未对外开放使用,仅OpenAI CEO Sam Altman 在X 平台上与评论互动生成视频,认为算力的限制可能是目前 Sora 暂未开放使用的重要因素。

算力已经成为了各家最为关注的资源之一。2018 年,Altman 个人投资了一家AI 芯片初创公司Rain Neuromorphics,2019 年,OpenAI 花费5100 万美元购买Rain 的芯片;去年 11 月,Altman 为一家代号为“Tigris”的芯片企业寻求数十亿美元的资金。

软银集团创始人孙正义则正寻求筹措1000亿美元资金成立一家芯片企业,与旗下半导体设计公司ARM的业务形成互补。

不过Sora的惊艳并不意味着其他人就没有机会。视频生成赛道此前的明星公司是Runway和Pika,尽管有许多人认为Sora很容易对两者进行降维打击,但Pika创始人郭文景在回应钛媒体时称,“我们觉得这是一个很振奋人心的消息,我们已经在筹备直接冲,将直接对标Sora。”

事实上,OpenAI也并非毫无对手。和Sora同一时期发布的还有谷歌的Gemini1.5 Pro,根据官方数据,其支持长达 100 万个 token,远超当前其他基础模型,可以一次性处理大量信息,如 1 小时的视频、11 小时的音频、超过3万行代码或超过70万个单词。

Sora当然是OpenAI领先的有力证明,但更像是大模型这个“大力出奇迹”赛道竞争升级的信号。

节点声明:本内容为作者独立观点,不代表节点财经立场。未经允许不得转载,文中内容仅供参考,不作为实际操作建议,交易风险自担。

(0)
伯虎财经的头像伯虎财经
上一篇 2024年 2月 23日 18:39
下一篇 2024年 2月 23日 18:40

相关推荐

  • 商米科技IPO之前,需要回答的三个问题

    文 / 零度  来源 / 节点财经  提及商米科技,很多人并不了解,但在日常生活中,却随处能看到商米科技的产品,它就是支付宝刷脸支付、“碰一下”背后的企业。 据港交所近日披露,上海商米科技集团股份有限公司向港交所主板提交上市申请。 《节点财经》获悉,这并非商米科技首次IPO,2021年商米科技曾在上交所开启上市进程,但上交所在两轮问询中对…

    2025年 7月 2日
  • 智谱再融10亿元,资本为何持续押注清华系大模型?

    文 / 道哥  7月2日,大模型创业公司智谱在上海举办「智谱开放平台产业生态大会」,并宣布获得浦东创投集团和张江集团联合10亿元人民币的战略投资。 据公开融资信息,这是智谱完成的第16轮融资。在此次上海国资入场前,今年3-4月智谱已相继引入杭州、珠海、北京、成都等地的国资战略融资,频繁的大额融资使智谱成为国内“大模型六小虎”中融资规模最大的公司之一…

    2025年 7月 5日
  • 地平线“龙虾时刻”:舱驾融合一体化方案定义整车智能新标杆

    4月22日,以“征程无垠,驭见星空”为主题的地平线年度产品技术发布会在京举行。会上,地平线正式发布中国首款舱驾融合整车智能体芯片地平线星空®(Horizon Starry®),以及中国首个整车智能体操作系统地平线KaKaClaw咖咖虾™,并同步推出全场景辅助驾驶系统HSD V1.6。 此次发布标志着地平线率先完成从芯片到软件、从智驾到智舱的整车计算战略拼图,…

    2026年 4月 23日
  • 为何五源、高瓴如此看好地平线?

    作为智驾科技龙头企业,地平线机器人(9660.HK)的禁售期将在4月24日结束引起了市场广泛关注。 关于本轮解禁,格隆汇从早期领投方五源资本和高瓴处获悉,在地平线解禁后不会急于减持,会长期支持。 五源资本创始合伙人刘芹称,地平线始终以产业终局的思维来布局未来。当前,智能驾驶正在经历从技术突破到规模化落地的关键拐点,其重构出行生态的价值远未充分释放。我们看好地…

    2025年 4月 17日
  • “面条大王”陈克明跨界养猪巨亏,72岁辞职欲再造一家上市公司

    文|雷达财经 莫恩盟 编辑|深海 现年72岁的“面条大王”陈克明,于10月17日正式卸下了公司董事长的重任,站完了自己在克明食品的最后一班岗。作为陈克明一手带大的企业,克明食品从一家小小的面条厂发展为如今挂面行业的头部企业走过了30多个年头。 曾经靠面条生意起家的克明食品,如今业务已不仅仅局限于此,试图多元化发展的克明食品还将目光瞄准了生猪业务。不过,努力寻…

    上市公司 2023年 10月 20日