分享好友 最新动态首页 最新动态分类 切换频道
OpenAI新年开出王炸,AI竞争升级
2024-12-26 11:30

作者 | 陈平安

OPEN AI又刷屏了。

2023年年初,OPEN AI就曾引爆全球科技圈。

因为其发布了一个全新的聊天机器人模型—— ChatGPT。和过去那些简单的聊天机器人相比,ChatGPT不仅可以回答人类的追问,承认自己回答中的错误,拒绝回答不适当的问题,还能写诗、编程、写论文等等。

连马斯克都忍不住感叹:“ChatGPT好得吓人,我们离强大到危险的人工智能不远了。”距离发布后仅两个月,ChatGPT月活用户就达到了1亿,为其母公司OpenAI拉来了微软100亿美元的下注。

2024年年初,相似的故事又在上演。

2 月 16 日凌晨,OpenAI 在 AI 生成视频领域扔出一枚“王炸”,宣布推出全新的生成式人工智能模型“Sora”。

在 OpenAI 官网分享的演示视频中,Sora 可以直接输出有多个角色、多种场景和运镜的画面。这对比一年前 AI 生成的视频,简直是天差地别,其视频长度方面就“碾压”同行。

据了解,通过文本指令,Sora可以直接输出长达60秒的视频,且视频的精致程度远超大部分人的想象。

这意味着,继文本、图像之后,OpenAI将其先进的AI技术拓展到了视频领域。

一方面是技术上的突破。

Sora 能够生成长达 1 分钟的超长视频,远超Runway-gen2 的 18 秒和 Pika 的 3 秒。

另一方面,同样引人关注的是,Sora理解长文本的能力。OpenAI在官方博客中写道,“Sora不仅可以理解用户的需求,还知道这些事物在现实世界如何存在。”

什么意思呢?只需要输入一段文本,Sora就能自动生成最长一分钟的高清视频。让人惊艳的是,Sora不仅可以准确把握用户文本中的复杂意思,并且还能分拆出不同的元素,将其转换为有具体创意构思的视频内容,看起来就像是专业导演、摄像和剪辑的作品。

比如 Sora以“色彩缤纷的鱼类和海洋生物充斥的,由纸艺精心构建的珊瑚礁世界”为主题的视频中, Sora 通过其摄影角度和拍摄时机,成功地推进了故事的发展。视频中实际上发生了多次镜头转换,这些没有特别指令它这么做,它却能自动完成。

据内行人士透露,像是Sora生成的视频,就算是头部动画制作公司都需要数日时间完成,而Sora只需要几分钟搞定。

国盛证券认为 Sora 相比此前其他文生视频模型,已经跨越到实用生产力工具,1 分钟长度有望大规模应用在短视频领域,扩展视频的能力也有望制作长视频,或将带来新一轮内容创作产业革命。

当然,Sora并不完美。OpenAI官网指出它可能难以准确模拟复杂场景的物理原理,并且可能无法理解因果关系,混淆提示的空间细节。

以此次发布的DEMO“与中国龙一起庆祝农历新年的视频”为例,Sora无法准确生成视频画面中的中文,还被网友调侃调侃“都怪中文太难了?”以及视频中老人生日蛋糕蜡烛,但蜡烛火苗前面却没有丝毫变化等等。

但OpenAI的团队,让AI能从最初的模糊分辨不清的图像,进步到目前足以生成长视频的阶段,可见其发展可怖。

B站一位网友是这么评价的:

Sora最直接的影响的肯定是对视频行业的冲击。作为一种视频生成工具,Sora仅需文字就可以生成60秒时长的精细视频,大大降低了视频制作的门槛和成本,特别是热点类等具备强烈时效性的内容。

不过Sora更深层的意义在于,这也意味着有关AI的竞争再度升级。

2023年,ChatGPT的发布引领全球进入AI热潮,光是中国公司就发布了超过130个大模型。起初,大家的目标都是朝着自研大模型进发——有钱的大厂研发基座模型,创业公司们则转向研发在开源模型基础上加入特定数据集做微调的行业模型、垂直模型。

但事实证明,大模型真正的门槛在于高昂的成本——海量的算力、能提供定制服务的数据服务商和顶尖的人才团队。

以算力为例,目前市场绝大部分被用于训练大模型的算力芯片都来自于英伟达。根据财经报道,2023年,英伟达A100的售价涨了约1倍。单单部署1000台服务器的电力成本就高达月20万元。

大厂们的优势在于,既拥有雄厚的财力去大规模购买、部署GPU,也能及时通过工程优化,利用大模型去实现效率提升。

根据晚点LatePost报道,11月,基于阿里的“通义千问”,跨境业务AI Business团队正式对外公布自己的产品 “Aidge”,兼具翻译、营销、设计、本地化服务等一系列功能。统计数据显示,11月经过AI优化后的商品,获得的海外询盘量比之前增加了15%。

字节则在推出了云雀大模型后,相继研发出了豆包、扣子、话炉等产品。以话炉为例,用户可以在其中与AI智能体一道,通过故事聊天、创作,获得互动体验。

Sora使用 transformer 架构,将视频和图像表示为称为 Patch 的较小数据单元的集合,类似于 GPT 中的 token。重要的是,它和GPT一样符合AI 缩尺律(Scaling Law),也就是说随着训练计算量的增加,样本质量明显提高。

有行业人士表示,目前Sora 暂未对外开放使用,仅OpenAI CEO Sam Altman 在X 平台上与评论互动生成视频,认为算力的限制可能是目前 Sora 暂未开放使用的重要因素。

算力已经成为了各家最为关注的资源之一。2018 年,Altman 个人投资了一家AI 芯片初创公司Rain Neuromorphics,2019 年,OpenAI 花费5100 万美元购买Rain 的芯片;去年 11 月,Altman 为一家代号为“Tigris”的芯片企业寻求数十亿美元的资金。

软银集团创始人孙正义则正寻求筹措1000亿美元资金成立一家芯片企业,与旗下半导体设计公司ARM的业务形成互补。

不过Sora的惊艳并不意味着其他人就没有机会。视频生成赛道此前的明星公司是Runway和Pika,尽管有许多人认为Sora很容易对两者进行降维打击,但Pika创始人郭文景在回应钛媒体时称,“我们觉得这是一个很振奋人心的消息,我们已经在筹备直接冲,将直接对标Sora。”

事实上,OpenAI也并非毫无对手。和Sora同一时期发布的还有谷歌的Gemini1.5 Pro,根据官方数据,其支持长达 100 万个 token,远超当前其他基础模型,可以一次性处理大量信息,如 1 小时的视频、11 小时的音频、超过3 万行代码或超过 70 万个单词。

Sora当然是OpenAI领先的有力证明,但更像是大模型这个“大力出奇迹”赛道竞争升级的信号。

原标题:《OpenAI新年开出王炸,AI竞争升级》

最新文章
iOS越狱最新消息,探索风险与法律的边缘
随着科技的飞速发展,iOS越狱这一话题再次引发了广泛关注,本文将为您带来关于iOS越狱的最新消息,同时探讨与之相关的风险和法律问题。iOS越狱是指通过一系列技术手段,破解苹果设备的限制,使得用户能够安装非官方应用商店的第三方应用、
AI辅助下的PPT制作:免费下载与创意设计
在当今这个数字化的时代,PPT已经成为了我们日常工作和学习中不可或缺的一部分。然而,制作一份高质量的PPT却并非易事,它需要我们具备一定的设计能力和审美水平。幸运的是,随着人工智能技术的发展,AI辅助下的PPT制作已经成为了可能。本
1、常用规则引擎、java规则引擎的标准。
一、概述。JSR94标准 在本文中,我们将介绍一些最流行的Java规则引擎。 在应用程序中,业务规则很复杂(比如:优惠券的使用规则)。如果用源代码实现这些规则,很繁琐。通过规则引擎将业务逻辑与源代
m.1518.com的百度排名情况
a href="https://baidurank.aizhan.com/" target="_blank"img src="https://baidurank.aizhan.com/api/mbr?domain=m.1518.com&style=images" //aa href="https://baidurank.aizhan.com/" target="_blank"script type=&quo
gpt-4是否免费(gpt42)
本文主要讲解“gpt-4可以免费使用吗?”本文的解释简单明了,易学易懂。请按照主机频道的思路越来越深入,研究学习“gpt-4可以免费使用吗?”!Gpt-4不能免费使用,每个月需要支付20美元。与ChatGPT最初使用的GPT-3.5型号相比,GPT-4实现了
AI美女写真:用搜狐简单AI一键生成超逼真美女写真!
搜狐简单AI是最近备受关注的一款AI绘图工具,操作极其简单,适合新手用户。它支持多种风格提取,只需选择模板、输入描述并点击生成,作品即可快速呈现,反应速度快且效果相对稳定。在实际使用中,它几乎不需要复杂的设置,人人都能轻松上手
10分钟以前:《天阔文化App》无法出金!拉掉遮羞布真相让人恼羞成怒!!
某天晚上,柳先生玩手机,浏览到一个网站,里面弹出一个链接被骗信用分不足无法出金,在好奇心的驱使下,柳先生下载了被骗信用分不足无法出金,进入之后,有被骗信用分不足无法出金平台的客服来联系柳先生,被骗信用分不足无法出金平台客服
AI智能人工智能解决方案(50页 PPT)
人工智能的定义和发展历程:是研究、开发用于模拟、延伸和扩展人的智能的理论、方法、技术及应用系统的新的技术科学,企图了解智能实质并生产出能以类似人类智能方式做出反应的智能机器,涉及机器人、语言识别、图像识别、自然语言处理和专
9个超实用的机器学习数据集网址,都给你整理好啦(建议收藏)
机器学习通常被视为一种神奇的工具,你可以整理数据,并将获得的数据知识转化为预测。为此,我们也需要花费大量时间在数据收集、清理和合并等方面。 今天我将给大家分享 9 个关于机器学习数据集获取的最佳网址,它
AI人工智能仿真机器人
一、现状和背景人工智能(Artificial Intelligence,简称AI)是当今科技领域的热门话题,而AI人工智能仿真机器人则是AI技术在机器人领域的应用。随着技术的快速发展和应用的广泛推广,AI人工智能仿真机器人逐渐成为了众多行业的焦点。二、
相关文章
推荐文章
发表评论
0评