视频生成
Video Generation
只用一句话或一张照片就能生成动态视频的AI。Sora、Veo、Runway是这一领域的代表。
简单来说
视频生成AI能用一句话或一张照片,做出会动的视频。OpenAI的Sora、谷歌的Veo、Runway都是这个领域的代表产品。
这比图像生成难得多。因为要生成的不是一张图,而是成百上千帧画面,而且这些画面之间,人走路的姿态、水流动的方式等「世界的物理规律」都要自然衔接。所以模型得学会杯子脱手后应该落地这种常识,目前也还留有手指变形、物体突然消失之类的错误。
即便如此,这仍是该领域发展最快的部分。几秒钟的短片已经开始被真正用于广告和音乐视频,如今甚至能连声音一起生成。这也是为什么广告、电影行业的制作成本话题,以及演员、配音演员工会的反弹声音,总是如影随形。
在报道中是这样出现的
「用一行文字生成带声音的8秒视频」——这是视频模型发布报道中的典型说法,演示视频的完成度本身就成了新闻标题。
相关词条
出现过这个词的报道
目前还没有报道用到这个词。有新报道时会自动出现在这里。