字节跳动OmniHuman多模态视频生成模型即将上线

IT之家 2025-02-07 17:28:40

IT之家2月7日消息,据第一财经报道,字节跳动旗下一站式AI创作平台即梦AI将上线多模态视频生成模型OmniHuman,仅需一张图片与一段音频便可生成一条AI视频,该模型为字节自研闭源模型。

即梦AI相关负责人透露,该模型未来会进行小范围内测,官方也会对这一功能设置严格的安全审核机制,并对输出的视频标注水印以作提醒。

IT之家注意到,字节跳动的研究人员近日展示了一款AI模型,可以通过一张图片和一段音频生成半身、全身视频。字节跳动表示,和一些只能生成面部或上半身动画的深度伪造技术不同,OmniHuman-1能够生成逼真的全身动画,且能将手势和面部表情与语音或音乐精准同步。

0 阅读:8
IT之家

IT之家

爱科技,爱这里 - 前沿科技人气平台