VASA-1 特别有趣的地方在于,它能够模拟自然的面部表情、各种情绪和唇部同步。最重要的是几乎没有人工痕迹,如果不细看很难发现。
研究人员承认,与所有其他模型一样,该模型目前还无法妥善处理头发等非刚性元素,但整体效果要比其它同类模型要更为优秀。
研究人员还表示 VASA-1 支持离线 batch 处理模式下,以 45fps 生成分辨率为 512*512 的动态短视频,在线直播模式下可以达到 40 fps,且延迟仅为 170ms。而且整个生成操作只需要一台配备英伟达 RTX 4090 显卡的电脑上就能处理。
附上参考地址
2024-08-28
2024-06-08
2024-06-13
2024-04-23
微软资讯推荐
win10系统推荐
系统教程推荐