最近, APPSO 观看了国内首场 AI 艺人线下演唱会,效果非常惊艳,但略有遗憾的是,主角 Yuri 尤栗和观众互动的方式是在大屏幕上打字,要是她能像真人歌手观众那样和观众实时互动,让我们点歌,和我们玩一些小游戏,那该多有趣啊。 现在,这样能实时生成和编辑的视频已经出现了。 当大部分视频生成模型还在「卷时长、卷清晰度、算完再看」的离线生成赛道厮杀时,生数科技刚刚发布的 Vidu S2 已经把战场直接拉到了「边看边改」的实时操控领域。 Vidu S2 的能力分为两部分, S2-Avatar 和 S2-Editing: S2-Avatar,实时交互模型。面向实时数字人互动,支持 720p 高清输出,增强动作指令遵循与人物表演能力;可在直播过程中输入参考图,根据指令完成持品互动、换服装和换背景。 S2-Editing,实时编辑模型。 面向正在流动的视频画面,支持实时修改风格、服装、人物主体与背景,为直播、虚拟演绎和互动内容提供即时视觉编辑能力。 APPSO 第一时间进行了评测,我们发现:Vidu S2 将实时数字人互动进一步拓展到实时视频编辑,让数字人的表现更丰富、交互控制更灵活,也让正在进行的视频画面拥有了更多可编辑空间。 AI 视频终于「边播边改」了 Vidu S2-Avatar 对舞蹈、特定手势、情绪微表情的理解能力大幅提升,只需通过语音或文本指令即可驱动高质量动作,比如摆臂、扭身、踏步和抬腿等动作。 用户可以上传各种图片,比如真人照片、动漫形象或者可爱的宠物图片,从而创建出一个数字人物。 启用麦克风和摄像头权限后,便可以与所创建的角色对话。你可以在视频流进行中的任意时刻,加入物品、服装或背景图片:让角色拿起图中的杯子,换上指定服装,或进入新的场景,输出分辨率同步提升至 720p。 最近,iPhone 首款折叠屏手机成了科技圈最火的话题,同样也伴随着巨大争议,有外媒认为 iPhone Duo 再现了乔布斯时代的惊艳,有人则认为创新不足。 我也很好奇,如果乔布斯能够重新站在我们面前,看到今天的 iPhone Duo,他会怎么评价? 所以这次我直接在 Vidu S2 里创...
本文转载自 爱范儿,仅供学习交流。查看原文