国内AI实现让照片开口唱歌_EMO来了!通义APP推出照片唱歌功能是非常多小伙伴都想了解的内容,下面小编为大家整理的国内AI实现让照片开口唱歌_EMO来了!通义APP推出照片唱歌功能相关信息,欢迎大家的分享收藏哟!

来自环球网科技综合报道的消息,只需向人工智能模型EMO输入一段音频和一张照片,就能让图片中的人物开口演唱或讲话,如让奥黛丽·赫本演绎《上春山》,让秦始皇陵的陶俑仕女说英语RAP,或是让阿尔伯特·爱因斯坦讲中文笑话。日前,由于阿里通义实验室发布的一篇研究论文,这款名为EMO的模型在全球范围内引发了广泛关注,其产品化进度同样受到热议。4月25日,EMO正式登陆通义应用程序(APP),对所有用户提供免费试用服务。
通过通义APP,用户可以进入“全民舞台”频道,访问EMO产品的“全民唱演”页面。在这里,从歌曲、热门梗和表情包等各类模板中任意挑选,上传个人肖像照片后,EMO即可迅速生成相应的视频内容。
在通义APP首发版本中,已经提供了超过80个EMO模板,涵盖了诸如《上春山》、《野狼disco》之类的热门歌曲,以及“钵钵鸡”、“回手掏”等网络流行梗。然而,目前该APP尚不允许用户自定义音频素材,用户仅能选用APP内预设的音频生成视频。
EMO是由通义实验室研发的人工智能模型,其所采用的肖像说话(Talking Head)技术在当下备受瞩目的AIGC领域独树一帜。相较于以往需要针对人脸、人头或身体部分进行3d建模的技术,通义实验室在业内首推了弱控制设计,无需建模即可驱动肖像开口说话,既降低了视频生成的成本,又显著提高了视频生成的质量。EMO具备学习和编码人类情感表达的能力,能够精准匹配音频内容与人物的表情、口型,并将音频的语调特点及情感色彩生动地体现在人物微妙的表情变化之中。
今年2月底,通义实验室公开了相关研究论文,自此EMO便成为了继SORA之后备受各界关注的人工智能模型之一。如今,通义APP让更多普通用户得以免费体验这一前沿模型所展现出的创新力。展望未来,EMO技术有望在数字人、数字化教育、影视制作、虚拟陪伴以及电商直播等多个场景中得到广泛应用。
近段时间,通义APP连续推出了一系列爆款应用,其中“全民舞王”曾在社交媒体上引发过“兵马俑跳科目三”和“金毛跳舞”等热潮。而支撑“全民舞王”现象级应用背后的Animate Anyone模型也同样出自通义实验室之手。近期,通义APP还相继推出了超长文档解析、AI编码助手、AI会议助手等诸多免费且实用的功能。如今,通义大型模型正日益成为众多用户的超级AI助手。
关于国内AI实现让照片开口唱歌_EMO来了!通义APP推出照片唱歌功能的内容小编就阐述到这里了,希望本篇的信息能够解答大家目前的疑问,想要更多最新的内容记得关注多特软件站哟!
了解更多消息请关注收藏我们的网站(news.duote.com)。
文章内容来源于网络,不代表本站立场,若侵犯到您的权益,可联系多特删除。(联系邮箱:[email protected])
近期热点
最新资讯