2025-04-27 12:29:03 | 来源: 智享导航
2024年2月29日报道丨AI资讯早报
2月28日,阿里巴巴的人工智能技术研发团队发布了基于音频驱动的肖像脸部表情神态动作视频生成框架EMO(Emote Portrait Alive)。这种创新性的技术架构,让用户只需输入一张参考的图像和一段声音音频用于解析,该框架能够生成具有丰富面部表情和头部姿势的声音肖像视频。

该技术利用先进的音视频扩散模型,在有限的数据条件下,也能高效模仿原始数据,并快速生成具有高度真实感和丰富表现力的肖像视频。官方展示的视频案例显示,不仅可以让《蒙娜丽莎》本人的肖像开口说话,还可以呈现不同的语言和跨次元的风格,比如让电视剧《狂飙》的男主角“高启强”用法律老师罗翔的声音讲述法律考试在线课程。
项目主页:
https://humanaigc.github.io/emote-portrait-alive/
热门榜单
360AI搜索
常用AIsharegpt
常用AIGPTs:GPT Builder创建器
常用AIHi Echo — 网易有道
常用AI美图Moki
常用AIPicTech AI
常用AIPhotosonic
常用AIDreamUp
常用AIScribble Diffusion
常用AI热门资讯
讯飞星火大模型V3.5春季上新,长文本长图长语音,生产力实测:你的超级知识助手来了!
12-26有哪些好用的AI工具_AI工具测评使用_
12-31荣耀CEO赵明:荣耀领先三年,很高兴看到苹果追随我们的AI手机发展路线
02-24马斯克突然发布新版Grok-2大模型,牺牲特斯拉资源叫板OpenAI,一手实测来了
12-25夸克AI搜索_夸克最新动态_夸克官方网站
12-26SD3超详细使用教程+效果测评丨附热门模型下载地址
12-26快手AI文生视频大模型【可灵】首发实测:这可能将成为真正意义的第一款「中国版Sora」
12-26体验完腾讯的AI助理应用「腾讯元宝」,完整的公众号内容生态将是它的最强杀手锏
12-26Stable Diffusion 3最新模型测评丨SD3模型ComfyUI流程简单搭建
12-26商汤科技发布「日日新大模型」5.0:直接对标GPT-4 Turbo,全能分析轻松掌握周冠宇F1赛事数据
12-26