当前位置:首页 > 科技  > 资讯

可灵AI数字人来了 支持情绪与动作控制、轻松打造“有灵魂”的数字角色

来源: 责编: 时间:2025-09-20 09:16:12 113观看
导读近日,可灵AI数字人正式亮相,凭借领先的口型精准度、情绪动作演绎和跨风格泛化能力,重新定义了数字人技术的行业标杆。用户仅需上传一张角色图片、输入角色表达内容或一段音频,就能生成最长1分钟、极具表现力的数字人视频,

近日,可灵AI数字人正式亮相,凭借领先的口型精准度、情绪动作演绎和跨风格泛化能力,重新定义了数字人技术的行业标杆。用户仅需上传一张角色图片、输入角色表达内容或一段音频,就能生成最长1分钟、极具表现力的数字人视频,而且支持多类角色及中英日韩多语种,最低价格仅0.12元每秒,广泛适用于广告、电商、娱乐、媒体、教育等众多场景。目前产品公测陆续开放中。HMa28资讯网——每日最新资讯28at.com

HMa28资讯网——每日最新资讯28at.com

极简输入、高质输出:一张图实现分钟级数字人生成HMa28资讯网——每日最新资讯28at.com

可灵AI数字人极大降低了行业的制作门槛,用户只需提供一张角色图(支持写实人物、动漫、动物等多种角色),输入一段文字或音频,即可一键生成最高达1080p分辨率、48FPS高帧率的高质量数字人视频。HMa28资讯网——每日最新资讯28at.com

该功能可支持生成最长达1分钟的数字人视频,可轻松满足产品讲解、新闻播报、在线教育等多种场景需求,结合会员优惠最低价仅0.12元/秒(标准价格:高品质模式8灵感值/秒,标准模式4灵感值/秒),让高品质数字人技术不再是少数专业机构的专利,真正赋能广大内容创作者与中小企业。HMa28资讯网——每日最新资讯28at.com

此外,为了实现“开箱即用”的便捷体验,可灵AI还提供了一站式解决方案。既支持用户上传自有素材,也可以使用内置的官方形象库、AI生图功能以及近百种TTS音色,轻松完成从角色创建到配音的全流程。HMa28资讯网——每日最新资讯28at.com

角色演绎“神形兼备”  HMa28资讯网——每日最新资讯28at.com

在数字人的核心能力——“表现力”上,可灵AI展示了其深厚的技术功底,不再满足于同类产品简单的音画同步,而是追求角色“神形兼备”的生动演绎。HMa28资讯网——每日最新资讯28at.com

HMa28资讯网——每日最新资讯28at.com

(可灵AI数字人视频截图)HMa28资讯网——每日最新资讯28at.com

在对口型这一基础指标上,可灵AI数字人展现出了业界领先的精准度。实测案例中,一位女歌手正演唱英文歌曲,其唇形与快速变化的歌词音节完美贴合,复杂口型也表现出色。而根据提示词“眼神专注自信地唱歌”,数字角色更呈现出自信的眼神、持麦的自然姿态,以及与观众互动的微笑,生动还原了歌手在舞台上的表演状态。HMa28资讯网——每日最新资讯28at.com

同时,凭借可灵视频模型的强大能力,可灵AI数字人展现出优秀的泛化性能,无论是写实人物、动漫卡通、动物形象,皆可生成高质量数字人视频。在卡通猫咪唱英文Rap的案例中,可灵AI精准地捕捉音频节奏,生成了一只一边说唱、一边随节奏自然摇摆身体的“Rapper猫”,跨越不同角色风格界限,赋予角色生命力。HMa28资讯网——每日最新资讯28at.com

提示词驱动角色表演 情绪与动作精细可控  HMa28资讯网——每日最新资讯28at.com

区别于仅“动嘴皮”的数字人,可灵AI数字人还带来了对情绪的深刻理解与表达,而且可通过提示词精细化控制角色情绪与肢体语言,实现“有灵魂的表演”。HMa28资讯网——每日最新资讯28at.com

HMa28资讯网——每日最新资讯28at.com

(可灵AI数字人视频截图)HMa28资讯网——每日最新资讯28at.com

在这个表现“愤怒”情绪的案例中,根据音频内容和提示词“内心全是气愤,非常生气”。模型精准地将这种抽象情绪转化为具体的面部微表情——紧锁的眉头、紧抿的嘴唇和充满压迫感的眼神,将角色的内心怒火展现得淋漓尽致。HMa28资讯网——每日最新资讯28at.com

基于可灵AI视频模型,依托多模态理解大模型与视频生成模型的深度融合,可灵AI数字人突破传统音画同步的表浅拟合,首次实现从「听声音」到「懂意图」的跨越。在口型准确度已达行业领先的基础上,可精准解析输入的语音、图像和提示词,对长视频中数字人情绪、动作与运镜作出精准规划,确保生成内容紧密呼应叙事意图与情感脉络,真正完成从对口型到情节演绎的升级。HMa28资讯网——每日最新资讯28at.com

技术驱动 打造数字人行业标杆HMa28资讯网——每日最新资讯28at.com

可灵AI数字人的卓越表现,得益于其背后多模态理解大模型与视频生成模型的深度融合。通过音画高度对齐的交叉注意力机制、强化口型的训练策略以及精细化的数据处理,实现了语音与唇形的精准同步,即使面对多语种、歌唱或极快语速的台词,仍能保证唇形与发音严丝合缝。而采用关键帧控制的架构,模型先构建高层次叙事骨架,再并行生成多个片段的数字人视频,可在保持身份一致的前提下,实现无限长度视频生成。HMa28资讯网——每日最新资讯28at.com

专业测试中,可灵AI数字人与行业知名产品Heygen及即梦数字人(Omnihuman-1方案)进行了效果对比。结果显示,可灵 AI 数字人在整体效果及多个细分维度上均表现优异,与即梦数字人(Omnihuman-1 方案)对比的整体 GSB 得分达到 2.39,与 Heygen 对比的整体 GSB 得分达到 1.37,位居行业领先。HMa28资讯网——每日最新资讯28at.com

HMa28资讯网——每日最新资讯28at.com

* GSB 指标用于衡量群体意见的一致性和正负倾向,GSB 值越大,说明模型优势越大HMa28资讯网——每日最新资讯28at.com

* 评测时间:Heygen于2025.08.25评测;即梦于2025.07.22评测。HMa28资讯网——每日最新资讯28at.com

可灵AI作为全球领先的视频生成大模型,自2024年6月发布以来已完成超30次迭代,用户规模突破4500万,生成视频数量超2亿,为超过2万家企业提供API服务,覆盖广告、影视、游戏等多个领域。随着可灵AI数字人的推出,将进一步降低行业创作门槛、提升制作标准,推动其在短视频、电商直播、在线教育、企业服务等领域的规模化应用。HMa28资讯网——每日最新资讯28at.com

本文链接:http://www.28at.com/showinfo-16-183020-0.html可灵AI数字人来了 支持情绪与动作控制、轻松打造“有灵魂”的数字角色

声明:本网页内容旨在传播知识,若有侵权等问题请及时与本网联系,我们将在第一时间删除处理。邮件:2376512515@qq.com

上一篇: 全域突破,赢战双11,磁力引擎双11营销作战大图发布

下一篇: 快手电商举办超级双选会,近3000位商家达人参会选品

标签:
  • 热门焦点
  • 线程通讯的三种方法!通俗易懂

    线程通信是指多个线程之间通过某种机制进行协调和交互,例如,线程等待和通知机制就是线程通讯的主要手段之一。 在 Java 中,线程等待和通知的实现手段有以下几种方式:Object 类下
  • 微信语音大揭秘:为什么禁止转发?

    大家好,我是你们的小米。今天,我要和大家聊一个有趣的话题:为什么微信语音不可以转发?这是一个我们经常在日常使用中遇到的问题,也是一个让很多人好奇的问题。让我们一起来揭开这
  • Temu起诉SHEIN,跨境电商战事升级

    来源 | 伯虎财经(bohuFN)作者 | 陈平安日前据外媒报道,拼多多旗下跨境电商平台Temu正对竞争对手SHEIN提起新诉讼,诉状称Shein“利用市场支配力量强迫服装厂商与之签订独家
  • 自律,给不了Keep自由!

    来源 | 互联网品牌官作者 | 李大为编排 | 又耳 审核 | 谷晓辉自律能不能给用户自由暂时不好说,但大概率不能给Keep自由。近日,全球最大的在线健身平台Keep正式登陆港交所,努力
  • 东方甄选单飞:有些鸟注定是关不住的

    作者:彭宽鸿来源:华尔街科技眼‍‍‍‍‍‍‍‍‍‍东方甄选创始人俞敏洪带队的“7天甘肃行”直播活动已在近日顺利收官。成立后一
  • AI芯片初创公司Tenstorrent获三星和现代1亿美元投资

    Tenstorrent是一家由芯片行业资深人士Jim Keller领导的加拿大初创公司,专注于开发人工智能芯片,该公司周三表示,已经从现代汽车集团和三星投资基金等
  • OPPO K11采用全方位护眼屏:三大护眼能力减轻视觉疲劳

    日前OPPO官方宣布,全新的OPPO K11将于7月25日正式发布,将主打旗舰影像,和同档位竞品相比,其最大的卖点就是将配备索尼IMX890主摄,堪称是2000档位影像表
  • Windows 11发布,微软一改往常对老机型开放的态度

    距离 Windows 11 发布已经过去一周,在过去一周里,很多数码爱好者围绕其对 Android 应用的支持、对老机型的升级问题展开了激烈讨论。与以往不同的是,在这次大
  • 利用职权私自解除被封帐号 Meta开除20多名员工

    11月18日消息,据外媒援引知情人士表示,过去一年时间内,Facebook母公司Meta解雇或处罚了20多名员工以及合同工,指控这些人通过内部系统以不当方式重置用户帐号,其
Top