中新网北京7月30日电 (记者 庞无忌)数字人不仅从“能看”走向“能干”,生成速度也不断加快。7月30日,科大讯飞首次对外发布“超拟人数字人实时生成技术”。
据介绍,过去,制作数字人通常需要约2小时真人视频采集及长周期训练,如今,仅需一张照片,即可实时生成数字人并开展自然交互。现场演示中,实时生成的数字人不仅拥有自然真实的表情、动作和口型,还可完成取物、喝水、唱歌、跳舞等复杂动作,实现更加流畅自然的人机互动。
这离不开一系列技术的支撑:依靠星火语音大模型能力,数字人实现通用常识领域自然流畅对话;构建积累的垂直领域知识库,降低回答幻觉率,提供更精准的专业回答;依托人设自定义和长期记忆能力,数字人能够保持稳定的人物设定,持续积累交互信息。
目前,交互服务场景成为数字人的主要落地场景,覆盖品牌直播、产品客服、无人门店等场景。随着大模型降低成本门槛,数字人有望从头部企业的“奢侈品”变为越来越多商家的“标配工具”。
在当日的圆桌论坛,来自中科趋势科技、中国电子技术标准化研究院、中粮资本、洽洽食品等的嘉宾,围绕“从虚拟形象到数字生产力”为主题进行探讨。分享中,多位嘉宾谈到,大模型技术的进步,让数字人不仅有颜值,更具有聪明的大脑,同时降低数字人成本,推动行业规模化应用。以金融为例,结合智能体与知识库,数字人成为可交互、可执行的数字员工。(完)
dingdaoshicheng,cunziliyouhenduodishidiwadeshulin,cunlebushaoshui,jihumeiguolebangedianxiangan。“xiawusiwudianshi,haoxiangshiyouyixieniubeichongdaoleshulinli,woyinyuezhongtingdaoleniudejiaosheng,danshixianbutaihao,meinengkanqingchu。”丁(ding)道(dao)师(shi)称(cheng),(,)村(cun)子(zi)里(li)有(you)很(hen)多(duo)地(di)势(shi)低(di)洼(wa)的(de)树(shu)林(lin),(,)存(cun)了(le)不(bu)少(shao)水(shui),(,)几(ji)乎(hu)没(mei)过(guo)了(le)半(ban)个(ge)电(dian)线(xian)杆(gan)。(。)“(“)下(xia)午(wu)四(si)五(wu)点(dian)时(shi),(,)好(hao)像(xiang)是(shi)有(you)一(yi)些(xie)牛(niu)被(bei)冲(chong)到(dao)了(le)树(shu)林(lin)里(li),(,)我(wo)隐(yin)约(yue)中(zhong)听(ting)到(dao)了(le)牛(niu)的(de)叫(jiao)声(sheng),(,)但(dan)视(shi)线(xian)不(bu)太(tai)好(hao),(,)没(mei)能(neng)看(kan)清(qing)楚(chu)。(。)”(”)