中新网北京7月30日电 (记者 庞无忌)数字人不仅从“能看”走向“能干”,生成速度也不断加快。7月30日,科大讯飞首次对外发布“超拟人数字人实时生成技术”。
据介绍,过去,制作数字人通常需要约2小时真人视频采集及长周期训练,如今,仅需一张照片,即可实时生成数字人并开展自然交互。现场演示中,实时生成的数字人不仅拥有自然真实的表情、动作和口型,还可完成取物、喝水、唱歌、跳舞等复杂动作,实现更加流畅自然的人机互动。
这离不开一系列技术的支撑:依靠星火语音大模型能力,数字人实现通用常识领域自然流畅对话;构建积累的垂直领域知识库,降低回答幻觉率,提供更精准的专业回答;依托人设自定义和长期记忆能力,数字人能够保持稳定的人物设定,持续积累交互信息。
目前,交互服务场景成为数字人的主要落地场景,覆盖品牌直播、产品客服、无人门店等场景。随着大模型降低成本门槛,数字人有望从头部企业的“奢侈品”变为越来越多商家的“标配工具”。
在当日的圆桌论坛,来自中科趋势科技、中国电子技术标准化研究院、中粮资本、洽洽食品等的嘉宾,围绕“从虚拟形象到数字生产力”为主题进行探讨。分享中,多位嘉宾谈到,大模型技术的进步,让数字人不仅有颜值,更具有聪明的大脑,同时降低数字人成本,推动行业规模化应用。以金融为例,结合智能体与知识库,数字人成为可交互、可执行的数字员工。(完)
“weishenmejiaxianghuizhemeluohou?wowufalijie。”zhuanyedejinrongzhishiyunongcundexianshizaitashenshangduanliekailai,congnashiqi,tasikaozijiweilaidechulu:“wodudebushidingjiandexuexiao,biyehoukeyiquzhaoyifenputongdegongzuo,huozhekaogegongwuyuan。danbeishangguangbuquerencai,erjiaxiangzhemeluohou,wohuilai,jihuiyinggaigengduo。”“(“)为(wei)什(shen)么(me)家(jia)乡(xiang)会(hui)这(zhe)么(me)落(luo)后(hou)?(?)我(wo)无(wu)法(fa)理(li)解(jie)。(。)”(”)专(zhuan)业(ye)的(de)金(jin)融(rong)知(zhi)识(shi)与(yu)农(nong)村(cun)的(de)现(xian)实(shi)在(zai)他(ta)身(shen)上(shang)断(duan)裂(lie)开(kai)来(lai),(,)从(cong)那(na)时(shi)起(qi),(,)他(ta)思(si)考(kao)自(zi)己(ji)未(wei)来(lai)的(de)出(chu)路(lu):(:)“(“)我(wo)读(du)的(de)不(bu)是(shi)顶(ding)尖(jian)的(de)学(xue)校(xiao),(,)毕(bi)业(ye)后(hou)可(ke)以(yi)去(qu)找(zhao)一(yi)份(fen)普(pu)通(tong)的(de)工(gong)作(zuo),(,)或(huo)者(zhe)考(kao)个(ge)公(gong)务(wu)员(yuan)。(。)但(dan)北(bei)上(shang)广(guang)不(bu)缺(que)人(ren)才(cai),(,)而(er)家(jia)乡(xiang)这(zhe)么(me)落(luo)后(hou),(,)我(wo)回(hui)来(lai),(,)机(ji)会(hui)应(ying)该(gai)更(geng)多(duo)。(。)”(”)