中新网北京7月30日电 (记者 庞无忌)数字人不仅从“能看”走向“能干”,生成速度也不断加快。7月30日,科大讯飞首次对外发布“超拟人数字人实时生成技术”。
据介绍,过去,制作数字人通常需要约2小时真人视频采集及长周期训练,如今,仅需一张照片,即可实时生成数字人并开展自然交互。现场演示中,实时生成的数字人不仅拥有自然真实的表情、动作和口型,还可完成取物、喝水、唱歌、跳舞等复杂动作,实现更加流畅自然的人机互动。
这离不开一系列技术的支撑:依靠星火语音大模型能力,数字人实现通用常识领域自然流畅对话;构建积累的垂直领域知识库,降低回答幻觉率,提供更精准的专业回答;依托人设自定义和长期记忆能力,数字人能够保持稳定的人物设定,持续积累交互信息。
目前,交互服务场景成为数字人的主要落地场景,覆盖品牌直播、产品客服、无人门店等场景。随着大模型降低成本门槛,数字人有望从头部企业的“奢侈品”变为越来越多商家的“标配工具”。
在当日的圆桌论坛,来自中科趋势科技、中国电子技术标准化研究院、中粮资本、洽洽食品等的嘉宾,围绕“从虚拟形象到数字生产力”为主题进行探讨。分享中,多位嘉宾谈到,大模型技术的进步,让数字人不仅有颜值,更具有聪明的大脑,同时降低数字人成本,推动行业规模化应用。以金融为例,结合智能体与知识库,数字人成为可交互、可执行的数字员工。(完)
zaizhuangcikanlai,jichuxuekeyanjiuzhongxindedingweiyaozugougao,keyiyituojuyoulianghaojichudeyanjiuyuansuohuogaoxiaoqujianshe,zhengfugeiyuzugoufengyudewendingzhichijingfei,yizhonglixiangdeyunxingmoshishicanzhaoriben“shijiedingjiguojiyanjiuzhongxin(WPI)”jihua。在(zai)庄(zhuang)辞(ci)看(kan)来(lai),(,)基(ji)础(chu)学(xue)科(ke)研(yan)究(jiu)中(zhong)心(xin)的(de)定(ding)位(wei)要(yao)足(zu)够(gou)高(gao),(,)可(ke)以(yi)依(yi)托(tuo)具(ju)有(you)良(liang)好(hao)基(ji)础(chu)的(de)研(yan)究(jiu)院(yuan)所(suo)或(huo)高(gao)校(xiao)去(qu)建(jian)设(she),(,)政(zheng)府(fu)给(gei)予(yu)足(zu)够(gou)丰(feng)裕(yu)的(de)稳(wen)定(ding)支(zhi)持(chi)经(jing)费(fei),(,)一(yi)种(zhong)理(li)想(xiang)的(de)运(yun)行(xing)模(mo)式(shi)是(shi)参(can)照(zhao)日(ri)本(ben)“(“)世(shi)界(jie)顶(ding)级(ji)国(guo)际(ji)研(yan)究(jiu)中(zhong)心(xin)((()W(W)P(P)I(I))())”(”)计(ji)划(hua)。(。)