中新网北京7月30日电 (记者 庞无忌)数字人不仅从“能看”走向“能干”,生成速度也不断加快。7月30日,科大讯飞首次对外发布“超拟人数字人实时生成技术”。
据介绍,过去,制作数字人通常需要约2小时真人视频采集及长周期训练,如今,仅需一张照片,即可实时生成数字人并开展自然交互。现场演示中,实时生成的数字人不仅拥有自然真实的表情、动作和口型,还可完成取物、喝水、唱歌、跳舞等复杂动作,实现更加流畅自然的人机互动。
这离不开一系列技术的支撑:依靠星火语音大模型能力,数字人实现通用常识领域自然流畅对话;构建积累的垂直领域知识库,降低回答幻觉率,提供更精准的专业回答;依托人设自定义和长期记忆能力,数字人能够保持稳定的人物设定,持续积累交互信息。
目前,交互服务场景成为数字人的主要落地场景,覆盖品牌直播、产品客服、无人门店等场景。随着大模型降低成本门槛,数字人有望从头部企业的“奢侈品”变为越来越多商家的“标配工具”。
在当日的圆桌论坛,来自中科趋势科技、中国电子技术标准化研究院、中粮资本、洽洽食品等的嘉宾,围绕“从虚拟形象到数字生产力”为主题进行探讨。分享中,多位嘉宾谈到,大模型技术的进步,让数字人不仅有颜值,更具有聪明的大脑,同时降低数字人成本,推动行业规模化应用。以金融为例,结合智能体与知识库,数字人成为可交互、可执行的数字员工。(完)
duiyu“shenmeshizhengchang”detiwen,wangxiaodongshuo,“jiuxiangbeishengsuomoshiyuguowaidabufenyanjiusuomoshimeiyoubenzhiqubieyiyang,dajiabujiaodebeishengsuoyouduomedute,jiushiyiqunkexuejiazaihaoqixinherongyuqudongxiaquzuozijideshi,tamenzaiyideyeshizhongguodingjiandexueshushuipingnengchanshengzenyangdeguojiyingxiangli,erbushizishuozihua。”对(dui)于(yu)“(“)什(shen)么(me)是(shi)正(zheng)常(chang)”(”)的(de)提(ti)问(wen),(,)王(wang)晓(xiao)东(dong)说(shuo),(,)“(“)就(jiu)像(xiang)北(bei)生(sheng)所(suo)模(mo)式(shi)与(yu)国(guo)外(wai)大(da)部(bu)分(fen)研(yan)究(jiu)所(suo)模(mo)式(shi)没(mei)有(you)本(ben)质(zhi)区(qu)别(bie)一(yi)样(yang),(,)大(da)家(jia)不(bu)觉(jiao)得(de)北(bei)生(sheng)所(suo)有(you)多(duo)么(me)独(du)特(te),(,)就(jiu)是(shi)一(yi)群(qun)科(ke)学(xue)家(jia)在(zai)好(hao)奇(qi)心(xin)和(he)荣(rong)誉(yu)驱(qu)动(dong)下(xia)去(qu)做(zuo)自(zi)己(ji)的(de)事(shi),(,)他(ta)们(men)在(zai)意(yi)的(de)也(ye)是(shi)中(zhong)国(guo)顶(ding)尖(jian)的(de)学(xue)术(shu)水(shui)平(ping)能(neng)产(chan)生(sheng)怎(zen)样(yang)的(de)国(guo)际(ji)影(ying)响(xiang)力(li),(,)而(er)不(bu)是(shi)自(zi)说(shuo)自(zi)话(hua)。(。)”(”)