中新网北京7月30日电 (记者 庞无忌)数字人不仅从“能看”走向“能干”,生成速度也不断加快。7月30日,科大讯飞首次对外发布“超拟人数字人实时生成技术”。
据介绍,过去,制作数字人通常需要约2小时真人视频采集及长周期训练,如今,仅需一张照片,即可实时生成数字人并开展自然交互。现场演示中,实时生成的数字人不仅拥有自然真实的表情、动作和口型,还可完成取物、喝水、唱歌、跳舞等复杂动作,实现更加流畅自然的人机互动。
这离不开一系列技术的支撑:依靠星火语音大模型能力,数字人实现通用常识领域自然流畅对话;构建积累的垂直领域知识库,降低回答幻觉率,提供更精准的专业回答;依托人设自定义和长期记忆能力,数字人能够保持稳定的人物设定,持续积累交互信息。
目前,交互服务场景成为数字人的主要落地场景,覆盖品牌直播、产品客服、无人门店等场景。随着大模型降低成本门槛,数字人有望从头部企业的“奢侈品”变为越来越多商家的“标配工具”。
在当日的圆桌论坛,来自中科趋势科技、中国电子技术标准化研究院、中粮资本、洽洽食品等的嘉宾,围绕“从虚拟形象到数字生产力”为主题进行探讨。分享中,多位嘉宾谈到,大模型技术的进步,让数字人不仅有颜值,更具有聪明的大脑,同时降低数字人成本,推动行业规模化应用。以金融为例,结合智能体与知识库,数字人成为可交互、可执行的数字员工。(完)
duijichuyanjiudewendingzhichi,guowaidingjianjigoushizenmezuode?2019nian,zhongkeyuanzuzhileyigekaochaxiangmu,zhizaitongguoshiditiaoyanshijiezhimingjichuyanjiujigou,zongjietaguojingyan,tansuoshenmeshishihezhongguoguoqingdejichuyanjiukeyanzuzhimoshi,zhuangcicanjialezheyixiangmu。对(dui)基(ji)础(chu)研(yan)究(jiu)的(de)稳(wen)定(ding)支(zhi)持(chi),(,)国(guo)外(wai)顶(ding)尖(jian)机(ji)构(gou)是(shi)怎(zen)么(me)做(zuo)的(de)?(?)2(2)01(1)9(9)年(nian),(,)中(zhong)科(ke)院(yuan)组(zu)织(zhi)了(le)一(yi)个(ge)考(kao)察(cha)项(xiang)目(mu),(,)旨(zhi)在(zai)通(tong)过(guo)实(shi)地(di)调(tiao)研(yan)世(shi)界(jie)知(zhi)名(ming)基(ji)础(chu)研(yan)究(jiu)机(ji)构(gou),(,)总(zong)结(jie)他(ta)国(guo)经(jing)验(yan),(,)探(tan)索(suo)什(shen)么(me)是(shi)适(shi)合(he)中(zhong)国(guo)国(guo)情(qing)的(de)基(ji)础(chu)研(yan)究(jiu)科(ke)研(yan)组(zu)织(zhi)模(mo)式(shi),(,)庄(zhuang)辞(ci)参(can)加(jia)了(le)这(zhe)一(yi)项(xiang)目(mu)。(。)