中新网北京7月30日电 (记者 庞无忌)数字人不仅从“能看”走向“能干”,生成速度也不断加快。7月30日,科大讯飞首次对外发布“超拟人数字人实时生成技术”。
据介绍,过去,制作数字人通常需要约2小时真人视频采集及长周期训练,如今,仅需一张照片,即可实时生成数字人并开展自然交互。现场演示中,实时生成的数字人不仅拥有自然真实的表情、动作和口型,还可完成取物、喝水、唱歌、跳舞等复杂动作,实现更加流畅自然的人机互动。
这离不开一系列技术的支撑:依靠星火语音大模型能力,数字人实现通用常识领域自然流畅对话;构建积累的垂直领域知识库,降低回答幻觉率,提供更精准的专业回答;依托人设自定义和长期记忆能力,数字人能够保持稳定的人物设定,持续积累交互信息。
目前,交互服务场景成为数字人的主要落地场景,覆盖品牌直播、产品客服、无人门店等场景。随着大模型降低成本门槛,数字人有望从头部企业的“奢侈品”变为越来越多商家的“标配工具”。
在当日的圆桌论坛,来自中科趋势科技、中国电子技术标准化研究院、中粮资本、洽洽食品等的嘉宾,围绕“从虚拟形象到数字生产力”为主题进行探讨。分享中,多位嘉宾谈到,大模型技术的进步,让数字人不仅有颜值,更具有聪明的大脑,同时降低数字人成本,推动行业规模化应用。以金融为例,结合智能体与知识库,数字人成为可交互、可执行的数字员工。(完)
[huanqiushibaozhumeiguoteyuejizhefengyarenhuanqiushibaojizhezhaoshuang]jumeiguoyouxiandianshixinwenwang(CNN)5yue3ribaodao,5yue2ri,meiguozhuhuadashinigulasi·boensibiaoshi:“meiguoyijingzhunbeihaoyuzhongguoduihua,bingxiwangzhongfangnenggoujijihuiying。womenxiwangzailiangguozhengfuzhijian,jianliqigenghaohegengshencengcidegoutongqudao。”[([)环(huan)球(qiu)时(shi)报(bao)驻(zhu)美(mei)国(guo)特(te)约(yue)记(ji)者(zhe)冯(feng)亚(ya)仁(ren)环(huan)球(qiu)时(shi)报(bao)记(ji)者(zhe)赵(zhao)霜(shuang)](])据(ju)美(mei)国(guo)有(you)线(xian)电(dian)视(shi)新(xin)闻(wen)网(wang)((()C(C)N(N)N(N))())5(5)月(yue)3(3)日(ri)报(bao)道(dao),(,)5(5)月(yue)2(2)日(ri),(,)美(mei)国(guo)驻(zhu)华(hua)大(da)使(shi)尼(ni)古(gu)拉(la)斯(si)·(·)伯(bo)恩(en)斯(si)表(biao)示(shi):(:)“(“)美(mei)国(guo)已(yi)经(jing)准(zhun)备(bei)好(hao)与(yu)中(zhong)国(guo)对(dui)话(hua),(,)并(bing)希(xi)望(wang)中(zhong)方(fang)能(neng)够(gou)积(ji)极(ji)回(hui)应(ying)。(。)我(wo)们(men)希(xi)望(wang)在(zai)两(liang)国(guo)政(zheng)府(fu)之(zhi)间(jian),(,)建(jian)立(li)起(qi)更(geng)好(hao)和(he)更(geng)深(shen)层(ceng)次(ci)的(de)沟(gou)通(tong)渠(qu)道(dao)。(。)”(”)