中新网北京7月30日电 (记者 庞无忌)数字人不仅从“能看”走向“能干”,生成速度也不断加快。7月30日,科大讯飞首次对外发布“超拟人数字人实时生成技术”。
据介绍,过去,制作数字人通常需要约2小时真人视频采集及长周期训练,如今,仅需一张照片,即可实时生成数字人并开展自然交互。现场演示中,实时生成的数字人不仅拥有自然真实的表情、动作和口型,还可完成取物、喝水、唱歌、跳舞等复杂动作,实现更加流畅自然的人机互动。
这离不开一系列技术的支撑:依靠星火语音大模型能力,数字人实现通用常识领域自然流畅对话;构建积累的垂直领域知识库,降低回答幻觉率,提供更精准的专业回答;依托人设自定义和长期记忆能力,数字人能够保持稳定的人物设定,持续积累交互信息。
目前,交互服务场景成为数字人的主要落地场景,覆盖品牌直播、产品客服、无人门店等场景。随着大模型降低成本门槛,数字人有望从头部企业的“奢侈品”变为越来越多商家的“标配工具”。
在当日的圆桌论坛,来自中科趋势科技、中国电子技术标准化研究院、中粮资本、洽洽食品等的嘉宾,围绕“从虚拟形象到数字生产力”为主题进行探讨。分享中,多位嘉宾谈到,大模型技术的进步,让数字人不仅有颜值,更具有聪明的大脑,同时降低数字人成本,推动行业规模化应用。以金融为例,结合智能体与知识库,数字人成为可交互、可执行的数字员工。(完)
jinnian2yue,zhongyangzhengzhijudedisancijitixuexizhong,xijinpingzongshujiqiangtiao,yaojianchi“sigemianxiang”,jianchimubiaodaoxiangheziyoutansuo“liangtiaotuizoulu”,bashijiekejiqianyantongguojiazhongdazhanlvexuqiuhejingjishehuifazhanmubiaojieheqilai。今(jin)年(nian)2(2)月(yue),(,)中(zhong)央(yang)政(zheng)治(zhi)局(ju)的(de)第(di)三(san)次(ci)集(ji)体(ti)学(xue)习(xi)中(zhong),(,)习(xi)近(jin)平(ping)总(zong)书(shu)记(ji)强(qiang)调(tiao),(,)要(yao)坚(jian)持(chi)“(“)四(si)个(ge)面(mian)向(xiang)”(”),(,)坚(jian)持(chi)目(mu)标(biao)导(dao)向(xiang)和(he)自(zi)由(you)探(tan)索(suo)“(“)两(liang)条(tiao)腿(tui)走(zou)路(lu)”(”),(,)把(ba)世(shi)界(jie)科(ke)技(ji)前(qian)沿(yan)同(tong)国(guo)家(jia)重(zhong)大(da)战(zhan)略(lve)需(xu)求(qiu)和(he)经(jing)济(ji)社(she)会(hui)发(fa)展(zhan)目(mu)标(biao)结(jie)合(he)起(qi)来(lai)。(。)