面向声音复刻场景的AI工具,业界也用声音克隆、人声分离来描述同类能力,检索时常混着出现,围绕声音复刻,模型能直接完成变声、语音识别、混音母带,省去大量手工操作,日常使用集中在有声书制作、主播这类人群,新手也能照模板跑通,在有声书、直播等任务里用得最多,把零散流程串成一条线。
科大讯飞推出的全栈式AI虚拟数字人平台,提供形象资产构建、AI驱动、多模态交互及场景化虚拟人产品服务。
百度文心驱动的数字人平台,覆盖电商直播、口播视频与实时互动三大场景,支持真人克隆。
文本转语音合成服务,提供大模型合成、声音复刻与多语种音色,可接入各类业务系统。