行情中心 沪深A股 上证指数 板块行情 股市异动 股圈 专题 涨跌情报站 盯盘 港股 研究所 直播 股票开户 智能选股
全球指数
数据中心 资金流向 龙虎榜 融资融券 沪深港通 比价数据 研报数据 公告掘金 新股申购 大宗交易 业绩速递 科技龙头指数

科大讯飞语音合成技术升级 声音复刻与超拟人能力实现突破

上海证券报 06-27 18:33

上证报中国证券网讯6月26日,科大讯飞宣布语音合成技术全新升级,一句话声音复刻与超拟人合成两大核心能力实现突破。只需一句话录音,AI就能完整捕捉用户喉腔共鸣、口音特点、气息流转等发音特征,还原用户的停顿习惯、情感起伏和呼吸节奏,达到复刻效果。专业测评显示,科大讯飞一句话声音复刻技术在相似度、准确度等维度行业领先。

2024年4月,讯飞星火APP的“一句话声音复刻”功能正式上线。在智能语音领域,声音复刻效果的核心指标始终围绕相似度与准确度两大维度展开。相似度决定“第一耳印象”,包含音色特质及风格韵味;准确度则关乎声音复刻是否好用,确保发音标准、停顿自然、语气连贯。

据介绍,此次技术突破的关键,除了星火语音大模型底座的基础和持续迭代,还构建了一套三阶段层次化语音建模框架。首先,通过星火底座大模型精确捕捉发音规律和韵律特征。其次,在音色恢复阶段解耦并重构声学特征。最后,通过高精度声码器恢复高保真波形。

在音色解耦表征能力的基础上,科大讯飞在声音复刻场景针对性进行两项关键技术的尝试与突破:音色编码增强、强化学习。在需要深入交流的场景里,仅有相似音色并不足够。讯飞的超拟人合成技术此次进阶的重点是赋予AI声音以“上下文情商”。面对多轮对话的复杂度,科大讯飞开发了上下文感知的语音生成系统。

科大讯飞研究院院长刘聪表示:“我们希望声音不止于工具,更成为承载情感与个性的新维度,赋能更多场景行业、催生更多可能”。属于AI声音的多元化、情感化时代,正加速驶入现实。

业内人士认为,从曾经要录上数十个小时的语音素材,到录入几段话,再到现在仅用一句话就能复刻声音,语音合成技术一直在向更快、更好、更易用的方向奔跑。一句话复刻技术的进阶,代表着能用更少的资源、更快的速度带来惊艳且实用的效果,显著降低了应用门槛,让更多的场景和行业衍生出更多的个性化需求。

免责声明:本页所载内容来旨在分享更多信息,不代表九方智投观点,不构成投资建议。据此操作风险自担。投资有风险、入市需谨慎。

举报

相关股票

相关板块

  • 板块名称
  • 最新价
  • 涨跌幅

相关资讯

扫码下载

九方智投app

扫码关注

九方智投公众号

头条热搜

涨幅排行榜

  • 上证A股
  • 深证A股
  • 科创板
  • 排名
  • 股票名称
  • 最新价
  • 涨跌幅
  • 股圈