Skip to main content
Submitted by admin on

语音大模型的竞争,正在从"能不能把文字念出来"换成"能不能真正理解声音、组织声音"。阶跃星辰今天放出的 StepAudio 3 系列,就是冲着这个方向去的——五个模型一次全发:Realtime、ASR、TTS、Gen、Music。 最出挑的是 StepAudio 3 Realtime。在 Artificial Analysis 的 Conversational Dynamics 榜单上,它以 98.9% 的综...

来源:https://www.oschina.net/news/502502/step-audio-3

Aggregate 核验溯源
Domain Tag
harmonyos
Source Name
OSChina 开源资讯