登录 注册 退出
博客 AI资讯+
热门搜索: 2024 坍塌之后

标签:语音合成

共 8 篇文章
Fish Audio周年发布S2.1Pro:90ms延迟+耳语级情绪控制,让AI语音学会“说话”而不是“念稿” AI

Fish Audio周年发布S2.1Pro:90ms延迟+耳语级情绪控制,让AI语音学会“说话”而不是“念稿”

7月29日,Fish Audio周年发布S2.1Pro实时对话语音模型,首帧延迟约90ms,支持83种语言、5秒声音克隆,以及通过括号标签在文本任意位置实现逐词......

普思AI资讯 3星期前 6 阅读
千问Qwen-Audio-3.0-TTS正式开放:实时版首包延迟300ms,自然语言直接指挥AI“会表演” AI

千问Qwen-Audio-3.0-TTS正式开放:实时版首包延迟300ms,自然语言直接指挥AI“会表演”

7月20日,阿里千问发布语音合成大模型Qwen-Audio-3.0-TTS。Flash版首包延迟300ms,Plus版支持48kHz高清输出与3分钟长文本合成。......

普思AI资讯 1个月前 10 阅读
通义千问Qwen-Audio-3.0-TTS正式开放:首包延迟300ms,让AI声音学会“表演” AI

通义千问Qwen-Audio-3.0-TTS正式开放:首包延迟300ms,让AI声音学会“表演”

7月20日,阿里通义千问发布语音合成大模型Qwen-Audio-3.0-TTS。Flash版首包延迟300ms,Plus版支持48kHz高清输出与3分钟长文本合......

普思AI资讯 1个月前 10 阅读