公众号 公众号二维码 扫码关注公众号 AI工具导航 投稿
登录 注册 退出

标签:语音合成

共 8 篇文章
Google 发布 Gemini 3.8 双款语音模型:语音生成从"朗读"走向"可导演" AI

Google 发布 Gemini 3.8 双款语音模型:语音生成从"朗读"走向"可导演"

Google 发布 Gemini 3.8 Flash TTS 与 Flash-Lite TTS:前者侧重角色声音设计与逐句表演控制,后者面向大规模配音与语音智能......

讯场网 2小时前 849 阅读
Fish Audio周年发布S2.1Pro:90ms延迟+耳语级情绪控制,让AI语音学会“说话”而不是“念稿” AI

Fish Audio周年发布S2.1Pro:90ms延迟+耳语级情绪控制,让AI语音学会“说话”而不是“念稿”

7月29日,Fish Audio周年发布S2.1Pro实时对话语音模型,首帧延迟约90ms,支持83种语言、5秒声音克隆,以及通过括号标签在文本任意位置实现逐词......

普思AI资讯 1个月前 12 阅读
千问Qwen-Audio-3.0-TTS正式开放:实时版首包延迟300ms,自然语言直接指挥AI“会表演” AI

千问Qwen-Audio-3.0-TTS正式开放:实时版首包延迟300ms,自然语言直接指挥AI“会表演”

7月20日,阿里千问发布语音合成大模型Qwen-Audio-3.0-TTS。Flash版首包延迟300ms,Plus版支持48kHz高清输出与3分钟长文本合成。......

普思AI资讯 2个月前 18 阅读
通义千问Qwen-Audio-3.0-TTS正式开放:首包延迟300ms,让AI声音学会“表演” AI

通义千问Qwen-Audio-3.0-TTS正式开放:首包延迟300ms,让AI声音学会“表演”

7月20日,阿里通义千问发布语音合成大模型Qwen-Audio-3.0-TTS。Flash版首包延迟300ms,Plus版支持48kHz高清输出与3分钟长文本合......

普思AI资讯 2个月前 16 阅读