音频模型
语音、音乐与音频理解模型 · 66 篇
站内搜索
搜索
2026年9月4日
语音模型
11:15
微软发布 MAI-Transcribe-2:号称全球最快最准最便宜的语音转文字模型,超越 GPT-Transcribe 和 Gemini
0 次阅读
阅读全文
语音模型
01:19
世界第一开源TTS Breeze 2来了:T8开源ComfyUI整合包及节点,搭配MiniMax H3极致情感演绎
2 次阅读
阅读全文
2026年9月3日
音乐模型
11:08
Suno 48小时内连吃两起新官司:音乐人集体诉讼+加拿大版权机构SOCAN起诉
0 次阅读
阅读全文
2026年8月25日
语音模型
11:14
Murf 推出 Falcon 2:号称实时语音代理里最快的 TTS,1 美分一分钟,10 秒音频就能克隆品牌声音
4 次阅读
阅读全文
2026年8月16日
音乐模型
11:06
ElevenLabs 上线 Sounds:免费 AI 音效与 Loop 库,文字描述即可生成新声音
6 次阅读
阅读全文
2026年8月15日
音乐模型
11:05
MiniMax Music 3.0 开源发布:8B+0.6B 双模型架构,最长5分钟完整歌曲生成,支持多语言人声
12 次阅读
阅读全文
2026年8月13日
语音模型
11:09
Deepgram 发布 Flux TTS:首个对话原生语音合成模型,80ms 延迟+跨轮次上下文,盲测击败 ElevenLabs
21 次阅读
阅读全文
2026年8月12日
语音模型
01:05
IndexTTS-2.5 开源发布:多语言零样本语音克隆,支持情感与语速精细控制
30 次阅读
阅读全文
2026年8月11日
语音模型
21:36
NVIDIA 开源全双工语音模型 VoiceChat 11B:一个模型替代 ASR+LLM+TTS 三件套,448ms 对话延迟还支持工具调用
12 次阅读
阅读全文
2026年8月8日
语音模型
11:22
阿里推出 CosyVoice Studio:国内首个 AI 语音生产力平台,Qwen-Audio-3.0 登顶全球
28 次阅读
阅读全文
2026年8月7日
音乐模型
11:11
Suno 宣布音频水印与透明性工具:AI 生成音乐将可被识别,下载政策同步收紧
17 次阅读
阅读全文
2026年8月6日
语音模型
11:39
字节 SeedRealtime 发布:首个音视频全双工大模型,AI 终于能「边看边听边说」
30 次阅读
阅读全文
已显示 12 / 66 篇文章
加载更多
加装
AI
助手
首页
大语言模型
生图模型
视频模型
音频模型
AI硬件
AI工具
本站经验分享
正在读取账户...