音频模型
语音、音乐与音频理解模型 · 48 篇
站内搜索
搜索
2026年7月18日
语音模型
11:17
AssemblyAI 推出 Sync API:一个 HTTP 请求完成语音转写,延迟仅 134ms
4 次阅读
阅读全文
2026年7月17日
语音模型
11:13
Google Vids 推出个人数字分身:上传一张自拍和一段语音,AI 就能替你说话
8 次阅读
阅读全文
2026年7月15日
语音模型
11:09
AssemblyAI 推出 Sync API:短音频转录一次请求搞定,134ms 返回结果
5 次阅读
阅读全文
2026年7月8日
语音模型
11:23
Cohere 发布阿拉伯语 ASR 新 SOTA:2B 参数开源模型,WER 比 Whisper 低 11 个点
7 次阅读
阅读全文
2026年7月7日
语音模型
11:37
AssemblyAI Universal-3.5 Pro:原生语码转换、最准说话人分离,ASR 模型解决真实音频三大痛点
11 次阅读
阅读全文
2026年6月30日
音乐模型
11:12
Tidal 全面拒付 AI 生成音乐版税:7月起加标签、即日起停分成
14 次阅读
阅读全文
2026年6月29日
语音模型
11:10
ElevenLabs 接入 Google SynthID 水印:AI 生成音频终于有了「隐形身份证」
9 次阅读
阅读全文
2026年6月7日
音乐模型
10:18
LTX 2.3 开源三合一:Singularity 模型 + 多图参考 + 导演台免费平替 Seedance 2.0
25 次阅读
阅读全文
2026年5月30日
语音模型
20:07
ElevenLabs 发布 Dubbing v2:保留说话人情感的 AI 配音模型,支持 90+ 语言实时本地化
45 次阅读
阅读全文
2026年5月27日
音乐模型
20:05
Stability AI 开源 Stable Audio 3:从音效到音乐,最快不到 1 秒生成 20 秒立体声
6 次阅读
阅读全文
2026年5月23日
语音模型
09:08
DeepSeek 启动 100 亿美元融资轮,梁文锋宣布追求 AGI、坚持开源、短期不商业化
6 次阅读
阅读全文
2026年5月20日
语音模型
20:21
Corti 发布 Symphony for Speech-to-Text:医疗专用语音识别,词错率 1.4% 碾压 OpenAI 和 Whisper
7 次阅读
阅读全文
已显示 12 / 48 篇文章
加载更多
加装
AI
助手
首页
大语言模型
生图模型
视频模型
音频模型
AI硬件
AI工具
本站经验分享
正在读取账户...