音频模型
语音、音乐与音频理解模型 · 59 篇
站内搜索
搜索
2026年10月8日
语音模型
11:06
Amazon Nova 2.5 Sonic 正式商用:语音Agent能边聊边查订单了,价格还不变
0 次阅读
阅读全文
2026年9月24日
语音模型
11:05
Google 发布 Gemini 3.8 Flash TTS:一句话设计新声音,30 秒克隆真人,登顶 Hume 语音基准
8 次阅读
阅读全文
2026年9月23日
语音模型
11:05
阿里云栖大会升级 Qwen-Audio 3.1:能听懂情绪、按脚本生成整段有声内容,同传延迟压到 2.5 秒
3 次阅读
阅读全文
2026年9月22日
语音模型
11:08
Kyutai 一周内给 Pocket TTS 连更四刀:默认英语模型换新,还能训 Muon、跑波兰语
5 次阅读
阅读全文
2026年9月16日
语音模型
11:05
Google 发布 Gemini 3.8 Live 系列语音模型:边聊边干活,还能看懂你指的东西
4 次阅读
阅读全文
2026年9月15日
语音模型
11:21
Apple Siri AI 发布:Expressive Voices 让语音交互进入新时代
3 次阅读
阅读全文
2026年9月14日
语音模型
11:07
腾讯混元开源 AuK:一个 1.5B 模型,从零样本 TTS 到音频编辑全能覆盖
34 次阅读
阅读全文
2026年9月13日
语音模型
11:04
Azure AI Speech 推出 LLM Speech 2607:多语种更准、延迟快 3 倍的语音识别更新
11 次阅读
阅读全文
2026年9月11日
语音模型
11:08
OpenAI 语音模型 GPT-Live-1 开放 API:能同时听和说的语音 Agent,每分钟 5 美分
5 次阅读
阅读全文
2026年9月8日
语音模型
01:07
Breeze TTS 2:一个 3B 开源 TTS,把语音克隆、声音设计、多人对话全装进 ComfyUI
24 次阅读
阅读全文
2026年9月7日
语音模型
11:06
VoiceStudio 开源神器:本地跑完 ElevenLabs 全家桶,646 种语言语音克隆免费用
3 次阅读
阅读全文
2026年9月5日
语音模型
11:16
Meta 发布 Muse Voice Transcribe:首款实时音频感知模型,一次搞定 20 人对话转录
6 次阅读
阅读全文
已显示 12 / 59 篇文章
加载更多
加装
AI
助手
首页
大语言模型
生图模型
视频模型
音频模型
AI硬件
AI工具
本站经验分享
正在读取账户...