📡
voicearena_ai发布Monsoon ASR 解决小语种语音识别缺口
𝕏2026 年 9 月 29 日
📡
VoiceArena 开源免费 Monsoon ASR 模型
𝕏2026 年 9 月 28 日
📡
SarvamAI发布Saaras V4语音转文字模型
𝕏2026 年 9 月 25 日
📡
HuggingModels发布VibeVoice ASR Streaming 语音识别模型(1.5B)
𝕏2026 年 9 月 9 日
📖
新覆盖58种印度语言的噪音鲁棒语音AI数据集发布
AI数据集2026 年 9 月 7 日
📡
@MinLiBuilds发布Hojo-ASR-Multi-V1 开源语音识别模型(0.0%)
𝕏2026 年 9 月 3 日
📡
基于Qwen3-4B微调的ASR模型 16G显存可本地部署
𝕏2026 年 9 月 3 日
📡
Meta发布Muse Voice Transcribe语音模型
𝕏2026 年 9 月 2 日
📖
IBM语音模型1秒处理3.5小时录音,可本地运行
AI模型发布2026 年 8 月 26 日
📡
Audio8-ASR-0.1B 小模型端侧搞定快语速多说话人
𝕏2026 年 8 月 6 日
📡
通义千问发布了新版语音识别ASR大模型
𝕏2026 年 7 月 31 日
📡
新型语音识别能直接听清多人同时说话
𝕏2026 年 7 月 31 日
📡
做文字转语音的公司,推出语音转文字模型了
𝕏2026 年 7 月 10 日
💡
GPT-Realtime-2 是首个具备 GPT-5 级推理能力的语音模型,能边听边思考
2026 年 5 月 8 日
💡
上下文窗口从 32K 增至 128K,专业术语保留改善,支持五档推理努力级别
2026 年 5 月 8 日
💡
Zillow 使用 GPT-Realtime-2 后通话成功率从 69% 提升至 95%
2026 年 5 月 8 日
📖
OpenAI发布新语音模型,AI能边听边思考并实时处理多任务
AIAPI2026 年 5 月 8 日