AI Pulse

语音识别

3 篇文章 · 3 条要点 · 11 条信号 · 持续更新

📡

voicearena_ai发布Monsoon ASR 解决小语种语音识别缺口

𝕏2026 年 9 月 29 日
📡

VoiceArena 开源免费 Monsoon ASR 模型

𝕏2026 年 9 月 28 日
📡

SarvamAI发布Saaras V4语音转文字模型

𝕏2026 年 9 月 25 日
📡

HuggingModels发布VibeVoice ASR Streaming 语音识别模型(1.5B)

𝕏2026 年 9 月 9 日
📖

新覆盖58种印度语言的噪音鲁棒语音AI数据集发布

AI数据集2026 年 9 月 7 日
📡

@MinLiBuilds发布Hojo-ASR-Multi-V1 开源语音识别模型(0.0%)

𝕏2026 年 9 月 3 日
📡

基于Qwen3-4B微调的ASR模型 16G显存可本地部署

𝕏2026 年 9 月 3 日
📡

Meta发布Muse Voice Transcribe语音模型

𝕏2026 年 9 月 2 日
📖

IBM语音模型1秒处理3.5小时录音,可本地运行

AI模型发布2026 年 8 月 26 日
📡

Audio8-ASR-0.1B 小模型端侧搞定快语速多说话人

𝕏2026 年 8 月 6 日
📡

通义千问发布了新版语音识别ASR大模型

𝕏2026 年 7 月 31 日
📡

新型语音识别能直接听清多人同时说话

𝕏2026 年 7 月 31 日
📡

做文字转语音的公司,推出语音转文字模型了

𝕏2026 年 7 月 10 日
💡 GPT-Realtime-2 是首个具备 GPT-5 级推理能力的语音模型,能边听边思考 2026 年 5 月 8 日
💡 上下文窗口从 32K 增至 128K,专业术语保留改善,支持五档推理努力级别 2026 年 5 月 8 日
💡 Zillow 使用 GPT-Realtime-2 后通话成功率从 69% 提升至 95% 2026 年 5 月 8 日
📖

OpenAI发布新语音模型,AI能边听边思考并实时处理多任务

AIAPI2026 年 5 月 8 日

订阅 AI Pulse

每天 08:00 · 12:30 · 18:30 · 23:50 更新