你听说了吗,ElevenLabs把多模态生成直接塞进AI助手了
有人泡了一杯茶的功夫,刚安装的新功能就已经跑通了工作流。
这次更新来自声音AI领域的知名开发商ElevenLabs,他们在自己的 MCP(模型上下文协议,一个能让AI模型和各类工具无缝交互的开放连接器) 里,新增了语音、音乐、图像和视频生成功能。也就是说,你平时一直在用的AI助手,现在可以直接调用ElevenLabs的模型,生成语音、转录文本、配音、音乐、音效、图像和视频,不用再打开多个网站切换工具。
目前ElevenLabs的ElevenCreative已经带来了超过50个对应不同模态的模型,已经有用户完成了和Claude Code的集成,整个过程非常顺畅。除此之外,ElevenLabs Conversational AI早已支持MCP,可以和成千上万的外部系统集成,还新增了权限层,能给工具调用设置审批要求,满足企业对安全管控的需求。音乐生成方面,ElevenLabs已经更新到Music v2.5,盲测显示大多数用户更偏好这个版本,而且所有套餐都支持无损下载。
@ElevenLabs 认为:你可以在已经在使用的助手里面完成所有多模态内容生成工作。
@ecommartinez 认为:差不多等了一年才等到这个功能,泡一杯茶回来就已经安装运行成功,这才是我想要的集成。
@kimmonismus 认为:这是ElevenLabs的一次大升级,做视频工作的时候,你还在改脚本就能听到粗剪配音了。
从增长数据来看,ElevenLabs从2025年开始,每个月的中端客户基数同比增长约100%,进入2026年后增速还提升到了约120%,没有明显放缓。现在它已经接入了41家企业的工作流,按照行业预测,到2030年企业级AI市场规模会达到1040亿美元,ElevenLabs目前的布局刚好踩中了企业整合AI工具的需求。
对于平时需要做内容、剪视频、搭产品原型的创作者来说,这次整合意味着原来需要打开三四个工具导出再导入的工作,现在在一个对话窗口里就能全部完成,省下了来回折腾的时间。企业用户也能在统一的工作流里调用各类生成工具,还能管控权限,降低安全风险。
现在越来越多的AI工具都在往通用集成方向走,下一个接入AI助手工作流的会是哪个细分功能?