ElevenLabs MCP 新增语音、音乐、图像与视频生成能力
Introducing voice, music, image, and video generation in the ElevenLabs MCP
ElevenLabs 为其 MCP 连接器加入生成能力,一次安装加一次 OAuth 登录后,助手内即可生成语音、转录、配音、音乐、音效、图像和视频,产物统一进入 ElevenCreative 工作区。
ElevenLabs 把语音、音乐、图像、视频生成统一进一个 MCP 连接器,读者可据此判断多模态创作在助手内完成的程度。
ElevenLabs MCP 已经让你可以在日常使用的助手中管理你的智能体。而现在,它能做的远不止这些——它让你可以创作。只需一次安装和一次 OAuth 登录,你的助手就能生成语音、转录、配音、音乐、音效、图像和视频,你创作的一切都会进入你的 ElevenCreative 工作区。
它现已在 Claude、ChatGPT、Cursor、Grokbot、Hermes 等平台上线。一个连接器覆盖整个技术栈,调用超过 50 个模型,无需运行服务器,也无需管理 API 密钥。
一个连接器覆盖整个技术栈
大多数创意工作横跨多个工具,而在它们之间来回切换正是时间被浪费的地方。ElevenLabs MCP 把你已经依赖的模型带入你正在进行的对话中。用平实的语言说出你的需求,它就会在对话中直接生成,从一段配音到一部配好配乐的完整视频。
连接之后,你可以创作以下内容。
文本转语音
在对话中请求任意一个来自语音库的声音的配音,文本转语音 就会生成它,随时可用。没有导出步骤,也不用打开第二个标签页。你描述台词和你想要的演绎方式,音频就会在你请求的地方返回。
使用 Scribe 的语音转文本
传入一段录音,Scribe 就会返回一份干净的转录文本,包含说话人标签和覆盖 99 种语言的时间戳。从那里到脚本、字幕或配音只有一步之遥,无需离开助手。
配音
请求另一种语言的音轨,配音 会通过同一个连接器运行,保留原始说话人的声音、语气和演绎方式。完成的配音会在对话中返回。
音乐和音效
生成任意流派或风格的音轨,带人声或不带人声,用来垫在视频下方或独立撑起一段广告。音效也是同样的方式,从一段简短提示到一组可供你挑选的变体。
图像和视频
图像和视频与音频工具并排而立。生成一张图像、编辑它、把它制作成动画视频,再加上唇形同步,全部通过同一个连接器、全部在同一个对话线程中完成。图像和视频模型都是领先的,它们与你已经信任的语音、音乐和 音效 并肩工作。
从一份简报到一个成品
这些工具单独使用就很有用,而组合起来更有用。一份简报就能产出脚本、配音、音乐 铺底、声音设计和承载它的视频。你只需描述一次这个项目,然后在同一个地方组装各个部分,而不是事后在多个独立应用之间把它们拼接起来。
与驱动 ElevenLabs Agents 的是同一个连接器
这与驱动 ElevenLabs Agents 的是同一个 MCP,因此一次安装即可覆盖两者。如果你的团队已经把 ElevenLabs 连接起来以审查智能体表现或创建新的智能体,那么这些创意工具对你来说已经可用。无需再做其他设置。
一切都会进入你的 ElevenCreative 工作区
每一次生成都会进入你的 ElevenCreative 工作区,你可以在那里打开 Studio 来完成作品。调整时间线、精修旁白、叠加音乐和音效,准备好后导出。对话能让你快速得到一个不错的初版,而当你想要对最终剪辑进行精确控制时,Studio 就在那里。
工作区管理员决定该连接可以调用哪些工具,数据驻留地在建立连接时选定,因此负责该账户的人员始终掌控它可以访问的内容。
已在 Claude、ChatGPT 和 Cursor 中可用
安装只需点击几下。在 Claude、ChatGPT 或 Cursor 的连接器目录中找到 ElevenLabs,选择连接,然后使用你的 ElevenLabs 账户登录。访问权限通过 OAuth 限定在你的工作区范围内,无需管理 API 密钥,也无需手动配置。
Flows 中可用的每个节点都可以通过 MCP 使用,因此你可以从助手访问的范围与你在画布上构建的范围一致。
开始使用
立即添加 ElevenLabs MCP,开始创作。
来源:ElevenLabs Blog · elevenlabs.io