跳到正文
ElevenLabs Blog· Aron Pammer·· 23 天前精选AI 评分66

ElevenLabs MCP 新增语音、音乐、图像与视频生成能力

Introducing voice, music, image, and video generation in the ElevenLabs MCP

AI 导读

ElevenLabs 为其 MCP 连接器加入生成能力,一次安装加一次 OAuth 登录后,助手内即可生成语音、转录、配音、音乐、音效、图像和视频,产物统一进入 ElevenCreative 工作区。

推荐理由

ElevenLabs 把语音、音乐、图像、视频生成统一进一个 MCP 连接器,读者可据此判断多模态创作在助手内完成的程度。

正文 · AI 翻译

ElevenLabs MCP 已经让你可以在日常使用的助手中管理你的智能体。而现在,它能做的远不止这些——它让你可以创作。只需一次安装和一次 OAuth 登录,你的助手就能生成语音、转录、配音、音乐、音效、图像和视频,你创作的一切都会进入你的 ElevenCreative 工作区。

它现已在 Claude、ChatGPT、Cursor、Grokbot、Hermes 等平台上线。一个连接器覆盖整个技术栈,调用超过 50 个模型,无需运行服务器,也无需管理 API 密钥。

一个连接器覆盖整个技术栈

大多数创意工作横跨多个工具,而在它们之间来回切换正是时间被浪费的地方。ElevenLabs MCP 把你已经依赖的模型带入你正在进行的对话中。用平实的语言说出你的需求,它就会在对话中直接生成,从一段配音到一部配好配乐的完整视频。

连接之后,你可以创作以下内容。

文本转语音

在对话中请求任意一个来自语音库的声音的配音,文本转语音 就会生成它,随时可用。没有导出步骤,也不用打开第二个标签页。你描述台词和你想要的演绎方式,音频就会在你请求的地方返回。

使用 Scribe 的语音转文本

传入一段录音,Scribe 就会返回一份干净的转录文本,包含说话人标签和覆盖 99 种语言的时间戳。从那里到脚本、字幕或配音只有一步之遥,无需离开助手。

配音

请求另一种语言的音轨,配音 会通过同一个连接器运行,保留原始说话人的声音、语气和演绎方式。完成的配音会在对话中返回。

音乐和音效

生成任意流派或风格的音轨,带人声或不带人声,用来垫在视频下方或独立撑起一段广告。音效也是同样的方式,从一段简短提示到一组可供你挑选的变体。

图像和视频

图像和视频与音频工具并排而立。生成一张图像、编辑它、把它制作成动画视频,再加上唇形同步,全部通过同一个连接器、全部在同一个对话线程中完成。图像和视频模型都是领先的,它们与你已经信任的语音、音乐和 音效 并肩工作。

从一份简报到一个成品

这些工具单独使用就很有用,而组合起来更有用。一份简报就能产出脚本、配音、音乐 铺底、声音设计和承载它的视频。你只需描述一次这个项目,然后在同一个地方组装各个部分,而不是事后在多个独立应用之间把它们拼接起来。

与驱动 ElevenLabs Agents 的是同一个连接器

这与驱动 ElevenLabs Agents 的是同一个 MCP,因此一次安装即可覆盖两者。如果你的团队已经把 ElevenLabs 连接起来以审查智能体表现或创建新的智能体,那么这些创意工具对你来说已经可用。无需再做其他设置。

一切都会进入你的 ElevenCreative 工作区

每一次生成都会进入你的 ElevenCreative 工作区,你可以在那里打开 Studio 来完成作品。调整时间线、精修旁白、叠加音乐和音效,准备好后导出。对话能让你快速得到一个不错的初版,而当你想要对最终剪辑进行精确控制时,Studio 就在那里。

工作区管理员决定该连接可以调用哪些工具,数据驻留地在建立连接时选定,因此负责该账户的人员始终掌控它可以访问的内容。

已在 Claude、ChatGPT 和 Cursor 中可用

安装只需点击几下。在 Claude、ChatGPT 或 Cursor 的连接器目录中找到 ElevenLabs,选择连接,然后使用你的 ElevenLabs 账户登录。访问权限通过 OAuth 限定在你的工作区范围内,无需管理 API 密钥,也无需手动配置。

Flows 中可用的每个节点都可以通过 MCP 使用,因此你可以从助手访问的范围与你在画布上构建的范围一致。

开始使用

立即添加 ElevenLabs MCP,开始创作。

elevenlabs.io/mcp

来源:ElevenLabs Blog · elevenlabs.io