OpenRouter 发布 5 月更新:Workspace Guardrails、语音 API 与 Model Fusion
May Release Spotlight
OpenRouter 公布 5 月更新,完成 1.13 亿美元 B 轮融资,月路由量达 100 万亿 token。新功能包括集中管理安全与治理的 Workspace Guardrails、支持 Whisper 等模型的语音与转写 API、把提示词并行发给多个模型并合成答案的 Model Fusion,以及企业私有模型路由和 Pareto Code Router。
OpenRouter 一次性放出护栏、语音、模型融合等多项平台能力,可据此判断多模型路由的治理与成本控制走向。
我们完成了 1.13 亿美元 B 轮融资,现在我们每月路由 100 万亿 token。以下是 5 月发布的其他所有内容。
工作区护栏
为通过你的工作区路由的每个请求提供集中式安全与治理。设置按成员和按密钥的支出限额,将流量锁定到模型和提供商允许列表,强制执行零数据保留,阻止针对 30 多种源自 OWASP 模式的提示注入,并在 PII 到达提供商之前将其脱敏。将规则叠加为一个护栏,或将其限定到特定的 API 密钥和成员,无需更改代码。
语音与转录 API
通过你已在使用的同一 API 密钥为任何应用添加语音功能。语音转文本已上线,支持 Whisper、GPT-4o Mini Transcribe 和 Voxtral;文本转语音在模型 API 中公开了 supported_voices。两者都内置了提供商故障转移和上游错误透传。
模型融合
将你的提示并行路由到多个模型,并将其响应合成为一个更高质量的单一答案。模型融合现已作为 API 插件、服务器工具和聊天室编辑器中的功能提供。你可以在一次调用中获得专家集成,而不是依赖单个模型。
模型对比
最多可并排比较五个模型的价格、上下文长度和基准分数。重建后的对比页面包含“高亮最佳”开关、按提供商编码的智能、编码和代理指标基准图表,以及可快速添加模型的交互式槽位卡片。
私有模型(企业版)
通过标准的 completions 和 responses API 路由到你自己的自定义、微调或专用模型端点。你的私有模型享有与平台上任何公共模型相同的护栏、可观测性和计费。仅在企业版计划中提供。
帕累托代码路由器
设置 min_coding_score,并路由到达到你质量门槛的最便宜的具备代码能力的模型。你的编码代理不再为足够好的代码支付过高费用。可在插件设置中按工作区配置默认值。
企业版与工作区控制
为大规模运行 OpenRouter 的团队发布的一系列功能:
- IP 允许列表强制执行。带有 IP 允许列表的 API 密钥现在会主动阻止来自未授权 IP 的请求,并返回
403,从仅观察模式升级而来。文档 - BYOK 管理 API。以编程方式跨工作区列出、创建、更新和删除自带密钥凭据。密钥现在按优先级分组,支持拖放重新排序,并针对失败请求提供一键“测试密钥”。API 文档
- 可观测性目标 API。用于通过管理密钥管理 Datadog、Langfuse、LangSmith 和其他可观测性集成的 CRUD 端点。API 文档
- 按提供商的 ZDR 控制。为非前沿、Anthropic、OpenAI 和 Google 提供商分别设置零数据保留开关,这样你就可以按提供商满足合规要求,而无需限制整个模型目录。
- 跨工作区复制护栏。通过“复制到…”菜单,只需点击几下即可在所有工作区中标准化安全策略。
本月还发布了
Presets API。 可直接从推理请求体创建或版本化预设,现支持 Anthropic Messages 和 Responses 皮肤,并提供 TypeScript 和 Python SDK 支持。文档
Human-in-the-loop 工具。 一种新的 SDK 工具类型,可在返回结果前暂停执行并等待人工输入,适用于需要在任务中途进行人工判断的智能体。博客文章
Session-id 提供商粘性。 共享同一 session_id 的请求现在会路由到同一提供商,并在多轮对话中固定到同一具体模型,从而提高多轮智能体工作流的缓存命中率。文档
自动路由器 cost_quality_tradeoff。 用 0 到 10 的整数替代旧的二元开关,在使用自动路由器时对成本与质量进行更精细的控制。文档
重新设计的模型页面。 全新的模型页面页眉、带有 /responses 和 /messages 端点的分步 API 选项卡、全屏模型选择器,以及用于内联测试的 playground 侧边面板。
日志中的请求选项卡。 在生成日志旁提供完整的请求级下钻,支持请求 ID 过滤和时间选择器简写(15min、1h、3d)。日志
改进的编码智能体归因。 Cursor、GitHub Copilot、Cline、RooCode、Kilo Code、Zed 和 OpenCode 现在可在活动日志中被正确识别,让你看到是哪些工具驱动了你的使用量。
API 密钥上的用量与预算。 按护栏层级展示支出图表和预算进度,直接显示在每个 API 密钥上。
排行榜每日数据集。 GET /api/v1/datasets/rankings-daily 返回按每日 token 量排名的前 50 个模型,用于程序化分析。
新模型
5 月发布了 20 个模型,涵盖文本、语音、图像、视频和编码:
- Anthropic Claude Opus 4.8: Anthropic 最新的 Opus,支持会话中途系统消息,另有一个快速变体
- Google Gemini 3.5 Flash: Google 最新的 Flash 模型
- xAI Grok 4.3: xAI 最新的前沿模型
- xAI Grok Imagine Video: 来自 xAI 的视频生成
- xAI Grok Build 0.1: xAI 的代码生成模型
- Qwen Qwen3.7 Max: Qwen 最新的 max 层级模型
- Recraft V3、V4、V4 Pro: 三个新的图像生成模型
- Mistral Voxtral Mini Transcribe: Mistral 的语音转文本模型
此外还有:Gemini 3.1 Flash Lite、GPT Chat Latest、CoBuddy(免费)、Ring-2.6-1T(免费)、Perceptron Mk1 等。
以上所有内容现已上线。浏览完整模型目录,或 在 Discord 上告诉我们缺少什么。
来源:OpenRouter Blog · openrouter.ai