Gemini API Changelog·· 2025-05-20精选AI 评分66
Google 发布 Gemini 2.5 Flash 预览版及多款语音、音乐模型
May 20, 2025
AI 导读
Google 在 Gemini API 更新中发布 gemini-2.5-flash-preview-05-20,一款主打性价比与自适应思考的预览模型,同时发布 gemini-2.5-pro-preview-tts 和 gemini-2.5-flash-preview-tts,支持单人或双人语音生成。
推荐理由
Gemini API 一次更新集中放出多款预览模型与工具能力,可据此判断多模态与实时语音的可用边界。
正文 · AI 翻译
API 更新:
- 推出了对自定义视频预处理的支持,可使用裁剪区间和可配置的帧率采样。
- 推出了多工具使用功能,支持在同一个
generateContent请求中配置代码执行和基于 Google 搜索的 Grounding。 - 在 Live API 中推出了对异步函数调用的支持。
- 推出了一款实验性的URL 上下文工具,用于将 URL 作为附加上下文提供给提示词。
模型更新:
- 发布了
gemini-2.5-flash-preview-05-20,这是一款 Gemini 预览版模型,针对性价比和自适应思考进行了优化。如需了解更多信息,请参阅Gemini 2.5 Flash Preview和Thinking。 - 发布了
gemini-2.5-pro-preview-tts和gemini-2.5-flash-preview-tts模型,它们能够以一位或两位说话人生成语音。 - 发布了
lyria-realtime-exp模型,可实时生成音乐。 - 发布了
gemini-2.5-flash-preview-native-audio-dialog和gemini-2.5-flash-exp-native-audio-thinking-dialog,这是适用于 Live API 的新 Gemini 模型,具备原生音频输出能力。如需了解更多信息,请参阅Live API 指南和Gemini 2.5 Flash Native Audio。 - 发布了
gemma-3n-e4b-it预览版,可在AI Studio上使用,也可通过 Gemini API 使用,这是 Gemma 3n 发布的一部分。
来源:Gemini API Changelog · ai.google.dev