跳到正文
5月16日周四
  1. OpenAI News20

    Canva 打造 AI 驱动的 Magic Studio

    Canva 推出 AI 驱动的 Magic Studio,为其月活超 1.75 亿的视觉传播平台加入 AI 创作能力。该平台支持制作演示文稿、视频、文档、网站和社交媒体图形,借助易用界面、丰富素材库和提效工具,让缺乏设计训练的知识工作者也能创作出视觉出色的内容。

5月15日周三
5月14日周二
  1. Hugging Face Blog62

    Google 发布开源视觉语言模型 PaliGemma

    Google 发布视觉语言模型家族 PaliGemma,由 SigLIP-So400m 图像编码器和 Gemma-2B 文本解码器组成,可输入图像与文本并输出文本。

    推荐理由:Google 开源视觉语言模型 PaliGemma 的完整发布说明,含架构、三种 checkpoint 与微调路径,便于判断适用场景。

5月13日周一
  1. OpenAI News82

    OpenAI 发布新旗舰模型 GPT-4o

    OpenAI 宣布推出新旗舰模型 GPT-4 Omni(GPT-4o),可在音频、视觉和文本之间进行实时推理。

    推荐理由:OpenAI 官方发布新旗舰模型,读者可据此了解其在音频、视觉与文本上的实时推理定位。

  2. Hugging Face Blog71

    Hugging Face 发布 Transformers Agents 2.0

    Hugging Face 发布 Transformers Agents 2.0,在原有智能体类型之外新增可基于历史观察迭代的 ReactAgent 等两类智能体,并加入共享功能。

    推荐理由:官方给出新智能体框架的模块划分与 GAIA 榜单成绩,可据此判断开源智能体方案的可用性。

5月9日周四
5月7日周二
5月6日周一
5月5日周日
5月3日周五
5月1日周三
  1. OpenAI News62

    OpenAI 封禁与俄罗斯相关操作“Bad Grammar”关联的账号

    OpenAI 封禁了一批与一项此前未报告的俄罗斯来源操作相关的账号,该操作被其命名为“Bad Grammar”。这些账号利用 AI 生成英语和俄语的 Telegram 评论,涉及乌克兰、摩尔多瓦、波罗的海地区及美国政治话题。

    推荐理由:OpenAI 披露一起此前未报告的俄罗斯相关账号操作,可了解平台如何界定并处置这类滥用行为。

4月30日周二
4月29日周一
4月24日周三
4月23日周二
4月22日周一
4月20日周六
4月19日周五
4月18日周四
4月17日周三
  1. Mistral AI82

    Mistral 发布开源模型 Mixtral 8x22B

    Mistral 发布开源模型 Mixtral 8x22B,采用稀疏 MoE 架构,141B 总参数中仅 39B 激活参数,以 Apache 2.0 许可开放。该模型支持英语、法语、意大利语、德语和西班牙语,具备数学与编码能力,原生支持函数调用,上下文窗口为 64K tokens。

    推荐理由:Mixtral 8x22B 以 39B 激活参数和 Apache 2.0 许可发布,读者可据此判断开源模型的性能与成本取舍。

4月16日周二

最多提供 50 页,更早的内容请使用搜索或主题页。