跳到正文
10月2日周五
  1. AWS Machine Learning Blog22

    如何在 AWS 上为 Claude Platform 配置多环境访问

    AWS 博客给出 Claude Platform on AWS(CPonAWS)多环境访问的完整配置方案,采用专用 AI Services 账户加工作负载账户的三账户结构。AWS 工作负载通过跨账户 SigV4 免密钥调用推理,开发者用绑定开发工作区的 API key,外部环境则通过 OIDC 联邦获取短期凭证。生产与开发流量以 workspace 隔离,共享同一订阅。

9月30日周三
9月22日周二
3月27日周五
  1. Hugging Face Blog60

    Hugging Face 教你用开源模型替代 Claude 运行 OpenClaw 智能体

    Anthropic 正在限制 Pro/Max 订阅者在开放智能体平台中使用 Claude 模型,Hugging Face 提出两条迁移路径:通过 Hugging Face Inference Providers 调用开源模型,或在本地硬件上运行开源模型。

    推荐理由:Anthropic 收紧 Claude 在开放智能体平台的访问后,文章给出托管与本地两条迁移路径和具体配置命令。

1月28日周三
11月19日周三
  1. Google DeepMind82

    Google 发布智能体开发平台 Antigravity

    Google 发布智能体开发平台 Antigravity,即日起免费公开预览,提供 Gemini 3 Pro 的宽松速率限制。该平台在传统 AI IDE 之外新增以智能体为中心的 Manager 界面,可并行编排多个工作区中的智能体,并支持浏览器控制与异步交互。

    推荐理由:Google 把 IDE 改造成以智能体为中心的开发平台,读者可据此判断异步编排与 Artifacts 验证会怎样改变编码工作流。

8月27日周三
  1. OpenAI News62

    OpenAI 与 Anthropic 公布联合安全评估结果

    OpenAI 与 Anthropic 公布一次联合安全评估的结果,双方互相测试对方模型在失准、指令遵循、幻觉、越狱等方面的表现。OpenAI 称这是此类跨实验室合作评估,并提到其中的进展、挑战以及跨实验室协作的价值。

    推荐理由:两家头部实验室首次互测对方模型的对齐与越狱表现,可了解跨实验室安全评估的做法与发现。

8月19日周二
11月20日周三
  1. Hugging Face Blog40

    BAAI 推出 FlagEval Debate:首个多语言 LLM 辩论竞赛平台

    BAAI 推出 FlagEval Debate 平台,让大模型以辩论形式正面对抗,目前支持中文、英文、阿拉伯文和韩文四种语言。平台采用专家评审与用户投票的双重评估机制,并提供开发者自定义参数功能,以解决静态评测和 Chatbot Arena 类平台缺乏区分度、模型孤立生成及投票偏差等问题。2024 年 Q3 的实验显示,当前多数模型已具备参与辩论的能力。

11月19日周二
10月25日周三
7月26日周三
2月24日周五