跳到正文
10月4日周日
  1. Simon Willison36

    Simon Willison:按量付费服务需要默认硬性预算上限,AWS 已推出支出限额

    Simon Willison 呼吁按量付费的 API 和服务默认设置硬性预算上限,即达到 $X/月后直接切断并返回错误,而非仅发送警告邮件。他指出 AWS 已在 9 月 16 日推出月度支出限额功能,项目达到限额后当月暂停,但该功能目前仅向有限客户开放;Google Cloud 则在 7 月推出类似的 Spend Caps。

10月3日周六
10月2日周五
  1. MIT Technology Review · AI17

    用自主 AI 重新定义企业智能:MIT Technology Review 报告解析“智能体转型”

    MIT Technology Review 报告指出,2026 年全球 AI 投资将达 2.5 万亿美元,同比增长 44%,但多数企业仍未能靠 AI 增长收入。报告将 AI 从工具转向运营模式的转变称为“智能体转型”,主张以流程重构为先、建设可组合架构与数据主权,让 AI 智能体能在数据所在处直接查询和准备数据。

10月1日周四
9月30日周三
9月29日周二
9月22日周二
9月21日周一
  1. NVIDIA Blog38

    NVIDIA 谈 AI 安全:如何在智能体栈的每一层解决这一工程问题

    NVIDIA 提出 AI 安全是工程问题,需要明确的安全需求、可执行的管控、明确的责任人和防护有效的证据。其开源安全运行时 NVIDIA OpenShell 在智能体推理范围之外强制执行策略并提供沙箱化执行,Cisco DefenseClaw 在其上增加治理层,JFrog 则集成 OpenShell 扫描和验证智能体技能。

7月30日周四
  1. Hugging Face Blog22

    GPU 管理:为什么闲置 GPU 正在成为新的停场飞机

    Hugging Face 博客指出,AI 的下一个真正瓶颈是 GPU 利用率而非模型智能。GPU 按日历小时计费,却只在计算小时产出,企业自建集群后问题从"能否买到加速器"变成"能否让它们保持忙碌"。文章以航空业停场飞机作类比,强调集群即使满载也可能浪费大部分潜力,因为 GPU 全天运行而需求并不持续。

7月14日周二
7月7日周二
7月6日周一
6月1日周一
2月3日周二
  1. Hugging Face Blog38

    从 DeepSeek 到 AI+:全球开源 AI 生态的未来走向

    Hugging Face 博客第三篇中国开源 AI 系列文章指出,开源已成为中国 AI 机构近期的主流路线。Qwen 在 Hugging Face 上的衍生模型超过 113k,远超 Llama 的 27k 和 DeepSeek 的 6k;腾讯自 2025 年 5 月起以混元品牌加速开源视觉、视频与 3D 模型,百度则通过 Ernie 4.5 系列和 PaddlePaddle 重返开源生态。

1月27日周二
10月29日周三
  1. Hugging Face Blog66

    Hugging Face 分析全球算力格局变化:中国开源模型与国产芯片的相互牵引

    Hugging Face 发布分析文章,指出中国开源权重模型的推理已开始由华为昇腾、寒武纪等国产芯片承载,部分模型开始用国产芯片训练。文章认为美国出口管制与中国芯片产能提速高度相关,算力稀缺也促使 DeepSeek 的 MLA、GRPO 等效率创新走向开源,并推动 CUDA 之外的软件生态成形。

    推荐理由:梳理中国开源模型与国产芯片互相牵引的路径,可看到算力受限如何反过来塑造模型架构与部署生态。

4月13日周三
10月26日周二
  1. Hugging Face Blog28

    大语言模型:新的摩尔定律?

    微软和 NVIDIA 发布 Megatron-Turing NLG 530B,号称全球最大最强的生成式语言模型,但训练需数百台 DGX A100 服务器、成本近 1 亿美元。作者质疑这类超大模型趋势:基准提升有限,却带来高昂成本、复杂度和碳足迹,并建议改用预训练模型、更小模型(如 DistilBERT 保留 97% 语言理解、体积小 40%、速度快 60%)和微调。