OpenAI 封禁利用 AI 从事社会工程与影响力活动的账号
OpenAI 封禁了一批利用 AI 进行社会工程、监控主题研究和针对批评者的影响力活动的账号。这些账号被用于社交工程与舆论影响操作。
OpenAI 封禁了一批利用 AI 进行社会工程、监控主题研究和针对批评者的影响力活动的账号。这些账号被用于社交工程与舆论影响操作。
OpenAI 封禁了一批与疑似欺诈性就业活动相关的账号,这些账号利用 AI 生成用于虚假远程职位申请的材料。
OpenAI 封禁了一批利用 AI 生成帖文、批评一名台湾社交媒体网红及相关美国话题的账号。该行动被命名为“Sneer Review”,涉及中国来源的影响力活动。
OpenAI 封禁了一批中国来源账号,这些账号使用 AI 生成美国政治内容,并研究人物、运动和在线社群。该行动被命名为 Operation Uncle Spam,指向美国政治极化影响活动。
OpenAI 封禁了一批利用 AI 在社交平台生成菲律宾政治及公职人员相关评论的账号。
OpenAI 封禁了一批疑似源自俄罗斯的账号,这些账号利用 AI 生成涉及乌克兰、NATO 及德国国内议题的德语政治内容。
OpenAI 封禁了一批与公开归因于中国的威胁行为者相关的账号,这些账号利用 AI 辅助漏洞研究、脚本编写、翻译和行动排障。
OpenAI 封禁了一批俄语账号,这些账号利用 AI 构建恶意软件、改进 loader 并排查网络工具问题。此次行动代号 "ScopeCreep",针对的是俄语恶意软件开发活动。
Wix 的 AI Website Builder 由 OpenAI 提供支持,用户只需通过对话描述想法,即可在几分钟内创建完整网站。
Mistral AI 发布首个面向代码的嵌入模型 Codestral Embed,官方称其在真实代码数据检索任务上优于 Voyage Code 3、Cohere Embed v4.0 和 OpenAI 的大型嵌入模型。
推荐理由:官方给出代码嵌入模型在检索基准上的对比与按维度裁剪的存储成本权衡,可据此评估代码 RAG 的选型。
Hugging Face 分享研究,将 CodeAgent 的思考与代码强制以结构化 JSON 生成,在 GAIA、MATH、SimpleQA、Frames 等基准上平均比普通 CodeAgent 高出 2-7 个百分点。
Mistral 发布 Agents API,将自家语言模型与代码执行、图像生成、文档库、Web 搜索等内置连接器以及 MCP 工具结合,并提供跨对话的持久记忆与智能体编排能力。
推荐理由:官方给出 Agents API 的连接器、记忆与多智能体编排能力,可据此判断企业级智能体平台的搭建方式。
用户测试 Liger GRPO loss 与 TRL 集成时,在 DeepSpeed ZeRO3、bf16 精度下使用 Qwen2.5-0.5B-Instruct 训练,触发形状不匹配报错。错误发生在 liger_kernel 的 fused_linear_ppo 前向计算中,经 torch._dynamo 编译后抛出。
OpenAI 将 Operator 的底层模型从 GPT-4o 版本替换为基于 OpenAI o3 的版本,API 版本仍基于 4o。该变动作为 OpenAI o3 与 o4-mini 系统卡增补内容公布。
Dell 在 Dell Tech World 上发布新版 Dell Enterprise Hub,提供 Meta Llama 4 Maverick、DeepSeek R1。
Hugging Face 将 JS 版 Tiny Agents 移植到 Python,并扩展 huggingface_hub 客户端 SDK 使其充当 MCP Client,可从 MCP 服务器拉取工具并在推理时传给 LLM。
推荐理由:原文给出约 70 行代码实现 MCP 智能体的完整路径,读者可据此理解工具调用循环的最小结构。
CodeRabbit 采用 OpenAI 的 o3、o4-mini 和 GPT-4.1 模型改造代码审查流程,提升审查准确率并加快 PR 合并速度。该方案帮助开发者更快交付代码,减少 bug 并提高投资回报率。
OpenAI 宣布推出 Stargate UAE,这是其 AI 基础设施平台 Stargate 的首次国际部署。
推荐理由:OpenAI 官方宣布 Stargate 首次落地海外,读者可据此了解其 AI 基础设施的国际化布局。
Mistral AI 与 All Hands AI 合作发布智能体 LLM Devstral,在 SWE-Bench Verified 上取得 46.8%,比此前开源 SOTA 高出 6 个百分点以上,并以 Apache 2.0 许可开源。
推荐理由:Devstral 在 SWE-Bench Verified 上以 46.8% 超过此前开源 SOTA 逾 6 个百分点,并给出单卡 4090 可跑的本地部署路径。
Falcon-H1 系列发布六个开源模型,参数规模从 0.5B 到 34B,每个尺寸均提供 base 与 instruct 版本,采用 Apache 2.0 许可。
推荐理由:Falcon-H1 用注意力与 SSM 并行混合架构覆盖 0.5B 到 34B 六个尺寸,可对照其长上下文吞吐与同尺寸 Transformer 模型的取舍。
阿联酋 TII 发布 7B 参数的 Falcon-Arabic,基于 Falcon 3 架构,支持阿拉伯语、英语等多种语言,上下文长度 32,000 tokens。该模型在 OALL v2 基准上超越同尺寸及至多 4 倍大的阿拉伯语 LLM,训练采用扩展 32,000 个阿拉伯语 token 的词表与 100% 原生阿拉伯语数据。
Hugging Face Diffusers 现已集成 bitsandbytes、GGUF、torchao、Quanto 和原生 FP8 等多种量化后端,并以 Flux-dev 为例展示其效果。
Hugging Face 发布 nanoVLM,一个用纯 PyTorch 训练视觉语言模型(VLM)的轻量工具包,可在免费 Colab 上启动训练,灵感来自 nanoGPT。
推荐理由:Hugging Face 官方给出纯 PyTorch 训练 VLM 的最小仓库,读者可据此理解视觉与语言模态如何对齐并自行训练。
在 Microsoft Build 大会上,Satya Nadella 宣布扩大与 Hugging Face 的合作,Azure AI Foundry 的 Hugging Face Collection 现可一键部署 1 万多个开放模型,覆盖文本、音频和图像任务。
OpenAI 发布 o3 和 o4-mini 系统卡的补充说明,介绍云端编码智能体 Codex。Codex 由 codex-1 驱动,后者是 OpenAI o3 针对软件工程优化的版本,通过强化学习在多种环境的真实编码任务上训练,以生成贴近人类风格和 PR 偏好的代码、精确遵循指令,并反复运行测试直至通过。
推荐理由:官方系统卡补充说明 Codex 由 o3 衍生模型 codex-1 驱动,可了解其训练方式与编码定位。
Falcon-Edge 系列发布,基于 BitNet 架构的三值(1.58bit)语言模型,提供 1B 和 3B 两种规模,每种规模各有 base 与指令微调版本。
Hugging Face 在博客中表示,未来目标是让 Transformers 成为各框架之间的模型定义中枢,模型架构只要被 Transformers 支持,就能在生态其他工具中获得支持。
推荐理由:Hugging Face 官方说明 Transformers 将作为跨框架模型定义中枢,读者可据此理解模型接入与部署链路的变化。
Expedia Group 首席营销官 Jochen Koedijk 与 OpenAI 对话,讲述 AI 如何推动 Expedia 的营销演进。
Hugging Face 与 Kaggle 推出集成,让 Hugging Face 模型可直接在 Kaggle 上被发现和使用。
Hugging Face 在 Inference Endpoints 上线新版 OpenAI Whisper 部署方案,基于 vLLM 实现,性能较此前版本最高提升 8 倍。
OpenAI 推出面向医疗场景的 AI 评测基准 HealthBench,用于在真实情境中评估模型表现。该基准由 250 多名医生参与构建,旨在为医疗领域模型性能与安全性提供统一标准。
Hugging Face 发文回顾过去一年视觉语言模型的关键变化,涵盖 any-to-any、推理、小尺寸、MoE 解码器、视觉语言动作模型等新趋势。
Hugging Face 的 LeRobot 项目正推动社区共建机器人数据集,目标是打造机器人领域的“ImageNet”。目前 Hub 上的 lerobot 数据集数量快速增长,贡献主要集中在 So100 和 Koch 机械臂,聚焦操作任务。文章将泛化视为数据问题,呼吁通过简化录制流程、降低硬件成本来扩大数据多样性。
OpenAI 扩大领导层,Fidji Simo 加入。Sam 当天早些时候向公司内部发布了相关消息。
OpenAI 就 AI 基础设施议题向美国能源部提交回应,主张基础设施决定命运,并阐述美国如何抓住这一机遇。
OpenAI 面向亚洲客户推出数据驻留功能,建立在其企业级数据隐私、安全与合规项目之上。该功能旨在为全球客户提供支持。
Mistral AI 发布 Mistral Medium 3,称其在基准测试中达到 Claude Sonnet 3.7 九成以上水平,定价为每百万 token 输入 0.4 美元、输出 2 美元。
推荐理由:官方给出 Mistral Medium 3 的定价与对标基准,读者可据此判断企业级模型的成本与部署门槛。
Mistral 发布 Le Chat Enterprise,一款由全新 Mistral Medium 3 模型驱动的企业级 AI 助手,提供企业搜索、Agent 构建器、自定义数据与工具连接器、文档库、自定义模型和混合部署等功能,全部功能将在未来两周内逐步上线。
推荐理由:Mistral 官方发布企业版助手,列出企业搜索、Agent 构建与混合部署等能力,可据此判断其企业落地路径。
圣安东尼奥马刺队正在使用定制 GPT 提升球迷互动、简化运营并推动各团队创新。这些定制 GPT 被用于球场内外的多个场景,以扩大球队的影响力。
Lowe's 与 OpenAI 合作构建了 Mylow 和 Mylow Companion 两款 AI 工具,为顾客和门店员工提供专家级家装项目支持。这些工具旨在让复杂的家居改造项目更易于规划、推进和完成。