Hugging Face 将重新设计 Transformers 文档
Hugging Face 宣布将重新设计 Transformers 文档,原因是现有文档内容零散、导航困难且过时。新文档将面向构建 AI 产品的开发者,采用代码优先和解决方案导向的方式,并用更灵活的结构替代 Diátaxis 的刚性框架,让内容自然生长与整合。
Hugging Face 宣布将重新设计 Transformers 文档,原因是现有文档内容零散、导航困难且过时。新文档将面向构建 AI 产品的开发者,采用代码优先和解决方案导向的方式,并用更灵活的结构替代 Diátaxis 的刚性框架,让内容自然生长与整合。
Hugging Face Embedding Container for Amazon SageMaker 正式可用(GA),AWS 客户可借此在 SageMaker 上部署嵌入向量模型,构建 RAG 等生成式 AI 应用。
Artificial Analysis 发布文生图排行榜与 Image Arena,基于超 45,000 次人类图像偏好投票计算 ELO 分数,覆盖 Midjourney、DALL·E、Stable Diffusion、Playground 等主流开源与闭源模型。
OpenAI 利用可扩展的稀疏自编码器新技术,自动在 GPT-4 的计算过程中识别出 1600 万个模式。该方法旨在从模型内部提取可理解的概念。
Mistral AI 在 la Plateforme 上线模型定制功能,提供三条路径:开源微调代码库 mistral-finetune、平台上的无服务器微调服务,以及面向特定客户的定制训练服务。
推荐理由:Mistral 同时给出开源微调代码库与托管微调服务,读者可据此判断自建与托管两条路径的成本差异。
Mistral AI 于 6 月 5 日至 30 日举办线上微调黑客松,参赛者需使用其全新微调 API 提交原创项目。前三名各获 2500 欧元 Mistral API 额度,入选者可申请 100 美元免费额度,须在 6 月 10 日前提交表单。评审按影响力、技术实现、创意和展示各占 25% 打分。
Hugging Face 联合 Cubzh 与 Gigax 发布 NPC-Playground,一个可在浏览器中直接体验的 3D 演示,让玩家与 LLM 驱动的 NPC 互动,并用几行 Lua 脚本教它们新技能。
Hugging Face 将辅助生成(Assisted Generation)适配并优化到 Intel Gaudi 处理器,现已集成进 Optimum Habana。该方法基于 Speculative Sampling,用草稿模型生成 K 个 token 再由目标模型评估,大型 Transformer 模型通常可获得约 2x 加速,且采样质量与自回归采样相当。
Hugging Face 称本周早些时候发现其 Spaces 平台遭未授权访问,怀疑部分 Spaces secrets 可能被读取,已撤销其中涉及的若干 HF token 并邮件通知相关用户。
OpenAI 已终止与隐蔽影响力行动相关的账号,并称这些行动未借助其服务获得显著受众增长。
OpenAI 推出面向大学的平价产品 OpenAI for Education,旨在让高校负责任地将 AI 引入校园。该产品定位为可负担的教育方案,帮助大学在教学中规范使用 AI。
OpenAI 推出面向非营利组织的 OpenAI for Nonprofits 计划,为 ChatGPT Team 和 Enterprise 提供折扣价格,以提升其工具对非营利机构的可及性。
MavenAGI 推出基于 GPT-4 的 AI 客服智能体,Tripadvisor、Clickup 和 Rho 等公司已在使用,以节省时间并更好地服务客户。
Mistral 发布首款代码模型 Codestral,22B 开放权重,支持 80+ 编程语言,上下文窗口 32k,采用 fill-in-the-middle 机制补全代码和写测试。
推荐理由:Mistral 首款代码模型给出 22B 参数、32k 上下文与 80+ 语言支持,并附免费 API 与主流 IDE 集成入口。
Mistral AI 推出非生产许可证 MNPL,允许开发者将自家技术用于非商业用途并支持研究工作,商业使用则需另循公平可持续的方式。Codestral 于同日在该许可证下发布,Mistral 表示仍会继续以 Apache 2.0 发布模型和代码,并逐步整合 Apache 2.0 与 MNPL 两条产品线。
推荐理由:Mistral 推出非生产许可证,读者可据此理解开源模型厂商在开放与商业化之间的授权取舍。
The Atlantic 宣布与 OpenAI 达成战略内容与产品合作,成为 OpenAI 体系内的高端新闻来源。The Atlantic 的文章将可在 ChatGPT 等 OpenAI 产品中被发现,作为合作方,The Atlantic 还将参与塑造未来实时发现产品中新闻的呈现方式。
OpenAI 与 Vox Media 达成一项多层面合作协议,Vox Media 的内容将用于增强 ChatGPT 的输出。Vox Media 还将基于 OpenAI 的技术开发产品,以更好地服务其受众和广告商。
Hugging Face 发布博客介绍 Text Generation Inference(TGI)配套的 TGI Benchmarking 工具,可同时测量吞吐量与延迟,帮助用户按需调优 LLM 部署。
Hugging Face 发布博客,介绍如何用 Sentence Transformers 库微调嵌入向量模型,也可从零训练新模型。训练涉及数据集、损失函数、训练参数、评估器和 Trainer 五大组件,数据可来自 Hugging Face Hub 或本地 CSV、JSON、Parquet、Arrow、SQL 格式。
Meta 发布 CyberSecEval 2,用于评估 LLM 生成不安全代码、协助网络攻击、被提示词注入操纵以及滥用代码解释器的风险。相比 2023 年 12 月的首版,LLM 协助网络攻击的平均合规率从 52% 降至 28%。测试还显示提示词注入仍是未解决问题,LLM 目前难以可靠完成端到端漏洞利用。
TII 发布第二代 Falcon 2 模型,包括 11B 基座语言模型和具备图像理解能力的 11B VLM,训练数据超过 5000B tokens,覆盖英语及另外十种语言。
推荐理由:原文给出 Falcon 2 11B 的架构、训练数据与评测对比,可据此判断小尺寸开源模型与多模态路线的取舍。
OpenAI 与 News Corp 宣布建立多年全球合作伙伴关系,将把 News Corp 的优质新闻内容引入 OpenAI 的生成式 AI 产品与平台。
Hugging Face 宣布用户可直接将 Hub 上超 10 万个公开模型部署到 AWS Inferentia2,新增 14 种模型架构和 6 类机器学习任务支持,并可通过 Amazon SageMaker 或 Inference Endpoints 完成部署。
OpenAI 阐述了其安全实践的核心立场:通用人工智能有潜力惠及生活方方面面,因此必须以负责任的方式开发和部署。
Hugging Face Spaces 上线 Dev Mode,支持一键从 VS Code 或 SSH 直连 Space 编辑代码,无需再用 git 推送本地改动。该功能目前处于 beta 阶段,仅向 PRO 订阅用户开放,编辑后可直接在 Space 内点击 Refresh 测试,满意后再 commit 并 merge 保存。
Hugging Face 与 Dell 联合推出 Dell Enterprise Hub,可在 Dell 平台上本地训练和部署开源模型,将数周的工程工作缩短至几分钟。
Hugging Face 与微软在 Microsoft Build 上宣布深化战略合作,将 Llama 3、Mistral 7B、Command R Plus、Qwen 1.5 110B 等热门开源大模型加入 Azure 模型库的 Hugging Face Collection,支持从 Azure AI Studio 一键部署。
Hugging Face 与 AMD 合作,为 AMD Instinct MI300 GPU 在 Hugging Face 平台提供一等公民级集成,用户无需修改代码即可通过 transformers 和 text-generation-inference 在 Azure ND MI300x V5 虚拟机上部署模型。
OpenAI 与业内顶尖选角及导演专业人士合作,从 400 多份投稿中筛选,最终为 ChatGPT 选定 5 种声音。
ChatGPT 的数据分析功能获得升级,用户现在可以与表格和图表进行交互,并直接从 Google Drive 和 Microsoft OneDrive 添加文件。
OpenAI 与 Reddit 达成合作,将 Reddit 的独特内容引入 ChatGPT 及 OpenAI 旗下产品。
Canva 推出 AI 驱动的 Magic Studio,为其月活超 1.75 亿的视觉传播平台加入 AI 创作能力。该平台支持制作演示文稿、视频、文档、网站和社交媒体图形,借助易用界面、丰富素材库和提效工具,让缺乏设计训练的知识工作者也能创作出视觉出色的内容。
Hugging Face 在 Transformers 中上线 KV Cache 量化功能,通过降低 KV 缓存精度减少长上下文生成的内存占用,int4 精度下质量与 fp16 接近,int2 则出现明显下降。
OpenAI 宣布 Ilya Sutskever 将离开公司,Jakub Pachocki 被任命为首席科学家。
Google 发布视觉语言模型家族 PaliGemma,由 SigLIP-So400m 图像编码器和 Gemma-2B 文本解码器组成,可输入图像与文本并输出文本。
推荐理由:Google 开源视觉语言模型 PaliGemma 的完整发布说明,含架构、三种 checkpoint 与微调路径,便于判断适用场景。
Hugging Face 与 LangChain 联合推出合作包 langchain_huggingface,这是一个由双方共同维护的 Python 包,旨在将 Hugging Face 最新能力更快带入 LangChain 生态。
Hugging Face 发布 Open Arabic LLM Leaderboard(OALL),用于评估和比较阿拉伯语大语言模型性能,服务全球超 3.8 亿阿拉伯语使用者。
OpenAI 宣布推出新旗舰模型 GPT-4 Omni(GPT-4o),可在音频、视觉和文本之间进行实时推理。
推荐理由:OpenAI 官方发布新旗舰模型,读者可据此了解其在音频、视觉与文本上的实时推理定位。
OpenAI 发布最新旗舰模型 GPT-4o,同时把更多能力开放给 ChatGPT 免费用户。官方称此次发布包含新模型以及面向免费用户的功能扩展,具体能力与开放范围尚未在摘要中展开。
推荐理由:OpenAI 发布新旗舰模型 GPT-4o,并首次把更多能力开放给 ChatGPT 免费用户。
OpenAI 发布 GPT-4o,并在 ChatGPT 中向免费用户开放更多能力。官方称此次更新同时涉及新模型与免费层的能力范围。
推荐理由:OpenAI 官方发布 GPT-4o,并说明 ChatGPT 免费层将获得更多能力,可据此了解其模型与免费策略的同步变化。