OpenAI 封禁朝鲜相关威胁行为者账号:AI 辅助入侵研究
OpenAI 封禁了可能与公开报道的朝鲜(DPRK)相关威胁行为者有关的账号,这些账号利用 AI 研究入侵工具、钓鱼、恶意软件及加密货币攻击目标。
OpenAI 封禁了可能与公开报道的朝鲜(DPRK)相关威胁行为者有关的账号,这些账号利用 AI 研究入侵工具、钓鱼、恶意软件及加密货币攻击目标。
OpenAI 封禁了一批与伊朗有关联的账号,这些账号利用 AI 生成与 IUVM 和 STORM-2035 影响力活动相关的文章及社交帖子。
OpenAI 封禁了一批可能被用于协助欺诈性就业计划的账号,该计划带有公开报道过的朝鲜相关 IT 工作者活动的特征。
OpenAI 封禁了一批疑似来自柬埔寨的账号,这些账号利用 AI 翻译消息,实施虚假评论招聘诈骗,要求受害者支付费用。
OpenAI 封禁了一批疑似来自柬埔寨的账号,这些账号利用 AI 翻译并生成恋爱与投资诈骗对话。此类"杀猪盘"骗局借助 AI 批量生成话术,OpenAI 已对相关账号采取封禁措施。
OpenAI 封禁了一批疑似中国来源的账号,这些账号利用 AI 生成英文社交帖子和西班牙语文章。相关行动被命名为“Sponsored Discontent”。
OpenAI 发布 o3-mini 系统卡,说明该模型的安全工作,涵盖安全评估、外部红队测试以及 Preparedness Framework 评测。
推荐理由:官方系统卡披露 o3-mini 的安全评估、外部红队与 Preparedness Framework 评测范围,可了解该模型的安全工作构成。
OpenAI 发布 o3-mini 模型,官方页面已上线,但正文内容抓取失败,暂无可确认的能力、参数或开放范围信息。
OpenAI 最新一代推理模型将供美国国家实验室的顶尖科学家使用,以推动科学突破。该合作旨在加强美国在 AI 领域的领导地位。
OpenAI 发布 Operator 系统卡,说明其基于既有安全框架采取的多层防护措施,包括针对提示词工程与越狱的模型和产品层缓解,以及隐私与安全保护。文档还介绍了外部红队测试、安全评估,以及持续完善这些防护的后续工作。
德国全球媒体、服务与教育公司 Bertelsmann 将把 OpenAI 的技术整合到其全球多个品牌中。Bertelsmann 总部位于德国,业务覆盖媒体、服务与教育领域。
OpenAI 提出通过增加推理时计算来提升模型的对抗鲁棒性,即让模型在生成回答时投入更多计算,以抵御对抗性攻击。该研究探讨了推理时计算与对抗鲁棒性之间的权衡关系。
OpenAI 及其战略合作伙伴公布 Stargate 基础设施计划,目标是构建 AGI 所需的基础设施。OpenAI 表示希望与数据中心建设产业链上的公司合作,覆盖电力、土地、施工到设备等环节。
OpenAI 宣布 Stargate 项目。原文未披露该项目的具体投资规模、合作方、建设地点或时间表等细节。
OpenAI 宣布与 Axios 达成合作,进一步扩大其在新闻行业的合作版图。目前已有代表数百家新闻编辑室和内容品牌的出版商,通过 OpenAI 的合作与资助计划采用 AI 工具,ChatGPT 用户也可获取来自领先可靠出版物的信息。
Adebayo Ogunlesi 加入 OpenAI 董事会。
OpenAI 发文解释其公司结构必须调整,以更好推进自身使命,方案是由营利性业务的成功来支持一个更强大的非营利组织。
OpenAI 发布面向 o1 模型的新对齐策略“审议式对齐”,直接教模型安全规范并让其对这些规范进行推理。该策略的核心是借助模型的推理能力来提升安全性。
Artificial Analysis 发布 Big Bench Audio,一个从 Big Bench Hard 改编的音频推理评测数据集,含 1000 道音频题,覆盖 Formal Fallacies、Navigate、Object Counting、Web of Lies 四类各 250 题。
OpenAI 发布 o1 模型,并同步带来 Realtime API 改进和一种新的微调方法等面向开发者的更新。官方仅给出上述概要,未披露具体参数、价格或可用范围。
推荐理由:OpenAI 官方一次性公布 o1 模型与开发者工具更新,可据此了解其面向开发者的能力布局。
OpenAI 回应马斯克最新法律诉讼,称这是其不到一年内的第四次尝试。OpenAI 表示,马斯克 2017 年不仅想要、而且实际创建了 OpenAI 拟议的营利性新结构。
OpenAI 的视频生成模型 Sora 已在 sora.com 开放使用,支持生成最高 1080p 分辨率、最长 20 秒的视频,并提供宽屏、竖屏和方形画幅。用户可导入自有素材进行延展、重混和融合,也可直接由文本生成全新内容。
推荐理由:OpenAI 官方公布 Sora 的开放入口与分辨率、时长、画幅等关键规格,读者可据此判断可用范围。
电影制作双人组 Vallée Duhamel 解释了 Sora 如何帮助他们构建新的世界。
OpenAI 发布 Sora 系统卡,介绍这是其视频生成模型,可接收文本、图像和视频输入并生成新视频。Sora 基于 DALL-E 和 GPT 系列模型的经验构建,定位是为用户提供更丰富的叙事与创意表达工具。
推荐理由:OpenAI 官方系统卡披露 Sora 的输入输出形态与模型来源,可据此了解其视频生成能力边界。
跨学科艺术家 Minne Atairu 讲述 Sora 如何帮助她实现自己的创作构想。
电影制作人 Lyndon Barrois 分享了如何将 Sora 用作叙事工具来创造新世界。
OpenAI 宣布推出 ChatGPT Pro,官方称此举旨在扩大前沿 AI 的使用范围。目前公开信息仅有这一句说明,具体功能、定价与可用范围尚未披露。
OpenAI 发布 o1 系统卡,说明在发布 o1 和 o1-mini 之前开展的安全工作,包括外部红队测试以及依据 Preparedness Framework 进行的前沿风险评估。
推荐理由:系统卡披露了 o1 与 o1-mini 发布前的外部红队测试和前沿风险评估流程,可了解其安全评估框架。
OpenAI 与全球专业媒体平台 Future 宣布战略合作,将 Future 旗下 200 多家媒体品牌的内容带给 OpenAI 用户。
Morgan Stanley 正借助 AI 评估(AI evals)推动金融服务领域的变革。该机构将 AI 评估用于塑造金融服务的未来方向。
OpenAI 发布文章阐述如何结合人类与 AI 推进红队测试。原文未披露具体模型版本、参数规模或评测数据。
OpenAI 发布案例,展示如何用 GPT-4o 的视觉微调能力构建更智能的地图。
BAAI 推出 FlagEval Debate 平台,让大模型以辩论形式正面对抗,目前支持中文、英文、阿拉伯文和韩文四种语言。平台采用专家评审与用户投票的双重评估机制,并提供开发者自定义参数功能,以解决静态评测和 Chatbot Arena 类平台缺乏区分度、模型孤立生成及投票偏差等问题。2024 年 Q3 的实验显示,当前多数模型已具备参与辩论的能力。
Rox 宣布"all in"OpenAI,将其商业经验与深厚的大语言模型专业能力同 OpenAI 的模型结合,目标是让每一位销售都成为排名前 1% 的销售。
Hugging Face 博客发布 Judge Arena,一个让用户对两个 LLM 裁判的评分和理由进行投票对比的平台,投票结果汇总为 Elo 排行榜并每小时更新。
OpenAI 在法国开设了其在欧洲大陆的首个办公室。这是 OpenAI 在欧洲大陆的第一处办公据点,此前其欧洲布局仅涉及其他地区。
雅诗兰黛集团借助 ChatGPT Enterprise 和自定义 GPT 分析消费者数据、挖掘洞察,以加速美妆创新。该案例展示了企业级 ChatGPT 在数据驱动决策与产品研发环节的具体用法。
OpenAI 发布 ChatGPT 搜索功能,可快速给出带相关网络来源链接的及时回答。
推荐理由:OpenAI 官方发布 ChatGPT 搜索功能,读者可了解其以链接形式给出实时网络来源的定位。
Promega 自上而下在全公司推广 ChatGPT,用于加速生产、销售和营销环节。该公司将 ChatGPT 引入制造、销售与营销等业务,以提升整体运营效率。
OpenAI 发布名为 SimpleQA 的事实性基准,用于衡量语言模型回答简短事实型问题的能力。该基准聚焦短小、寻求事实的提问场景,评估模型的事实准确性。