跳到正文
3月10日周二
3月9日周一
3月6日周五
3月5日周四
  1. OpenAI News87

    OpenAI 发布 GPT-5.4 前沿模型

    OpenAI 发布 GPT-5.4,称其为面向专业工作能力最强且高效的前沿模型,具备 SOTA 编码、计算机使用、工具搜索能力和 1M token 上下文窗口。

    推荐理由:OpenAI 官方公布 GPT-5.4 的定位与能力方向,可据此了解其面向专业工作的能力边界。

3月4日周三
3月3日周二
2月28日周六
  1. OpenAI News62

    OpenAI 公布与美国国防部合同的细节

    OpenAI 公布其与美国国防部(Department of War)合同的细节,说明其中的安全红线、法律保护以及 AI 系统在涉密环境中的部署方式。材料仅提供摘要,未披露合同金额、期限或具体部署系统。

    推荐理由:OpenAI 官方披露与国防部门合同的边界条款,可了解其安全红线与法律保护如何界定。

2月27日周五
  1. OpenAI News78

    OpenAI 宣布 1100 亿美元新融资,投前估值 7300 亿美元

    OpenAI 宣布获得 1100 亿美元新投资,投前估值 7300 亿美元。其中软银出资 300 亿美元,NVIDIA 出资 300 亿美元,Amazon 出资 500 亿美元。

    推荐理由:OpenAI 公布 1100 亿美元新融资与 7300 亿美元投前估值,并列出三家出资方,可据此观察其资本结构与算力合作走向。

2月26日周四
2月25日周三
2月24日周二
2月23日周一
  1. OpenAI News60

    OpenAI 解释为何不再评测 SWE-bench Verified

    OpenAI 宣布不再使用 SWE-bench Verified 评测,理由是这一基准正日益受到污染,无法准确衡量前沿编码能力。其分析指出该基准存在测试缺陷和训练数据泄漏问题,并建议改用 SWE-bench Pro。

    推荐理由:OpenAI 说明 SWE-bench Verified 存在污染与测试缺陷,并给出替代基准建议,可供关注编码评测的人参考。

2月20日周五
2月19日周四
2月18日周三
2月13日周五
  1. OpenAI News62

    GPT-5.2 在理论物理中推导出新结果

    OpenAI 发布的一篇新预印本显示,GPT-5.2 为胶子振幅提出了一个新公式,随后由 OpenAI 与学术合作者完成形式化证明与验证。

    推荐理由:材料给出 GPT-5.2 在理论物理中提出新公式并被形式化证明的案例,可观察模型在科研推理上的边界。

  2. OpenAI News62

    OpenAI 在 ChatGPT 中推出 Lockdown Mode 与 Elevated Risk 标签

    OpenAI 在 ChatGPT 中推出 Lockdown Mode 和 Elevated Risk 标签,帮助组织防御提示词注入和 AI 驱动的数据外泄。两项功能面向企业安全场景,具体能力与开放范围原文未进一步说明。

    推荐理由:OpenAI 为 ChatGPT 增加 Lockdown Mode 与 Elevated Risk 标签,读者可了解企业防御提示词注入的新手段。

2月12日周四
  1. OpenAI News62

    OpenAI 发布 GPT-5.3-Codex-Spark 实时编码模型

    OpenAI 发布 GPT-5.3-Codex-Spark,称其为首个实时编码模型,生成速度提升 15 倍,支持 128k 上下文。该模型目前面向 ChatGPT Pro 用户开放研究预览。

    推荐理由:OpenAI 发布首个实时编码模型,给出 15 倍生成速度与 128k 上下文,可据此判断实时编码场景的可用性。

2月11日周三