跳到正文
热点事件持续更新

提出ExploreNet用于扩散RL可学习探索

1 篇报道1 个报道来源3 小时前更新

先了解这件事

AI 综述

2026年10月9日,X 用户 Dongxi 东锡 NLP(@dongxi_nlp)发布消息,介绍了一项名为 ExploreNet 的工作,称其用于扩散强化学习(diffusion RL)中的可学习探索。据该消息,ExploreNet 学习以当前状态为条件的自适应探索分布,并以 rollout 的多样性作为奖励,从而在扩散 GRPO 中实现更快、更有针对性的学习。该消息同时给出英文标题“ExploreNet: Learning Where to Explore in Diffusion GRPO”,并附有“推荐阅读”的提示。目前关于该工作的公开信息仅来自这一条社交平台发布,尚无更多跟进报道披露其作者、发表渠道、实验设置或具体效果数据,因此事件仍处于提出与初步介绍阶段。

AI 根据报道生成 · 3 小时前更新

报道时间线

沿着报道,了解事件的不同侧面。

10月9日
  1. Dongxi 东锡 NLP
    ExploreNet:扩散GRPO的可学习探索

    推荐阅读! ExploreNet: Learning Where to Explore in Diffusion GRPO 我们推出 ExploreNet🔍,用于扩散RL中的可学习探索。 ExploreNet 学习以当前状态为条件的自适应探索分布,以 rollout 的多样性作为奖励。 ➡️ 在扩散 GRPO 中实现更快、更有针对性的学习。

本事件热度走势

可比范围当前
9
可比范围峰值
1010月9日 02:00
近 24 小时变化
–

趋势仅比较持续完整观测到的相同主体,范围可能小于当前热度统计。移动指针或点击图表查看每小时热度;键盘可用左右方向键切换。