跳到正文
热点事件持续更新

ExploreNet:扩散GRPO中的可学习探索机制

1 篇报道1 个报道来源1 小时前更新

先了解这件事

AI 综述

2026年10月9日,X平台账号“马东锡 NLP”发布推荐阅读信息,介绍了一项名为ExploreNet的工作,标题为“ExploreNet: Learning Where to Explore in Diffusion GRPO”。该信息将ExploreNet定位为扩散GRPO(Diffusion GRPO)中的可学习探索机制,即让模型学习在何处进行探索。目前可获得的报道仅此一条,未披露具体方法细节、实验结果或发表渠道,事件仍处于初步传播阶段。

AI 根据报道生成 · 51 分钟前更新

报道时间线

沿着报道,了解事件的不同侧面。

10月9日
  1. Dongxi 东锡 NLP (@dongxi_nlp) · X
    ExploreNet:扩散GRPO的可学习探索

    推荐阅读! ExploreNet: Learning Where to Explore in Diffusion GRPO

本事件热度走势

还没有足够的连续观测数据,暂不绘制趋势。