跳到正文

#arXiv

今日 1 条
今天10月2日周五
  1. Dongxi 东锡 NLP49

    arXiv 更新了面向所有投稿者的 rate limiting 政策,称此举是为公平分配审核时间并支持其员工、志愿者、读者与作者社区。推文作者认为,在 Vibe research 时代,只要有想法就大概率能产出成果,但判定成果的标准已落后于时代,新标准尚无答案。

    引用arXiv.org@arxiv

    arXiv has updated our policy on rate limiting for all submitters. This update was made to fairly distribute moderator time & support the arXiv community of staff, volunteers, readers & authors. Please read our announcement to learn more: https://blog.arxiv.org/2026/10/01/updated-rate-limit-policy/

9月29日周二
  1. Hugging Face Daily Papers33

    E-MoE:面向非因子化扩散语言模型的增强型混合专家架构

    E-MoE提出将反向生成过程构建为基于MoE骨干网络专家路由决策的离散共享隐变量上的因子化分布混合,在不增加活跃参数的前提下提升少步生成质量。在合成多模态基准、二值化MNIST和LM1B上,E-MoE均优于因子化基线模型,缓解了掩码扩散模型在少步场景下因位置因子化导致的样本质量限制。

  2. Hugging Face Daily Papers33

    CorrGRPO:面向多奖励学习的相关性归一化 GRPO

    CorrGRPO 提出将 GRPO 中成对奖励协方差归一化为皮尔逊相关系数,在不改变中心化总奖励的前提下,平衡不同尺度奖励对归一化的影响,避免大尺度奖励主导优势值计算。研究者在代码生成、工具调用和智能体安全三类任务上,使用 0.5B 至 8B 参数的模型进行对比,结果显示 CorrGRPO 在三项任务上均优于 GRPO 及其他变体。代码已开源。