面向单步逆合成的化学合理性感知大语言模型 C3LM 训练
Training Chemical Plausibility-Aware Large Language Models for Single-Step Retrosynthesis
阅读原文
本站未展示全文,请前往来源网站阅读。
AI 导读
研究者提出 Top-K prompting 训练与推理范式,并构建约 4560 万条已验证反应的 CREED-CCV-2+USPTO-XL 数据集,训练出化学约束一致性语言模型 C3LM。该模型结合微调与基于 ChemCensor 及新颖性导向的奖励,在 OOD URSA-expert-2026 基准上取得 SOTA。反应唯一性分析显示 LLM 与传统模型探索互补的反应空间,支持集成式逆合成系统。
来源:Hugging Face Daily Papers · arxiv.org