跳到正文
Hugging Face Daily Papers·· 1 天前AI 评分40

PersonTTS:通过摊销式智能体策略发现实现个性化测试时扩展

From Pareto to Preference: Personalized Test-Time Scaling via Amortized Agentic Policy Discovery

阅读原文

本站未展示全文,请前往来源网站阅读。

AI 导读

针对测试时扩展(TTS)现有方法仅单独优化准确率-成本或准确率-延迟帕累托前沿的问题,研究者提出 PersonTTS,一个摊销式智能体策略发现框架,通过需求匹配的控制器初始化和源蒸馏过程指导复用先前搜索经验,为不同用户画像发现最大化多维需求联合满足率的可执行控制器。

来源:Hugging Face Daily Papers · arxiv.org