PersonTTS:通过摊销式智能体策略发现实现个性化测试时扩展
From Pareto to Preference: Personalized Test-Time Scaling via Amortized Agentic Policy Discovery
阅读原文
本站未展示全文,请前往来源网站阅读。
AI 导读
针对测试时扩展(TTS)现有方法仅单独优化准确率-成本或准确率-延迟帕累托前沿的问题,研究者提出 PersonTTS,一个摊销式智能体策略发现框架,通过需求匹配的控制器初始化和源蒸馏过程指导复用先前搜索经验,为不同用户画像发现最大化多维需求联合满足率的可执行控制器。
来源:Hugging Face Daily Papers · arxiv.org