AI 导读
HuggingFace 今日最热论文提出 Harness 框架,用共享结构化规格文档 S 串联设计者、执行者、验证者、修订者四个角色,实现 AI 生成论文图表。作者据此简化出一个 Skill:设计者生成图提示词、执行者用 Codex 调用 GPT-image-2 生图、验收者做审美评判,并整合抓取 Skill,只需提供 URL(含 X URL)即可生成配图。
正文
读了今天Huggingface最热论文,关于如何让AI生成论文图表的Harness框架。
框架会围绕一个共享的结构化规格文档 S。
① 设计者 D:根据 S 生成可执行的视觉方案
② 执行者 E:将方案渲染成图像(或代码)
③ 验证者 V:输出带有具体问题定位的诊断报告
④ 修订者 R:将诊断转化为结构化操作,直接修改 S 中的对应字段
参考并简化,写了一个Skill:
设计者(生图提示词)
执行者(Codex调用GPT-image-2生图)
验收者(审美评判,这个可能不靠谱)
另外整合了抓取Skill,只需要提供URL就能生成配图,哪怕是 X URL。
生成效果如下:
来源:@vista8 · x.com