北大&Google联手推出"发表级"科研论文插图制作AI agent!
众所周知,GPT类LLMs爆火后,简单的科研图制作变得很简单,但是,要制作publication-ready级别的图,难度依然存在,比如下面这几张之前复现过的Nature图,调参数调到手软,
PaperBanana来了
近日,北大联合Google Cloud AI Research推出PaperBanana,是一款科研论文插图制作智能体,号称,可生成publication-ready科研论文插图,
PaperBanana由5大agent协作完成,
1.检索智能体(Retriever Agent):定位相关参考案例,为后续环节提供指导。 2.规划智能体(Planner Agent):作为核心决策单元,将任务背景转化为具体图文描述。 3.风格智能体(Stylist Agent):融合参考案例的设计规范,确保成果符合学术美学标准。 4.可视化智能体(Visualizer Agent):将图文描述转化为可视化输出或可执行代码。 5.审查智能体(Critic Agent):对照原始资料审核生成结果,提出改进建议。
PaperBanana评估
团队制作了基准测试集PaperBananaBench,从Faithfulness、Conciseness等4个维度评估PaperBanana,结果显示,4个维度上都显著优于直接使用生图模型的Vanilla Settings。
不一一展示其它测试!
下面看看PaperBanana的一些使用案例,
PaperBanana使用案例,
生成统计图
润色图
生成流程图
PaperBanana犯错
团队发现PaperBanana生成流程图时会出现connection errors,
初步分析表明,审阅模型通常无法识别这类连接性问题,这表明相关错误可能源自基础模型固有的感知局限性。
另外,https://github.com/dwzhu-pku/PaperBanana显示代码和数据将在1~2周内更新!
拭目以待吧,希望真如文章所言般好用!
(加入学习,备注:299)