9月3日
10:09
10:09官方账号arXiv cs.AI@Chuer Chen, Zichen Wang, Yi He, Zhengxi Yu, Nan Cao
精选73°
研究团队推出VMetaphor-Bench,这是首个评估文本到图像模型视觉隐喻生成的基准,包含1500个真实创意图像隐喻,分为3个级别和10个类别。研究采用混合评估框架,通过MLLM-as-judge范式,包含9594道多选题和3个感知维度的评分。对11个代表性T2I模型的评估显示,即使是专有模型在组合结构和跨域映射方面也存在困难。
推荐理由:研究人员发布了首个视觉隐喻生成基准,测试了11个模型,发现即使是最好的模型在隐喻表达方面也有明显不足。