研究人员推出了AesCanvas,这是一个新的数据集和基准,旨在评估多模态大语言模型(MLLMs)提供美学评论和评估图像情境适宜性的能力。该套件包括CritiqueCanvas,拥有超过50万个指令-响应对,以及ContextCanvas,用于评估现实世界场景中的美学适宜性。评估显示,虽然通用MLLMs在情境判断方面表现良好,但美学专家在这方面却落后,这表明美学专业化并不一定能转化为对多样化情境下适宜性的理解。 AI
影响 为评估AI对图像美学和情境适宜性的细微理解建立了新的基准。
排序理由 该项目描述了一个用于评估AI模型的新数据集和基准,发布在arXiv上。[lever_c_demoted from research: ic=1 ai=1.0]
- AesCanvas
- alphaXiv
- arXiv
- CatalyzeX
- ContextCanvas
- CritiqueCanvas
- DagsHub
- Gotit.pub
- Hugging Face
- MLLMs
- ScienceCast
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →