研究人员推出了BIM-Edit,这是一个旨在评估大型语言模型(LLM)使用行业基础类(IFC)格式编辑建筑信息模型(BIM)能力的新基准测试。该基准测试包含跨越各种建筑模型的324项编辑任务,重点关注几何精度、语义有效性和拓扑一致性。目前的LLM显示出显著的局限性,表现最好的模型得分仅为49.5%,没有一个模型能完全解决超过3.4%的任务,这凸显了它们在处理结构化工程设计工作流程方面的能力差距。 AI
影响 强调了当前LLM在结构化工程设计任务中的显著局限性,表明在语义和拓扑理解方面需要进一步发展。
排序理由 该集群包含一篇介绍用于评估LLM的新基准测试的学术论文。
- BIM-Edit
- Building Information Models
- computer-aided design
- IFC
- Large language models
- Tobias Sesterhenn
- LLMs
AI 生成摘要 · Google Gemini · 来自 2 个来源。 我们如何撰写摘要 →