研究人员开发了SEMAADB,这是一个新的数据集和基准,旨在评估大型语言模型生成相干SysML图集的能力。该数据集包含3000个工程上下文,每个上下文有五个相互关联的SysML视图,并包含一个包含100个上下文的人工验证基准测试集。对三个语言模型的评估显示,虽然语法修复已基本解决,但语义修复和在多个图之间保持一致性仍然是当前模型面临的重大挑战。 AI
影响 这项研究突显了LLM在生成语义一致且相干的多图系统方面的现有局限性,指明了未来发展的方向。
排序理由 该集群包含一篇研究论文,详细介绍了用于评估LLM在SysML图生成方面能力的新数据集和基准。[lever_c_demoted from research: ic=1 ai=1.0]
- alphaXiv
- array data structure
- Block definition diagram
- CatalyzeX Code Finder for Papers
- DagsHub
- finite-state machine
- Gotit.pub
- Hugging Face
- large language models
- ScienceCast
- SEMAADB
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →