研究人员推出了 PLCWorld,这是一个旨在评估大型语言模型 (LLM) 在为可编程逻辑控制器 (PLC) 生成程序方面的性能的新基准测试。该基准测试包含 100 个合成任务和 473 个任务条件对,涵盖运动控制和物料搬运,重点评估闭环工厂仿真中的任务成功率和安全违规情况。初步评估显示,GPT-5.5 在简单案例上的任务成功率为 82.70%,但在困难案例上的成功率下降到 25.10%,凸显了 LLM 在复杂工业控制场景中面临的挑战。 AI
影响 该基准测试有望加速 LLM 在工业自动化和控制系统中的开发和验证。
排序理由 该条目描述了在 arXiv 上发布的新基准测试和研究论文。[lever_c_demoted from research: ic=1 ai=1.0]
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →