实体
BenchCAD
BenchCAD
PulseAugur coverage of BenchCAD — every cluster mentioning BenchCAD across labs, papers, and developer communities, ranked by signal.
总计 · 30天
3
90 天内 3
发布 · 30天
0
90 天内 0
论文 · 30天
2
90 天内 2
层级分布 · 90 天
主题
情绪 · 30 天
1 天有情绪数据
最近 · 第 1/1 页 · 共 3 条
-
CADFather系统使用协调工具自主重建CAD模型
研究人员开发了CADFather,一个自主代理系统,旨在从3D网格重建可编辑的CAD模型。该系统协调各种工具,包括视觉语言助手和数值优化,来提出和改进CAD操作。CADFather无需额外训练即可运行,并在多个基准上进行了评估,评估了重建质量和计算成本。
-
GPT-6 Astra 基准测试显示超越 Fable 5.1,用户期待 OpenAI 的进步
用户正在讨论即将推出的 GPT-6 Astra 模型,早期基准测试表明其性能优于 Fable 5.1 和 GPT Sol。GPT-6 Astra 在包括 ARC-AGI-3 和 SRE-Bench 在内的各种基准测试中得分很高,并有望成为 OpenAI 的重大进步。虽然 Fable 5.1 因其高级规划和写作能力而受到赞扬,但用户预计 Astra 将代表一个巨大的飞跃。
-
新的基准测试评估AI的CAD程序生成能力
发布了两个新的基准测试,CADBench和BenchCAD,用于评估AI从各种输入生成计算机辅助设计(CAD)程序的能力。这些基准测试旨在标准化多模态AI系统在从图像或3D模型重建可编辑CAD程序等任务中的评估。早期评估表明,虽然专用模型在网格到CAD任务上表现更好,但目前的通用视觉语言模型在复杂的几何细节和工业设计参数方面存在困难,这表明它们在工业准备方面存在差距。