一个名为稀疏表面理解框架(SSUF)的新框架已被开发出来,用于从不完整的视觉数据中改进材料识别。SSUF同时适配了四个预训练架构——ConvAE、ViT、Swin Transformer和MAE——用于表面重建和材料分类。在仅使用10%可见图像数据的Touch-and-Go数据集上进行的实验表明,Swin Transformer在分类准确率上达到了最高的89.21%,而MAE在重建方面表现出色。ViT提供了均衡的性能,所有模型都展示了实时推理能力。 AI
影响 这项研究通过在视觉输入严重受限的情况下实现材料识别,有望改善机器人感知和环境理解。
排序理由 该集群包含一篇详细介绍新框架和计算机视觉任务实验结果的研究论文。[lever_c_demoted from research: ic=1 ai=1.0]
- arXiv
- ConvAE
- Convolutional autoencoder and conditional random fields hybrid for predicting spatial-temporal chaos
- Mae
- Masked Autoencoder
- Sparse Surface Understanding Framework
- Swin Transformer
- Touch-and-Go dataset
- vision transformer
- Vít
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →