基于知识图谱引导的三维视觉问答
毛爱华,陈思宇

3D visual question answering guided by knowledge graph
Aihua MAO,Siyu CHEN
表 2 不同方法在ScanQA不带对象的测试集上的评估指标结果对比
Tab.2 Comparison evaluation metrics for different methods on ScanQA test set without objects
方法EM@1/%EM@10/%BLEU-1/%BLEU-4/%ROUGE/%METEOR/%CIDEr
RandomImage+MCAN[1]20.8251.2326.299.6629.2311.5455.64
VoteNet+MCAN[1]18.1548.5629.637.1029.1211.6853.34
scanRefer+MCAN(e2e)[1]19.0449.7026.987.8228.6111.3853.41
scanQA[1]20.9054.1130.6810.7531.0912.5960.24
3D-VisTA(scratch) [11]20.4051.508.7029.6011.6055.70
Multi-CLIP[2]20.7131.2211.4931.2512.8060.75
本研究21.1054.4933.2811.9432.8413.3063.41
jin-Context-aware*[4]21.5653.8931.4815.8431.7913.1363.40
Multi-CLIP(pre-trained)*[2]21.4832.6912.8732.6113.3663.20
3D-VisTA*[11]23.0053.5011.9032.8012.9062.60
CLIP*[3]21.3732.7011.7332.4113.2862.83