基于知识图谱引导的三维视觉问答
毛爱华,陈思宇

3D visual question answering guided by knowledge graph
Aihua MAO,Siyu CHEN
表 1 不同方法在ScanQA带有对象的测试集上的评估指标结果对比
Tab.1 Comparison evaluation metrics for different methods on ScanQA test set with objects
方法EM@1/%EM@10/%BLEU-1/%BLEU-4/%ROUGE/%METEOR/%CIDEr
RandomImage+MCAN[1]22.3153.1126.6614.2631.2712.1360.37
VoteNet+MCAN[1]19.7150.7629.466.0830.9712.0758.23
scanRefer+MCAN(e2e) [1]20.5652.3527.857.4630.6811.9757.36
scanQA[1]23.4556.5131.5612.0434.3413.5567.29
3D-VisTA(scratch)[11]25.2055.2010.5035.5013.8068.60
Multi-CLIP[2]22.7631.0813.3133.8413.2865.81
本研究24.4756.1833.8513.5936.2614.4271.33
jin-Context-aware*[4]24.5855.9733.1511.2335.9714.1670.18
Multi-CLIP(pre-trained)*[2]24.0232.6312.6535.4613.9768.70
3D-VisTA*[11]27.0057.9016.0038.6015.2076.60
CLIP*[3]23.9232.7214.6435.1513.9469.53