基于注意力增强的跨模态多层融合网络的物体位姿估计
杨恒,王韶涵,董青,赵科渊,杨明亮

Object pose estimation based on attention enhancement cross-modal multilayer fusion network
Heng YANG,Shaohan WANG,Qing DONG,Keyuan ZHAO,Mingliang YANG
表 3 YCB-Video数据集上的效率与精度消融实验
Tab.3 Ablation study on efficiency and accuracy on YCB-Video dataset
模型配置Np/106FLOPs/109tin/msAUC/%ADD(-S)
分数/%
Baseline78.035.916.483.590.1
+Multi-scale91.046.221.585.892.5
+AFE(Attention)81.037.517.688.995.3
完整模型(本文方法)94.047.922.393.797.1