Group DETR v2:基于编码器-解码器预训练的强目标检测器
计算机视觉与模式识别
2022-11-08 v1
摘要
我们提出了一种具有编码器-解码器预训练与微调的强目标检测器。我们的方法称为 Group DETR v2,构建于视觉 transformer 编码器 ViT-Huge~\cite{dosovitskiy2020image}、DETR 变体 DINO~\cite{zhang2022dino} 以及高效的 DETR 训练方法 Group DETR~\cite{chen2022group} 之上。训练过程包括在 ImageNet-1K 上对 ViT-Huge 编码器进行自监督预训练与微调、在 Object365 上对检测器进行预训练,以及最终在 COCO 上对其进行微调。Group DETR v2 在 COCO test-dev 上达到 mAP,并在 COCO 排行榜 https://paperswithcode.com/sota/object-detection-on-coco 上确立了新的 SOTA。
引用
@article{arxiv.2211.03594,
title = {Group DETR v2: Strong Object Detector with Encoder-Decoder Pretraining},
author = {Qiang Chen and Jian Wang and Chuchu Han and Shan Zhang and Zexian Li and Xiaokang Chen and Jiahui Chen and Xiaodi Wang and Shuming Han and Gang Zhang and Haocheng Feng and Kun Yao and Junyu Han and Errui Ding and Jingdong Wang},
journal= {arXiv preprint arXiv:2211.03594},
year = {2022}
}
备注
Tech report, 3 pages. We establishes a new SoTA (64.5 mAP) on the COCO test-dev