GC ViT - Object Detection

July 21, 2023 ยท View on GitHub

This repository is the official PyTorch implementation of Global Context Vision Transformers for object detection using MS COCO dataset.

Requirements

The dependencies can be installed by running:

pip install -r requirements.txt

Benchmarks

The expected performance of models that use GC ViT as a backbone is listed below:

BackboneHead#Params(M)FLOPs(G)mAPMask mAP
GC ViT-TMask R-CNN4829147.943.2
GC ViT-TCascade Mask R-CNN8577051.644.6
GC ViT-SCascade Mask R-CNN10886652.445.4
GC ViT-BCascade Mask R-CNN146101852.945.8