70 epochs head only pretraining no weight decay 0.0004 step learning rate scheduler step_size 20, factor 0.2 (starting from epoch 70) 200 epochs train loss 0.85192 validation loss 3.39859 Train set Average Precision (AP) @[ IoU=0.50:0.95 | area= all | maxDets=100 ] = 0.143 Average Precision (AP) @[ IoU=0.50 | area= all | maxDets=100 ] = 0.186 Average Precision (AP) @[ IoU=0.75 | area= all | maxDets=100 ] = 0.163 Average Precision (AP) @[ IoU=0.50:0.95 | area= small | maxDets=100 ] = 0.084 Average Precision (AP) @[ IoU=0.50:0.95 | area=medium | maxDets=100 ] = 0.204 Average Precision (AP) @[ IoU=0.50:0.95 | area= large | maxDets=100 ] = 0.192 Average Recall (AR) @[ IoU=0.50:0.95 | area= all | maxDets= 1 ] = 0.452 Average Recall (AR) @[ IoU=0.50:0.95 | area= all | maxDets= 10 ] = 0.622 Average Recall (AR) @[ IoU=0.50:0.95 | area= all | maxDets=100 ] = 0.753 Average Recall (AR) @[ IoU=0.50:0.95 | area= small | maxDets=100 ] = 0.276 Average Recall (AR) @[ IoU=0.50:0.95 | area=medium | maxDets=100 ] = 0.642 Average Recall (AR) @[ IoU=0.50:0.95 | area= large | maxDets=100 ] = 0.868