All-in-one training for vision models (YOLO, ViTs, RT-DETR, DINOv3): pretraining, fine-tuning, distillation.

1.6K stars 97 forks 1.6K watchers Python GNU Affero General Public License v3.0
computer-vision contrastive-learning deep-learning depth-estimation dinov2 dinov3 distillation embeddings eomt object-detection pretrained-models python pytorch real-time rtdetrv2 self-supervised self-supervised-learning semantic-segmentation vision-transformer yolo
1 Open Issue Need Help Last updated: Jul 30, 2026

Open Issues Need Help

View All on GitHub
good first issue

All-in-one training for vision models (YOLO, ViTs, RT-DETR, DINOv3): pretraining, fine-tuning, distillation.

Python
#computer-vision#contrastive-learning#deep-learning#depth-estimation#dinov2#dinov3#distillation#embeddings#eomt#object-detection#pretrained-models#python#pytorch#real-time#rtdetrv2#self-supervised#self-supervised-learning#semantic-segmentation#vision-transformer#yolo