39 тысяч подписчиков
32 видео
PR-330: How To Train Your ViT? Data, Augmentation, and Regularization in Vision Transformers
PR-355: Masked Autoencoders Are Scalable Vision Learners
PR-258: From ImageNet to Image Classification: Contextualizing Progress on Benchmarks
PR-120: ShuffleNet V2: Practical Guidelines for Efficient CNN Architecture Design
PR-377: Scaling Up Your Kernels to 31x31: Revisiting Large Kernel Design in CNNs
PR-044: MobileNet
PR-012: Faster R-CNN : Towards Real-Time Object Detection with Region Proposal Networks