ST-GCN is the first GCN-based method for the task of skeleton-based action recognition. In this video, I explain how it works. Paper link: https://arxiv.org/abs/1801.07455 Icon made by Freepik from flaticon.com
Devanagari Calligraphy Tutorial | 5th Alphabet by Artkibarsaat
Fill down sequence numbers skip hidden rows in Excel with Kutools for Excel
Miscrits: The Return (2025)
[120712] 소녀시대 Yeosu Expo - Run Devil Run by Chunyoon
"Аҡйондоҙ" халыҡ бейеүҙәре ансамбле - "Башҡорт егеттәре" бейеүе
00:00:00
Among Us Death Animation 2(Animated Version)!
Kalogeras Sisters (TRY TO) PLAY TENNIS
This is the Stihl BR800 C-E Magnum
Autoregressive Image Generation without Vector Quantization
Diffusion Models (DDPM & DDIM) - Easily explained!
GLIGEN (CVPR2023): Open-Set Grounded Text-to-Image Generation
The Entropy Enigma: Success and Failure of Entropy Minimization
Tent: Fully Test-time Adaptation by Entropy Minimization
VPD (ICCV2023): Unleashing Text-to-Image Diffusion Models for Visual Perception
TokenHMR (CVPR2024): Advancing Human Mesh Recovery witha Tokenized Pose Representation
SHViT (CVPR2024): Single-Head Vision Transformer with Memory Efficient Macro Design
InstaFlow: One Step is Enough for High-Quality Diffusion-Based Text-to-Image Generation
FastV: An Image is Worth 1/2 Tokens After Layer 2
GaLore: Memory-Efficient LLM Training by Gradient Low-Rank Projection
PoseGPT (ChatPose): Chatting about 3D Human Pose
MotionAGFormer (WACV2024): Enhancing 3D Human Pose Estimation with a Transformer-GCNFormer Network
HD-GCN (ICCV2023): Skeleton-Based Action Recognition
ST-GCN: Spatial Temporal Graph Convolutional Networks for Skeleton-Based Action Recognition
Graph Convolutional Networks (GCN): From CNN point of view
DINO: Self-Supervised Vision Transformers
MoCo (+ v2): Unsupervised learning in computer vision
ViTPose: 2D Human Pose Estimation
TrackFormer: Multi-Object Tracking with Transformers
MetaFormer is Actually What You Need for Vision
ConvNet beats Vision Transformers (ConvNeXt) Paper explained
Swin Transformer V2 - Paper explained
Masked Autoencoders (MAE) Paper Explained