99 тысяч подписчиков
71 видео
OpenAI Sora and DiTs: Scalable Diffusion Models with Transformers
Align your Latents - High-Resolution Video Synthesis Explanation
Extending Context Window of Large Language Models via Positional Interpolation Explained
LoRA: Low-Rank Adaptation of LLMs Explained
Adversarial Diffusion Distillation
Stable/Latent Diffusion - High-Resolution Image Synthesis with Latent Diffusion Models Explained
CodeFusion: A Pre-trained Diffusion Model for Code Generation
MusicGen: Simple and Controllable Music Generation Explained
Leave No Context Behind: Efficient Infinite Context Transformers with Infini-attention
Drag Your GAN: Interactive Point-based Manipulation on the Generative Image Manifold Explained
Visual AutoRegressive Modeling:Scalable Image Generation via Next-Scale Prediction
MiniMax-01: Scaling Foundation Models with Lightning Attention
Direct Preference Optimization (DPO): Your Language Model is Secretly a Reward Model Explained
CoDeF: Content Deformation Fields for Temporally Consistent Video Processing
Stable Diffusion 3: Scaling Rectified Flow Transformers for High-Resolution Image Synthesis
Bayesian Flow Networks (BFN) Explained