1 тысяч подписчиков
93 видео
February 2015 in Sunnyvale, California.
Episode 5.11 - Thread affinity control
Episode 5.6 - Strip-Mining for Vectorization
Episode 4.6 - Fork-Join Model. OpenMP Tasks
Episode 4.8 - Parallel Reduction
Episode 5.16 - Optimization of Communication- Offload
Episode 3.9 - File IO in MPI Applications on Coprocessors
Episode 2.2 - Details of Intel MIC Architecture
Episode 4.2 - Automatic Vectorization and Array Notation
Episode 5.3 - Optimization of Vectorization: Data Structures
Episode 5.1 - Optimization roadmap
Episode 5.7 - Vectorization Tuning Knobs
Episode 5.18 - Additional Topic- Load Balancing in Heterogeneous Systems
Episode 4.7 - Race Conditions and Mutexes
Episode 5.9 - Elimination of False Cache Line Sharing
Episode 5.17 - Optimization of Communication- MPI
Episode 5.12 - Optimization of Memory Access
Episode 4.9 - Distributed-memory Parallelism and MPI
Episode 5.19 - Closing words
Episode 5.5 - Optimization of Vectorization: Regularizing Pattern
Episode 5.10 - Do you have enough parallelism in your code
Episode 5.4 - Optimization of Vectorization: Alignment and Hints
Episode 5.2 - Scalar Tuning and General Optimization
Attention of Convolutional Neural Network (VGG16)
Episode 5.15 - NUMA and Allocation on First Touch