Get in Touch

Course Outline

Overview

Foundations of Heterogeneous Computing Frameworks

The Imperative for Parallel Computing: Addressing Modern Computational Demands

Multi-Core Processors: Architectural Principles and Design Standards

Thread Management: Core Concepts in Parallel Programming Paradigms

Foundations of GPU Software Optimization Workflows

OpenMP: Establishing Standards for Directive-Based Parallel Execution

Practical Application: Executing Complex Workloads on Multi-Core Systems

Foundations of GPU-Accelerated Computing

Leveraging GPUs for High-Performance Parallel Tasks

GPU Programming Frameworks and Architectural Models

Practical Application: Deploying Applications on GPU Hardware

SDKs, Toolchains, and Configuration of GPU Development Environments

Utilizing Specialized High-Performance Libraries

Practical Demonstration: Integrating GPU Tools, Sample Code, and OpenACC Standards

Comprehending the CUDA Programming Framework

Analyzing the CUDA Hardware Architecture

Configuration and Deployment of CUDA Development Environments

Implementing the CUDA Runtime Application Programming Interface

Optimizing CUDA Memory Management Strategies

Advanced Utilization of CUDA API Capabilities

Efficient Global Memory Access: Techniques for Optimization in CUDA

Enhancing Data Throughput: Leveraging CUDA Streams for Transfer Optimization

Strategic Use of Shared Memory Resources in CUDA

Implementing Atomic Operations and Synchronization Instructions in CUDA

Applied Example: Digital Image Processing Workflows Using CUDA

Scalable Multi-GPU Computational Strategies

Advanced Performance Profiling and Sampling on NVIDIA / CUDA Platforms

Implementing CUDA Dynamic Parallelism for Adaptive Kernel Execution

Synthesis of Key Findings and Final Recommendations

Requirements

  • C Language Programming Proficiency
  • Linux GCC Compiler Environment
 21 Hours

Number of participants


Price per participant

Testimonials (1)

Upcoming Courses

Related Categories