
Lec 26: Memory and throughput techniques for LLM training
Lec 26: Techniques de mémoire et de débit pour l'entraînement des LLM
Thema UYFP

Lec 26: Techniques de mémoire et de débit pour l'entraînement des LLM

Codez avec moi : exécutez votre code Polars sur GPU

Conception numérique et architecture informatique : L20b : Programmation GPU (Printemps 2026)

Conception numérique et architecture des ordinateurs : C19 : Architectures SIMD (Printemps 2026)

Stanford CS336 Modélisation du langage à partir de zéro | Printemps 2026 | Cours 5 : GPU, TPU

Programmation CUDA pour NVIDIA H100s – Cours complet

CUDA : Nouvelles fonctionnalités et perspectives | NVIDIA GTC

CUDA Live: Votre Guide de Programmation Parallèle

Libérer les performances du GPU avec le tiling CUDA

Comp. Arch. - Lecture 30 : Programmation GPU (Automne 2025)

Comp. Arch. - Cours 29 : Architectures SIMD et GPU (Automne 2025)

Architecture informatique - Cours 28 : Architectures de réseaux systoliques (Automne 2025)

Comp. Arch. - Leçon 21 : Multiprocesseurs II, Ordonnancement de mémoire et cohérence de cache (Automne 2025)

Exploration approfondie : Comment utiliser cuTile en Python

Accélérer la science et l'ingénierie avec les bibliothèques NVIDIA CUDA-X | NVIDIA GTC D.C.

CUDA 13.0 — Nouvelles fonctionnalités et au-delà | NVIDIA GTC D.C.


Implémentation d'un nouvel algorithme avec des noyaux CUDA | Cours CUDA C++ Partie 3

Asynchronisme et flux CUDA | Cours CUDA C++ - Partie 2

Accélérer les applications avec des algorithmes parallèles | Classe CUDA C++ Partie 1

Jour 1 : Jack Dongarra - Calcul haute performance et algorithmes imprudemment responsables

Inmaculada García : « L’informatique du futur doit aussi être une informatique durable »

Gagner la course : Multithreading et vous | Andrew Joy | NZGDC 2025

Cours de Programmation CUDA – Calcul Haute Performance avec GPU