IA
GPU
Aussi : GPUs · CUDA
En clair
Un GPU est une carte de calcul conçue à l’origine pour l’affichage graphique, capable de mener un très grand nombre d’opérations en parallèle. C’est devenu le matériel de référence pour entraîner et faire tourner les modèles d’IA. Sa mémoire embarquée fixe une limite dure : si le modèle n’y tient pas, il ne tourne pas, quelle que soit la puissance de la machine.
Concrètement
Un modèle de sept milliards de paramètres, une fois compressé, tient sur une carte de huit gigaoctets ; un modèle dix fois plus gros en exige plusieurs.
Pourquoi ça compte
Le budget d’un projet se heurte souvent à cette contrainte matérielle avant toute autre. À l’inverse, acheter de la carte sans avoir mesuré la charge réelle immobilise du capital pour rien.
Définition technique
Processeur graphique massivement parallèle, standard de fait pour entraîner et servir des modèles de deep learning.
Termes liés
Vu dans ces articles
- Cline Desktop veut faire des modèles open-weight de vrais agents de travail14 septembre 2026
- LLM auto-hébergés en agence : choisir selon l’usage, pas le benchmark13 septembre 2026
- Jalapeño : la bataille de l’IA se déplace vers l’inférence25 août 2026
- Qwen, Kimi, DeepSeek : la bataille du coût de l’IA21 août 2026
- SpaceX rachète Cursor : quelles pistes pour sa stratégie IA ?14 août 2026