APU 96 Go vs RTX 4080 : quel LLM local tourne sur quelle machine ?
Nous avons fait tourner les mêmes six modèles, mêmes fichiers, même llama.cpp, sur un mini-PC APU à 96 Go de mémoire unifiée et sur une RTX 4080 à 16 Go. Débit, concurrence, plafond de contexte, énergie par tâche, image. La réponse tient en une règle et un tableau.
Lire l'article →