LeCompute, analyses techniques de l'infrastructure et du compute IA

À la une

Threadripper Halo Station vs DGX Station : comment comparer leur mémoire ?

Votre modèle dépasse la mémoire d’un GPU. AMD et NVIDIA proposent deux façons de lui faire de la place, mais leur capacité totale ne suffit pas à choisir.

8 min de lecture

LeCompute décortique l'infrastructure de l'IA : GPU et silicium, mémoire HBM et interconnexions, runtimes d'inférence comme vLLM ou llama.cpp, quantification et edge AI. Des analyses techniques et des benchmarks reproductibles, du silicium au code, sans hype.

Read our articles in English

Analyses techniques de l'infrastructure IA

Voir tous les dossiers →

Silicon

Ryzen AI Halo face au DGX Spark : ce que 128 Go ne disent pas

Ryzen AI Halo et DGX Spark proposent 128 Go, mais leurs performances changent selon le modèle et le protocole. Mesures constructeur et essais indépendants audités.

20 min de lecture
  • Ryzen AI Halo
  • DGX Spark
  • Ryzen AI Max+ 395
  • LLM local

Silicon

BlueField-4 face à Pensando Salina : le DPU entre dans le chemin de l'inférence

BlueField-4 et Pensando Salina ne calculent aucun token. Ils déplacent le réseau, le stockage, la sécurité et certains transferts du KV cache hors du CPU hôte. Voici le chemin de données qui peut libérer le GPU, ou seulement déplacer le goulot.

13 min de lecture
  • BlueField-4
  • Pensando Salina
  • DPU
  • KV cache

Runtimes

MLPerf RAG mesure enfin toute la chaîne, pas encore le service

MLPerf E2E-RAG chronomètre l'ingestion, la recherche, le reranking et quatre rôles LLM dans une boucle multi-hop. Son débit est comparable, mais son scénario offline et sa précision de référence à 35 % bornent le verdict.

16 min de lecture
  • MLPerf
  • RAG
  • MLCommons
  • GPT-OSS

Silicon

UALink 2.0 contre NVLink 6 : quand le réseau calcule l'all-reduce

UALink 2.0 standardise le calcul dans le réseau ; NVLink 6 l'intègre dans ses switches. Voici ce que ce mécanisme change, et pourquoi Helios et Vera Rubin restent impossibles à départager.

16 min de lecture
  • UALink 2.0
  • UALoE
  • NVLink 6
  • in-network compute