Articles : Silicon (page 2)

Silicon

Vera Rubin : la fin de l'inférence GPU homogène

NVIDIA Vera Rubin n'est pas qu'un GPU plus rapide : l'inférence éclate en trois tiers (prefill GPU, decode LPU, orchestration CPU) coordonnés par Dynamo.

19 min de lecture
  • NVIDIA Rubin
  • Vera CPU
  • HBM4
  • Groq LPU

Silicon

RTX 5090 vs H100 : quelle carte pour un LLM en local ?

RTX 5090 vs H100 pour faire tourner un LLM en local : 32 Go GDDR7 face à 80 Go HBM3, ce qui tient vraiment en VRAM, et pourquoi ce ne sont pas les mêmes produits.

8 min de lecture
  • RTX 5090
  • H100
  • LLM local
  • VRAM

Silicon

CUDA vs ROCm en 2026 : l'écart réel en production IA

CUDA vs ROCm en 2026 : le débat n'est plus « est-ce que ROCm marche » mais « quel écart reste-t-il ». Versions, parité framework, vrais verrous, sources.

8 min de lecture
  • CUDA
  • ROCm
  • AMD
  • NVIDIA

Silicon

AMD MI355X vs NVIDIA B200/B300 : le vrai match en 2026

AMD MI355X face à NVIDIA B200 et B300 : mémoire, bande passante, FP4 et le vrai écart, le scale-up NVLink et le logiciel. Comparatif sourcé, mi-2026.

6 min de lecture
  • AMD MI355X
  • NVIDIA B200
  • Blackwell
  • CDNA 4