L’essor de l’intelligence artificielle générative et l’intensification des phases d’inférence ont fait émerger un obstacle technique majeur : la gestion du KV cache (stockage temporaire des données de calculs). Ces données contextuelles générées en continu lors des traitements par l’IA sont actuellement gérées directement par les serveurs GPU. Cepend…
Cet article est paru en premier sur le site https://www.lesnumeriques.com/disque-dur-externe/penurie-de-ssd-576-ssd-et-9600-to-par-unite-les-cmx-de-nvidia-menacent-d-assecher-le-marche-n259515.html
