AMD a dévoilé sa prochaine gamme de matériel d'entreprise axée sur les architectures Ryzen AI Max et Threadripper Halo, visant l'exécution locale de grands modèles de langage. L'écosystème matériel s'étend des mini-stations de travail compactes de 2 litres aux tours de bureau refroidies par liquide, conçues pour s'affranchir des dépendances envers l'infrastructure cloud pour les développeurs et les clients professionnels.
Mini-PC Ryzen AI Max
Acemagic prend la tête des déploiements au format compact avec sa nouvelle mini-station de travail, construite autour du processeur APU AMD Ryzen AI Max+ PRO 495 à 16 cœurs. Le processeur intègre des graphiques Radeon 8065S ainsi qu'une unité de traitement neuronal (NPU) dédiée offrant une performance d'inférence de 55 TOPS.
Le système peut accueillir jusqu'à 192 Go de mémoire LPDDR5X directement dans son châssis de 2 litres. Les capacités d'extension comprennent des interfaces OCuLink pour les périphériques externes à haut débit, fournissant des E/S évolutives pour le traitement de données locales et les tâches de réglage fin de modèles sans nécessiter de configuration en tour complète.
Stations de travail Threadripper Halo
Le haut de gamme accueille la Threadripper Halo Station, un système de bureau refroidi par liquide conçu pour les charges de travail d'IA à mille milliards de paramètres. La station de travail associe un processeur AMD Threadripper PRO 9995WX à 96 cœurs avec jusqu'à 2 To de mémoire système DDR5 RDIMM à 8 canaux.
L'accélération graphique et de calcul parallèle est assurée par un maximum de quatre GPU Instinct MI350P intégrés dans la même architecture, fournissant un pool collectif de 576 Go de mémoire HBM3e. Cette configuration produit une empreinte mémoire totale du système atteignant 2,6 To, plaçant les capacités de calcul local au même niveau que les nœuds de serveurs montés en rack.
Ces déploiements offrent des alternatives modulaires sur site aux pipelines d'IA basés sur le cloud. Les systèmes Ryzen AI Max ciblent le déploiement en périphérie (edge) local et le développement intermédiaire, tandis que l'architecture Threadripper Halo — dont le lancement commercial est prévu pour 2027 — vise à concurrencer directement les solutions de bureau d'entreprise telles que la DGX Station de NVIDIA en maintenant des modèles à paramètres massifs entièrement au sein des limites du réseau local.
Au-delà des spécifications brutes, le pivot stratégique vers ces systèmes locaux à haute densité représente un changement fondamental dans la façon dont les entreprises gèrent la souveraineté des données et la latence. En s'éloignant du mandat « cloud-first » qui a dominé le paysage de l'IA ces dernières années, AMD parie que la prochaine vague d'adoption par les entreprises privilégiera la sécurité et la prévisibilité des coûts du matériel sur site. L'inclusion du NPU de 55 TOPS dans la série Ryzen AI Max répond spécifiquement au besoin d'inférence en temps réel et à faible latence dans les flux de travail professionnels, permettant aux développeurs d'itérer sur des modèles complexes sans les frais généraux récurrents des appels d'API cloud.




