-+ 0.00%
-+ 0.00%
-+ 0.00%

AMD et Cerebras Systems annoncent un partenariat technique pour fournir une nouvelle solution d'inférence d'IA désagrégée qui combine les solutions AMD Helios Rackscale avec le moteur Cerebras Wafer-Scale

Benzinga·07/23/2026 17:49:04
Diffusion vocale
  • AMD et Cerebras collaborent pour proposer une approche optimisée en termes de charge de travail en matière d'infrastructure d'inférence d'IA à très faible latence.
  • AMD Helios™ et le moteur Cerebras Wafer-Scale fonctionneront comme un seul flux de travail d'inférence désagrégé, combinant le très haut débit des GPU AMD Instinct™ à la génération ultrarapide de jetons du moteur Cerebras Wafer-Scale.
  • Cerebras prévoit de déployer AMD Helios dans ses centres de données, la solution conjointe devant être disponible dans un premier temps via Cerebras Cloud au second semestre 2026.

SAN FRANCISCO et SUNNYVALE, Californie, 23 juillet 2026 (GLOBE NEWSWIRE) -- AMD (NASDAQ : AMD) et Cerebras Systems (NASDAQ : CBRS) ont annoncé un partenariat technique visant à fournir une nouvelle solution d'inférence d'IA désagrégée qui combine les solutions de mise à l'échelle en rack AMD Helios™ avec le moteur Cerebras Wafer-Scale. Dévoilée lors du salon Advancing AI 2026, la solution est conçue pour fournir la latence ultra-faible requise pour les applications d'IA les plus avancées tout en augmentant considérablement le débit et l'efficacité.

La solution conjointe d'AMD et de Cerebras déploiera AMD Helios aux côtés de la technologie Wafer-Scale Engine de Cerebras intégrée dans un flux de travail d'inférence unique pour des performances et une efficacité maximales. AMD Helios fournira un moteur de débit évolutif et performant. La technologie Wafer-Scale Engine de Cerebras permettra un décodage et une génération de jetons ultra-rapides et à très faible latence. Ensemble, les deux moteurs de calcul devraient fournir jusqu'à 5 fois plus de jetons par seconde et par watt (t/s/W).