-+ 0.00%
-+ 0.00%
-+ 0.00%

Selon OpenAI, la puce d'inférence Jalapeño augmente les performances par watt jusqu'à 1,9 fois lors des premiers tests

PUBT·08/25/2026 14:31:06
Diffusion vocale
Selon OpenAI, la puce d'inférence Jalapeño augmente les performances par watt jusqu'à 1,9 fois lors des premiers tests
  • OpenAI a publié les premiers résultats comparatifs pour Jalapeño, sa puce d'inférence personnalisée, le 25 août 2026.
  • Sur le GPT-OSS 120B, DeepSeek R1 et Kimi K2.5 ont fourni 1,5 à 1,9 fois plus de travail par watt au débit maximal.
  • La latence de bout en bout était de 1,7 à 3,6 fois inférieure ; les charges de travail interactives offraient des performances 2,1 à 4,1 fois supérieures.
  • Résultats d'InferenceX : pic GPT-OSS mixte TPS/kW 85 448 contre 44 960 ; latence 1,03 s contre 1,80 ; TBT min 0,69 ms contre 1,87 ms.
  • Déploiement prévu dans l'infrastructure interne d'ici la fin de l'année ; fin de l'exploitation dans neuf mois ; la génération 2 est en développement, la génération 3 prend forme.


Avertissement : Ce bulletin d'information a été créé par Public Technologies (PUBT) à l'aide de l'intelligence artificielle générative. Bien que PUBT s'efforce de fournir des informations précises et opportunes, ce contenu généré par l'IA est fourni à titre informatif uniquement et ne doit pas être interprété comme un conseil financier, d'investissement ou juridique. OpenAI Inc. a publié le contenu original utilisé pour générer cette note d'actualité le 25 août 2026 et est seule responsable des informations qu'il contient.