Tech
Openai Dévoile Sa Puce D'inférence Jalapeño, Jusqu'à 4,1 Fois Plus Performante Pour Les Charges De Travail Interactives

OpenAI a dévoilé sa première puce d'inférence sur mesure, Jalapeño, affirmant qu'elle offre jusqu'à 1,9 fois plus de travail d'IA par watt que les systèmes basés sur Nvidia tout en réduisant les temps de réponse. Testée sur trois modèles publics (GPT-OSS 120B, DeepSeek R1 670B et Kimi K2.5 1T), la puce a montré une performance de 1,5 à 1,9 fois supérieure par watt au débit maximal et une latence de bout en bout 1,7 à 3,6 fois inférieure. Pour les charges de travail très interactives, OpenAI a indiqué une performance 2,1 à 4,1 fois supérieure.
La puce est évaluée à 700 watts, mais la consommation mesurée est restée à 550 watts ou moins. OpenAI prévoit de déployer Jalapeño dans son infrastructure d'ici fin 2026, avec des conceptions de deuxième et troisième générations déjà en développement.
Source : Interesting Engineering
Les plus lus dans cette catégorie
Chargement de l’article…