
IA
La puce d'inférence Jalapeño d'OpenAI, codéveloppée avec Broadcom, embarque 216 GiB de HBM4 et atteint 27 EFLOP/s par système de 2 048 accélérateurs. Son vice-président du matériel explique comment les propres modèles d'OpenAI ont aidé à la concevoir.