En clair : Jalapeño est l'ASIC d'inférence d'OpenAI, co-conçu avec Broadcom, montré à Hot Chips 2026. Ho dit que des modèles internes (Codex, Sol, Astra) ont accéléré mise en page et vérification dès novembre 2025, ramenant l'idée à la révélation publique à moins de deux ans contre une base interne de 18 mois à deux ans même avec IP existante. L'équipe humaine garde les contrôles Synopsys et Cadence (timing statique, intégrité du signal) avant tape-out. Ce n'est pas un remplacement 2026 de toute la flotte Nvidia.
État des faits : Vérifié le 5 octobre 2026 d'après l'interview Jake Roach / Richard Ho dans Tom's Hardware (30 septembre 2026) et les Q&R sectorielles du même cycle vers le 4 octobre. Détails de stepping et calendrier gen2/gen3 peuvent évoluer avec le silicium.
Jalapeño sur scène
Les circuits intégrés sur mesure (ASIC) permettent aux hyperscalers d'adapter le silicium d'inférence à leurs modèles plutôt que d'acheter uniquement des GPU génériques. Jalapeño est l'ASIC d'inférence co-développé avec Broadcom, dévoilé à Hot Chips 2026, la conférence annuelle où les vendeurs exposent l'architecture avant le déploiement massif.
Ho décrit un design assisté par l'IA avec la stack de modèles d'OpenAI. Travail lancé vers novembre 2025 ; bring-up des noyaux vers mai 2026 quand les premières puces tournent. Du RTL (description register-transfer level) au tape-out : environ neuf mois. De l'idée à la présentation publique : moins de deux ans, contre 18 mois à deux ans auparavant même en réutilisant des blocs IP.
Où l'IA aide et où l'humain tranche
Ho rejette l'idée que les modèles remplacent les ingénieurs : une équipe plus petite et très qualifiée va plus vite car l'IA absorbe les tâches répétitives. Modèles cités : Codex, Sol, puis la famille Astra au fil du projet.
Le sign-off n'a pas sauté. Ho rappelle qu'un bloc « à 99,99 % » côté modèle ne tape-out pas sans les flux EDA standards (Synopsys, Cadence) : analyse de timing statique, intégrité du signal, exigences des fonderies. L'IA raccourcit les itérations ; elle ne suspend pas la physique.
Le stepping B0 apporterait jusqu'à 25 % de performance par watt en plus que A0, d'après le même cycle de reportage. C'est une histoire labo, pas une preuve que chaque rack OpenAI tourne déjà sur Jalapeño à grande échelle.
Limites du roadmap
Clive Chan, figure du hardware OpenAI, est parti chez Anthropic en juin 2026 selon la même couverture. Ho place la gen2 près du tape-out et la gen3 en développement, mais doute de cycles neuf mois d'affilée : outils et maturité process ne suivront pas toujours.
La première architecture a évité empilement 3D et optique co-emballée, choix qui repoussent la complexité. OpenAI construit du silicium d'inférence pour sa stack, pas un substitut fini 2026 à chaque GPU du marché.
Ce qui est établi
OpenAI a compressé le calendrier de Jalapeño avec Broadcom, a montré la puce à Hot Chips, et route l'approbation finale via les mêmes EDA que tout acteur sérieux. Gen2 et gen3 avancent ; Ho reste prudent sur la répétition du cycle le plus rapide.
Les posts qui présentent Jalapeño comme le remplacement total et immédiat de Nvidia, ou qui inventent mémoire et puissance non sourcées chez Tom's Hardware, dépassent les faits. Suivre déploiements réels, gains par stepping en charge, et respect des calendriers de tape-out annoncés.
Sources : Tom's Hardware, interview Richard Ho, 30 septembre 2026.