OpenAI bereidt Jalapeño voor op hun eigen infrastructuur, maar sluit de deur niet uit om het buiten te verkopen

OpenAI ontwikkelt Jalapeño als een inference-accelerator die voornamelijk is ontworpen om aan hun eigen computingbehoeften te voldoen. Richard Ho, hoofd hardware bij het bedrijf, legde aan Tom’s Hardware uit dat de chip mogelijk door andere klanten gebruikt kan worden, hoewel de prioriteit de komende jaren ligt op het voldoen aan de groeiende interne vraag van OpenAI.

De kernpunten van Jalapeño in 20 seconden

  • Jalapeño is de eerste eigen inference-accelerator van OpenAI, ontwikkeld in samenwerking met Broadcom.
  • Het bedrijf voorziet dat deze eind 2026 in zijn computing-infrastructuur wordt uitgerold.
  • OpenAI stelt dat het ook compatibel is met externe modellen zoals DeepSeek R1 en Kimi K2.5.
  • Ho houdt een toekomstige beschikbaarheid voor derden open, maar de huidige prioriteit ligt op intern gebruik.
  • Het ontwerp maakt deel uit van een multigenerationele platform, met Gen 2 al in ontwikkeling.

De positionering van OpenAI is pragmatischer dan commercieel. Het bedrijf presenteert Jalapeño niet als een product dat meteen concurreert met NVIDIA’s accelerators, maar als een onderdeel van haar eigen infrastructuur. Ho erkent dat de hardware mogelijk buiten OpenAI gebruikt kan worden, maar hij verwacht dat de vraag binnen het bedrijf voldoende zal zijn om de productie langdurig te vullen.

Een chip ontworpen rondom inference

OpenAI onthulde Jalapeño in juni 2026 samen met Broadcom. Het definieert de chip als haar eerste AI-processor en als de eerste generatie van een computingplatform dat meerdere generaties zal omvatten. De chip is specifiek ontworpen voor inference-ladingen van grote taalmodellen (LLM), in plaats van een bestaande accelerator aan de behoeften van OpenAI aan te passen.

Volgens OpenAI werd het project in slechts negen maanden van ontwerp tot productie ontwikkeld. Broadcom levert de siliciumimplementatie en netwerktechnologieën, terwijl Celestica instaat voor het fabricageproces van platen, racks en andere benodigde componenten voor grootschalige implementaties. OpenAI heeft op haar beurt de architectuur ontworpen op basis van haar modellen, kernels, inference-software en daadwerkelijke servicemodellen.

Een van de hoofddoelstellingen was de efficiëntie verbeteren. In een datacenter voor kunstmatige intelligentie kan het vergroten van de nuttige arbeid per watt direct de capaciteit verhogen die kan worden ingezet met een bestaande energie-infrastructuur.

De eerste resultaten die OpenAI in augustus publiceerde, ondersteunen deze verwachting. Bij tests met GPT-OSS 120B, DeepSeek R1 en Kimi K2.5 1T behaalde Jalapeño tussen de 1,5 en 1,9 keer meer AI-werk per watt bij maximale prestaties vergeleken met de referentiesystemen. Daarnaast registreerde het systeem een verlaging in latency van 1,7 tot 3,6 keer en in zeer interactieve workloads tot 2,1 tot 4,1 keer meer prestaties. Deze cijfers zijn gebaseerd op de eigen metingen en methodologie van OpenAI.

De deur naar derden blijft open

Het is niet uitgesloten dat Jalapeño uiteindelijk buiten OpenAI wordt gebruikt. Ho vertelde aan Tom’s Hardware dat de accelerator programmeerbaar en universeel is binnen de context ervan, en dat het team modellen kon draaien die niet bij de initiële ontwikkeling waren gebruikt.

Dit is relevant omdat één van de vragen bij ASICs, circuitintegraties ontworpen voor een specifieke toepassing, is in hoeverre ze gebonden zijn aan één enkel model of workload. OpenAI stelt dat Jalapeño niet exclusief voor haar eigen modellen is gecodeerd.

Het team bewees deze flexibiliteit door externe modellen uit te voeren. Volgens OpenAI heeft Jalapeño GPT-OSS 120B, DeepSeek R1 en Kimi K2.5 1T gedraaid. Ho legde ook uit dat de engineers ongeveer twee maanden na ontvangst van een A0-borstproef van de chip in staat waren om DeepSeek en Kimi te draaien, voorafgaand aan de presentatie op Hot Chips.

Dat betekent niet dat OpenAI Jalapeño gaat verkopen als een commercieel product. Ho benadrukt dat de huidige situatie is dat het bedrijf zich eerst richt op haar eigen computingbehoeften. De mogelijkheid om het in andere omgevingen te gebruiken blijft open, zonder dat er een vast plannings- of commerciële aankondiging is.

Daarnaast speelt productiecapaciteit een belangrijke rol. Op grote schaal eigen accelerators uitrollen houdt niet alleen in dat de chip wordt gefabriceerd, maar ook dat er geheugen, netwerken, kaarten, complete systemen en datacentercapaciteit beschikbaar moeten zijn. De strategie die OpenAI samen met Broadcom aankondigt, omvat grootschalige uitrol over meerdere generaties, terwijl OpenAI daarnaast nog steeds gebruikmaakt van NVIDIA-accelerators en andere leveranciers voor zowel training als inference.

Jalapeño maakt deel uit van een bredere strategie

OpenAI positioneert Jalapeño niet als een geïsoleerd project. Het bedrijf spreekt al over een tweede generatie in ontwikkeling en een derde die al vorm krijgt. Het doel is dat elke nieuwe generatie voortbouwt op de ervaring van de vorige, met verbeteringen in snelheid en efficiëntie.

Deze aanpak past bij de groeiende interesse van grote ontwikkelaars van modellen om meer controle te krijgen over de infrastructuur. Het gezamenlijk ontwerpen van modellen, inference-software, geheugen, netwerken en silicon stelt hen in staat om hardware af te stemmen op productievere workloads, die door externe fabrikanten voor verschillende klanten worden geleverd.

Voor OpenAI heeft deze geïntegreerde aanpak directe voordelen: het kunnen draaien van eigen modellen met minder energieverbruik en lagere latentie kan de beschikbare capaciteit vergroten zonder dat het afhankelijk wordt van de aanschaf van meer algemene accelerators. Tegelijkertijd handhaaft het bedrijf een strategie met meerdere leveranciers, waardoor Jalapeño niet direct de vervanging van NVIDIA of andere hardware in haar datacenters betekent.

De zakelijke implicaties blijven dus op de achtergrond. OpenAI beschikt over een accelerator die, volgens eigen tests, in staat is om zowel eigen als externe modellen goed uit te voeren. De prioriteit ligt echter eerst op het voldoen aan de interne vraag; zodra de productiecapaciteit toereikend is en de architectuur de voorsprong behoudt, zou hetzelfde ontwerp mogelijk ook buiten OpenAI worden toegepast. Voorlopig blijft dat een open optie en geen aangekondigd product voor externe klanten.

Veelgestelde vragen

Wat is Jalapeño van OpenAI?

Jalapeño is de eerste inference-accelerator ontworpen door OpenAI, gericht op het efficiënt en met lage latentie uitvoeren van grote taalmodellen.

Wordt Jalapeño aan andere bedrijven verkocht?

OpenAI heeft geen commerciële lancering voor derden aangekondigd. Ho gaf aan dat de chip mogelijk buiten het bedrijf wordt gebruikt, maar dat de huidige prioriteit ligt op het vervullen van de interne computing-behoeften.

Welke modellen kan Jalapeño draaien?

OpenAI heeft resultaten gepubliceerd met GPT-OSS 120B, DeepSeek R1 en Kimi K2.5 1T, naast haar eigen workloads.

Wanneer gaat OpenAI Jalapeño gebruiken?

OpenAI verwacht de uitrol van de chip eind 2026 in haar infrastructuur te starten. Het bedrijf werkt inmiddels ook aan een tweede generatie.

Scroll naar boven