OpenAI har annonceret et nyt API-tjenesteniveau kaldet Ultrafast, der kører GPT-5.6 Sol op til 14 gange hurtigere end standardtilbuddet. Tjenesten, der er drevet af Cerebras-hardware, leverer op til 750 output-tokens per sekund. Det skriver OpenAI i en officiel meddelelse.

For beslutningstagere, der bygger produkter eller tjenester med realtidskrav – fx chatbots, kundesupport eller kodningsassistenter – betyder den markant højere hastighed, at AI-svar kan leveres med en latenstid, der nærmer sig menneskelig samtalehastighed. Det kan ændre brugeroplevelsen fra at vente på et svar til at opleve en flydende dialog, hvilket kan være afgørende for adoption i kundevendte applikationer.

Det er værd at bemærke, at hastigheden kommer fra Cerebras' specialiserede hardware, ikke fra en ny modelversion. Det betyder, at virksomheder kan opnå ydelsesforbedringer uden at skulle tilpasse deres applikationer til en ny model. Samtidig signalerer partnerskabet, at OpenAI aktivt udnytter alternativ infrastruktur for at imødekomme efterspørgslen på hurtigere inferens – en tendens, der kan få betydning for, hvordan AI-kapacitet købes og leveres fremover.

For dem, der overvejer at investere i eller bygge på OpenAI's platform, er det relevant at vurdere, om Ultrafast-tjenesten kan løfte deres specifikke use case. Især applikationer, hvor latenstid er en flaskehals, kan få et konkurrencemæssigt løft. Men det er også værd at holde sig for øje, at den øgede hastighed kan komme med en højere pris – noget OpenAI ikke har specificeret i meddelelsen.