Perplexity har udsendt en bærbar computer bygget på NVIDIAs DGX Spark-platform, der samler lokale AI-modeller, en harness, en OS-håndhævet sandbox og connectors i ét system. Det betyder, at virksomheder kan køre AI-arbejdsgange lokalt uden per-token-omkostninger for de lokale trin – et markant brud med den cloud-baserede betalingsmodel, der dominerer i dag. Læs hele meddelelsen hos MarkTechPost.
For beslutningstagere er det vigtigste ikke hardwaren i sig selv, men hvad den signalerer: AI-udførelse flytter fra centraliserede cloud-datacentre til lokale enheder. Det har direkte konsekvenser for omkostningsstrukturer, dataprivatliv og forhandlingsposition over for cloud-leverandører. Hvis lokale trin kører uden token-afgift, kan virksomheder med store, gentagne arbejdsbelastninger reducere variable omkostninger markant – og samtidig beholde følsomme data på egen infrastruktur.
Sandboxen, som er håndhævet på OS-niveau, adresserer desuden et centralt sikkerhedsproblem: at køre tredjepartsmodeller eller -agenter i produktionsmiljøer. Det gør løsningen mere attraktiv for regulerede brancher som finans og sundhed, hvor kontrol med dataflow er afgørende. NVIDIAs DGX Spark-specifikationer understøtter denne form for lokal inferens med høj ydeevne, hvilket gør teknologien anvendelig til krævende opgaver.
Strategisk set er dette et signal til både købere og konkurrenter: Perplexity positionerer sig ikke kun som en søge- eller chatbot-udbyder, men som leverandør af en komplet lokal AI-infrastruktur. For virksomheder, der overvejer at bygge, købe eller investere i AI-kapacitet, er spørgsmålet ikke længere kun, hvilken model man skal bruge, men hvor arbejdsbyrden skal køre – og til hvilken pris.
