Forskere fra Peking University har udviklet et nyt system, der gør det markant nemmere for AI at skabe 3D-modeller ud fra tekst eller billeder. Systemet, kaldet aDSL, adresserer et kerneproblem: tidligere AI-modeller har haft svært ved at omsætte høje intentioner til præcis geometri, hvilket har gjort processen upålidelig og svær at kontrollere.

Løsningen ligger i at designe både et nyt programmeringssprog og et multi-agent system, der arbejder sammen. aDSL fokuserer på komposabilitet og rumlig ræsonnering, så agenter kan manipulere geometri gennem relationelle operatorer i stedet for skrøbelige absolutte koordinater. Det gør det muligt at lave fine justeringer, bevare strukturen og fortolke resultaterne – egenskaber der er afgørende for professionelle, der skal bruge 3D-modeller i produkter, arkitektur eller spil.

Systemet følger en Plan-Execute-Critic-loop, hvor det nedbryder brugerens ønske, genererer kode og løbende retter fejl ved hjælp af eksekveringsfeedback. Ifølge forskerne overgår metoden tidligere LLM-baserede tilgange på både tekst-til-form og billede-til-form opgaver, samtidig med at den bevarer eksplicit struktur og redigerbarhed. Det åbner også for avancerede anvendelser som skabelse af leddelte objekter og strukturerede scener – se paperet for detaljer.

For beslutningstagere betyder det, at AI-drevet 3D-produktion bliver mere forudsigelig og kan integreres i eksisterende workflows uden at kræve dyb teknisk indsigt. Virksomheder, der tidligere har afvist AI-genererede 3D-modeller på grund af manglende kontrol, kan nu overveje at genbesøge teknologien. Koden er offentligt tilgængelig på GitHub, hvilket gør det muligt at teste og implementere løsningen internt.